在论坛里看到了fp16和fp32的算力值计算方法,
fp16理论值计算方式:
cube:16 * 16* 16 * 频率 * AI核数量 * 2
vector:16 * 16 * 频率 * vector核数量
算力值:cube算力值 + vector算力值
fp32理论值计算方式:
cube: 8 * 16 * 8 * 频率 * AI核数量 * 2
vector:8 * 16 * 频率* vector核数量
算力值:cube算力值 + vector算力值
请问一下有没有int8 和 bf16 数据的理论算力计算方法。
按照上面的公式推,int8 理论值应该是fp16的两倍吗,fp16和bf16是否理论上没区别?
在论坛里看到了fp16和fp32的算力值计算方法,
fp16理论值计算方式:
cube:16 * 16* 16 * 频率 * AI核数量 * 2
vector:16 * 16 * 频率 * vector核数量
算力值:cube算力值 + vector算力值
fp32理论值计算方式:
cube: 8 * 16 * 8 * 频率 * AI核数量 * 2
vector:8 * 16 * 频率* vector核数量
算力值:cube算力值 + vector算力值
请问一下有没有int8 和 bf16 数据的理论算力计算方法。
按照上面的公式推,int8 理论值应该是fp16的两倍吗,fp16和bf16是否理论上没区别?