华为计算微信公众号
昇腾AI开发者公众号
华为计算微博
华为计算今日头条
RT,请问是否310B芯片不支持cube和vector的并行执行/异步执行。
也就是不支持在循环中发射两个matmul,然后中间使用上一轮matmul计算的数据执行vector操作,最后iterateall获取本轮数据交给下一轮vector操作。
那么如果不支持并行/异步操作,是否MM1(a:vecout,b:gm,c:vecin)->VEC1->MM2(a:vecout,b:vecout,c:gm), a为复用数据,mm1计算的c变成mm2的b, 其的流水如下:
我要发帖子
RT,请问是否310B芯片不支持cube和vector的并行执行/异步执行。
也就是不支持在循环中发射两个matmul,然后中间使用上一轮matmul计算的数据执行vector操作,最后iterateall获取本轮数据交给下一轮vector操作。
那么如果不支持并行/异步操作,是否MM1(a:vecout,b:gm,c:vecin)->VEC1->MM2(a:vecout,b:vecout,c:gm), a为复用数据,mm1计算的c变成mm2的b, 其的流水如下: