msprof 在多核情况mte2 l2全miss场景下,根据profiling mte2时间,计算得到的带宽值超过了理论带宽
收藏回复举报
msprof 在多核情况mte2 l2全miss场景下,根据profiling mte2时间,计算得到的带宽值超过了理论带宽
t('forum.solved') 已解决
发表于2025-02-12 09:23:20
0 查看

背景:通过ascend c构造一个mte2 从 gm_to_l1场景,并且通过msprof进行profling。发现在搬移代码后增加操作指令(如while循环),计算得到的带宽会超过理论带宽

数据如下:

每个核处理搬移的数据都是12800*128*128 FP16的大小,core_num表示用的核数,while:0表示整个算子只有搬移代码;while:50表示在搬移代码后,增加了一个while 50的循环代码, 循环内容为变量累加1.

根据以上方式,发现在while:50的情况下,带宽会超过理论带宽1.2T

本帖最后由 匿名用户2025/02/12 10:27:42 编辑

我要发帖子