华为计算微信公众号
昇腾AI开发者公众号
华为计算微博
华为计算今日头条
我在使用 昇腾 Atlas 800 服务器(Ascend 910 芯片) 进行模型推理测试时,发现虽然任务在 NPU 上运行,但整体性能提升有限,推理速度与 GPU 相近甚至略慢。同时,CPU 占用率却一直维持在 200% 以上(多核系统)。
请问出现这种情况的原因可能是什么?应该如何优化,才能充分发挥昇腾硬件的算力优势?
我要发帖子
我在使用 昇腾 Atlas 800 服务器(Ascend 910 芯片) 进行模型推理测试时,发现虽然任务在 NPU 上运行,但整体性能提升有限,推理速度与 GPU 相近甚至略慢。同时,CPU 占用率却一直维持在 200% 以上(多核系统)。
请问出现这种情况的原因可能是什么?应该如何优化,才能充分发挥昇腾硬件的算力优势?