目前正在尝试使用CANN8.0.0部署某onnx模型,网络结构类似yolov8,只推理不训练。在论坛搜索时看到有大佬写的在Ascend上直接运行onnxruntime的帖子,发现onnxruntime对昇腾有直接支持onnxruntime/docs/execution-providers/community-maintained/CANN-ExecutionProvider.md at gh-pages · microsoft/onnxruntime · GitHub
我想请问下直接使用onnxrutime和手动转om模型并调用aclruntime进行推理有性能差异吗?昇腾官方更推荐哪种部署方式,为什么?
目前正在尝试使用CANN8.0.0部署某onnx模型,网络结构类似yolov8,只推理不训练。在论坛搜索时看到有大佬写的在Ascend上直接运行onnxruntime的帖子,发现onnxruntime对昇腾有直接支持onnxruntime/docs/execution-providers/community-maintained/CANN-ExecutionProvider.md at gh-pages · microsoft/onnxruntime · GitHub
我想请问下直接使用onnxrutime和手动转om模型并调用aclruntime进行推理有性能差异吗?昇腾官方更推荐哪种部署方式,为什么?