项目简介:
根据https://github.com/xxxkkw/DeepSeek-Atlas-Chat开源项目部署的DeepSeek-R1-Distill-Qwen-1.5B模型
软件情况:
- python3.9
- pytorch2.0
- onnx 1.17
- CANN最开始7.0RC1 后尝试8.0.0RC3
- 与github项目推荐版本一致

问题一:
起初是在烧录镜像后自带的7.0RC1上进行ATC模型转换的,报错如附录,大概是
这两个问题,后面试了几次还是有DynamicQuantV2算子没有被注册的问题。
后面尝试更新CANN版本到8.0RC3后再次尝试
在使用atc进行模型转换时报图片中的错误应该怎么解决呢?(是按照DeepSeek-R1-Distill-Qwen-1.5B模型->onnx格式->量化->板端部署算子->板端atc工具转换来的) 
问题2:
根据开源项目【CANN训练营】Atlas 200I DK A2开发板运行ChatYuan-large对话机器人应用-云社区-华为云[https://bbs.huaweicloud.com/blogs/405188#H111]进行ATC模型转换时报错如下: 
问了一下AI,说可能是内存不够或者TBE相关问题,想请教一下具体是什么问题?怎么解决?
问题3
在昇腾官网上几乎没看到关于200I上部署LLM的案例,DeepSeek专区也是针对于300I、800I,请问想在200I上部署LLM有什么推荐或者参考?[https://https://]()
附录


项目简介:
根据https://github.com/xxxkkw/DeepSeek-Atlas-Chat开源项目部署的DeepSeek-R1-Distill-Qwen-1.5B模型
软件情况:
问题一:
起初是在烧录镜像后自带的7.0RC1上进行ATC模型转换的,报错如附录,大概是
这两个问题,后面试了几次还是有DynamicQuantV2算子没有被注册的问题。
后面尝试更新CANN版本到8.0RC3后再次尝试
在使用atc进行模型转换时报图片中的错误应该怎么解决呢?(是按照DeepSeek-R1-Distill-Qwen-1.5B模型->onnx格式->量化->板端部署算子->板端atc工具转换来的)
问题2:
根据开源项目【CANN训练营】Atlas 200I DK A2开发板运行ChatYuan-large对话机器人应用-云社区-华为云[https://bbs.huaweicloud.com/blogs/405188#H111]进行ATC模型转换时报错如下:
问了一下AI,说可能是内存不够或者TBE相关问题,想请教一下具体是什么问题?怎么解决?
问题3
在昇腾官网上几乎没看到关于200I上部署LLM的案例,DeepSeek专区也是针对于300I、800I,请问想在200I上部署LLM有什么推荐或者参考?[https://https://]()
附录