使用2张Atlast300I Duo 96G卡,docker镜像方式运行DeepSeek-R1-Distill-Qwen-32B模型,推理速度很慢。
收藏回复举报
使用2张Atlast300I Duo 96G卡,docker镜像方式运行DeepSeek-R1-Distill-Qwen-32B模型,推理速度很慢。
t('forum.solved') 已解决
新人帖
发表于2025-07-09 09:43:45
0 查看

总共有4张Atlast300I Duo 96G卡,使用了其中2张卡运行DeepSeek-R1-Distill-Qwen-32B,docker镜像使用的是swr.cn-south-1.myhuaweicloud.com/ascendhub/mindie:2.0.RC2-300I-Duo-py311-openeuler24.03-lts。   

启动容器命令:

docker run -it -d --net=host --shm-size=180g \

    --name ds32bfp16 \

    --restart=always \

    --privileged \

    --device=/dev/davinci_manager \

    --device=/dev/hisi_hdc \

    --device=/dev/devmm_svm \

    --device=/dev/davinci0 \

    --device=/dev/davinci1 \

    --device=/dev/davinci2 \

    --device=/dev/davinci3 \

    -v /usr/local/Ascend/driver:/usr/local/Ascend/driver:ro \

    -v /usr/local/sbin:/usr/local/sbin:ro \

    -v /data/ds32bfp16:/path-to-weights:ro \

swr.cn-south-1.myhuaweicloud.com/ascendhub/mindie:2.0.RC2-300I-Duo-py311-openeuler24.03-lts bash

运行模型成功:

cke_143.png

cke_45597.png

我要发帖子