---
title: qwen2.5-32b推理报错内存不足-昇腾社区
description: 使用 1.0.0-300I-Duo-py311-openeuler24.03-lts 的Docker镜像，在310P上部署了qwen2.5-32b模型。在执行 /usr/local/Ascend/atb-models/examples/run_pa.py 时，程序报错提示NPU内存不足，并具体指出NPU0卡的内存不足。
keywords: qwen2.5;MindIE;内存不足
url: https://www.hiascend.com/document/caselibrary/detail/topic_0000002549203555
section: (其他)
---

# qwen2.5-32b推理报错内存不足-昇腾社区

URL: https://www.hiascend.com/document/caselibrary/detail/topic_0000002549203555
描述: 使用 1.0.0-300I-Duo-py311-openeuler24.03-lts 的Docker镜像，在310P上部署了qwen2.5-32b模型。在执行 /usr/local/Ascend/atb-models/examples/run_pa.py 时，程序报错提示NPU内存不足，并具体指出NPU0卡的内存不足。
关键词: qwen2.5;MindIE;内存不足

昇腾文档 [了解详情](https://www.hiascend.com/document)

故障案例 [了解详情](https://www.hiascend.com/document/caselibrary)

qwen2.5-32b推理报错内存不足

qwen2.5-32b推理报错内存不足

2026/02/05

459

问题信息

| 问题来源 | 产品大类 | 关键字 |
| --- | --- | ---|
| 社区工单 | 模型推理 | qwen2.5、MindIE、内存不足 |

#### 问题现象描述

使用 1.0.0-300I-Duo-py311-openeuler24.03-lts 的Docker镜像，在310P上部署了qwen2.5-32b模型。在执行 /usr/local/Ascend/atb-models/examples/run_pa.py 时，程序报错提示NPU内存不足，并具体指出NPU0卡的内存不足。

图1日志信息：RuntimeError: NPU out of memory. Tried to allocate 542.00 MiB (NPU 0; 43.24 GiB total capacity; 6.65 GiB already allocated; 12.34 GiB reserved)

#### 原因分析

执行 npu-smi info 命令查询NPU信息，发现npu6和npu7几乎处于空闲状态，表明资源未被合理分配和充分利用。

图2NPU信息

#### 解决措施

在创建Docker容器时，确保将模型需要使用的NPU卡都挂载进容器中（如图2中的npu4、npu5、npu6、npu7），以便模型能充分利用可用资源。同时，可通过环境变量指定模型运行在哪几张卡上，操作命令为：export ASCEND_RT_VISIBLE_DEVICES=0,1,2,3,4,5,6,7。

本页内容

- 问题信息
- 问题现象描述
- 原因分析
- 解决措施
