我的设备环境是这样:
npu:310P3
驱动版本:npu-smi 24.1.0.1
CANN版本:version=7.1.0.3
系统版本:Linux taishan2280 5.15.0-143-generic #153-Ubuntu SMP Fri Jun 13 19:13:07 UTC 2025 aarch64 aarch64 aarch64 GNU/Linux
python环境:3.10
我安装了torch 2.6.0 和 torchvision 0.21.0,同时安装了torch-npu 2.6.0
然后我开始尝试训练数据,训练脚本如下:
import os
import torch
import torch_npu
from ultralytics import YOLO
LOGICAL_ID = 6 # 固定逻辑 ID
if __name__ == '__main__':
# 固定绑定逻辑 ID 6
os.environ["ASCEND_VISIBLE_DEVICES"] = str(LOGICAL_ID)
torch.npu.set_device(f"npu:{LOGICAL_ID}")
print(f"绑定到逻辑 NPU ID: {LOGICAL_ID}")
print("NPU available:", torch.npu.is_available())
print("NPU count:", torch.npu.device_count())
print("Current NPU:", torch.npu.current_device())
# 初始化模型
model = YOLO("yolo11.yaml").load("yolo11n.pt")
model.to(f"npu:{LOGICAL_ID}")
# 开始训练
results = model.train(
data="/data/Dataset/data.yaml",
optimizer='auto',
epochs=300,
imgsz=1280,
device=f"npu:{LOGICAL_ID}",
batch=2,
workers=8,
patience=0
)
npu-smi info如下:

我的本意是想把训练跑在npu为6的处理器上,但是运行脚本的时候会报错:

我不确定是不是因为我的torch、torchvison、torch-npu的版本有问题,导致无法开始训练
我的设备环境是这样:
npu:310P3
驱动版本:npu-smi 24.1.0.1
CANN版本:version=7.1.0.3
系统版本:Linux taishan2280 5.15.0-143-generic #153-Ubuntu SMP Fri Jun 13 19:13:07 UTC 2025 aarch64 aarch64 aarch64 GNU/Linux
python环境:3.10
我安装了torch 2.6.0 和 torchvision 0.21.0,同时安装了torch-npu 2.6.0
然后我开始尝试训练数据,训练脚本如下:
import os
import torch
import torch_npu
from ultralytics import YOLO
LOGICAL_ID = 6 # 固定逻辑 ID
if __name__ == '__main__':
# 固定绑定逻辑 ID 6
os.environ["ASCEND_VISIBLE_DEVICES"] = str(LOGICAL_ID)
torch.npu.set_device(f"npu:{LOGICAL_ID}")
print(f"绑定到逻辑 NPU ID: {LOGICAL_ID}")
print("NPU available:", torch.npu.is_available())
print("NPU count:", torch.npu.device_count())
print("Current NPU:", torch.npu.current_device())
# 初始化模型
model = YOLO("yolo11.yaml").load("yolo11n.pt")
model.to(f"npu:{LOGICAL_ID}")
# 开始训练
results = model.train(
data="/data/Dataset/data.yaml",
optimizer='auto',
epochs=300,
imgsz=1280,
device=f"npu:{LOGICAL_ID}",
batch=2,
workers=8,
patience=0
)
npu-smi info如下:
我的本意是想把训练跑在npu为6的处理器上,但是运行脚本的时候会报错:
我不确定是不是因为我的torch、torchvison、torch-npu的版本有问题,导致无法开始训练