昇腾310P3适配yolo
收藏回复举报
昇腾310P3适配yolo
t('forum.solved') 已解决
新人帖
发表于2025-08-12 14:59:11
0 查看

我的设备环境是这样:

npu:310P3

驱动版本:npu-smi 24.1.0.1

CANN版本:version=7.1.0.3

系统版本:Linux taishan2280 5.15.0-143-generic #153-Ubuntu SMP Fri Jun 13 19:13:07 UTC 2025 aarch64 aarch64 aarch64 GNU/Linux

python环境:3.10

我安装了torch 2.6.0 和 torchvision 0.21.0,同时安装了torch-npu 2.6.0

然后我开始尝试训练数据,训练脚本如下:

import os

import torch

import torch_npu

from ultralytics import YOLO

LOGICAL_ID = 6  # 固定逻辑 ID

if __name__ == '__main__':

    # 固定绑定逻辑 ID 6

    os.environ["ASCEND_VISIBLE_DEVICES"] = str(LOGICAL_ID)

    torch.npu.set_device(f"npu:{LOGICAL_ID}")

    print(f"绑定到逻辑 NPU ID: {LOGICAL_ID}")

    print("NPU available:", torch.npu.is_available())

    print("NPU count:", torch.npu.device_count())

    print("Current NPU:", torch.npu.current_device())

    # 初始化模型

    model = YOLO("yolo11.yaml").load("yolo11n.pt")

    model.to(f"npu:{LOGICAL_ID}")

    # 开始训练

    results = model.train(

        data="/data/Dataset/data.yaml",

        optimizer='auto',

        epochs=300,

        imgsz=1280,

        device=f"npu:{LOGICAL_ID}",

        batch=2,

        workers=8,

        patience=0

    )

npu-smi info如下:

cke_15944.png

我的本意是想把训练跑在npu为6的处理器上,但是运行脚本的时候会报错:

cke_32805.png

我不确定是不是因为我的torch、torchvison、torch-npu的版本有问题,导致无法开始训练

我要发帖子