使用LoRA微调llama2_7b模型时运行报错
收藏回复举报
使用LoRA微调llama2_7b模型时运行报错
t('forum.solved') 已解决
发表于2024-08-15 16:46:01
0 查看

环境配置

裸金属服务器,配备8张910 NPU,相关软件环境如下表所示:

OSEulerOS 2.0 SP8
NPU910
Driver23.0.0
CANN toolki+kernels8.0.RC3
MindSpore2.3.0
Mindformers1.2.0

问题描述

参考Mindformers官网提供的llama2使用文档,使用LoRA微调llama2_7b模型时,运行失败。

运行命令:

bash scripts/msrun_launcher.sh "run_mindformer.py \
 --config configs/llama2/lora_llama2_7b.yaml \
 --train_dataset_dir /{path}/alpaca-fastchat4096.mindrecord \
 --load_checkpoint /{path}/llama2_7b.ckpt \
 --auto_trans_ckpt False \
 --use_parallel True \
 --run_mode finetune" 8

llama2_7b.ckpt下载路径为:https://ascend-repo-modelzoo.obs.cn-east-2.myhuaweicloud.com/MindFormers/llama2/llama2_7b.ckpt

使用默认配置。

msrun_log/work_0.log报错如下:

cke_833.png

请问这个是什么原因导致的呢?如何修复?

谢谢!

本帖最后由 匿名用户2024/08/15 17:33:41 编辑

我要发帖子