华为ModelArts微调Qwen14B实录(2)---遭遇torch变化一些小坑
·
在ModelArts上设置好前面说的配置后,一开始环境是没错的,基本上直接就能训练,torch、torch_npu的版本是match的

版本也没错

但是下载完llamafactory之后就不行了
git clone https://github.com/hiyouga/LLaMA-Factory.git
cd LLaMA-Factory
pip install -e ".[torch_npu,metrics]"
版本都不对了

torch变成了2.10.0,torchvison变成跟它匹配的0.25.0,这样跟torch_npu又不匹配了。结果下载个模型啥的都报错,训练也自然是不行的。

所以装完llamafactory之后要重新安装一下torch那些
# 先卸掉当前 torch 和 torchaudio、torchvision
pip uninstall torch torchaudio torchvision -y
# 安装 torch 2.7.1
pip install torch==2.7.1 --index-url http://pip.modelarts.private.com:8888/repository/pypi/simple --trusted-host pip.modelarts.private.com
# 安装 torchaudio2.7.1
pip install torchaudio==2.7.1 --index-url http://pip.modelarts.private.com:8888/repository/pypi/simple --trusted-host pip.modelarts.private.com
# 然后尝试安装 torchvision 0.22.1
pip install torchvision==0.22.1 --index-url http://pip.modelarts.private.com:8888/repository/pypi/simple --trusted-host pip.modelarts.private.com
然后就可以下载模型并开始实验啦

更多推荐
所有评论(0)