LLaMA-Factory环境配置与WebUI启动全攻略：从CUDA适配到依赖踩坑 | 极客日志

Python

LLaMA-Factory环境配置与WebUI启动全攻略：从CUDA适配到依赖踩坑

最近在本地部署LLaMA-Factory时，踩了一连串环境配置的坑——从GitHub克隆失败、CUDA不可用到虚拟环境依赖缺失，最终成功启动WebUI。这篇文章就把完整的排错过程和解决方案整理出来，希望能帮到遇到类似问题的同学。一、问题背景：本地部署LLaMA-Factory的核心诉求目标是在Windows 10环境下，基于Anaconda创建虚拟环境，部署LLaMA-Factory并启动We…

魔尊发布于 2026/4/6更新于 2026/7/2862K 浏览

最近在本地部署LLaMA-Factory时，踩了一连串环境配置的坑——从GitHub克隆失败、CUDA不可用到虚拟环境依赖缺失，最终成功启动WebUI。这篇文章就把完整的排错过程和解决方案整理出来，希望能帮到遇到类似问题的同学。

一、问题背景：本地部署LLaMA-Factory的核心诉求

目标是在Windows 10环境下，基于Anaconda创建虚拟环境，部署LLaMA-Factory并启动WebUI，利用本地NVIDIA MX230显卡（2GB显存）实现GPU加速。但从克隆仓库开始，就遇到了一系列报错，主要涉及三类问题：

仓库克隆失败（GitHub连接重置、Gitee 403权限拒绝）；
PyTorch CUDA支持缺失（报'Torch not compiled with CUDA enabled'）；
虚拟环境依赖缺失（直接运行WebUI报'ModuleNotFoundError: No module named 'torch''）。

二、核心报错解析与分步解决方案

坑1：仓库克隆失败——网络限制与镜像选择

报错现象

从GitHub克隆时提示连接重置，从某Gitee镜像克隆时提示403权限拒绝：

(base) PS E:\pc-project> git clone --depth 1 https://github.com/hiyouga/LLaMA-Factory.git Cloning into 'LLaMA-Factory'... fatal: unable to access 'https://github.com/hiyouga/LLaMA-Factory.git/': Recv failure: Connection was reset (base) PS E:\pc-project> git clone https://gitee.com/qzl9999/LLaMA-Factory.git Cloning into 'LLaMA-Factory'... remote: [session-6b44feb3] Access denied fatal: unable to access 'https://gitee.com/qzl9999/LLaMA-Factory.git/': The requested URL returned error: 403

原因分析

GitHub克隆失败是国内网络访问限制导致；Gitee 403是因为选择的镜像仓库权限设置问题（非公开可克隆）。

解决方案

优先选择GitHub国内镜像站，配合Git网络配置优化；备选方案使用官方维护的Gitee镜像：

# 1. 配置Git超时与网络参数（避免连接超时） git config --global http.lowSpeedLimit 0 git config --global http.lowSpeedTime 999999 git config --global http.timeout 300 # 2. 使用GitHub镜像站克隆（推荐） git clone --depth 1 https://github.91chi.fun/https://github.com/hiyouga/LLaMA-Factory.git # 3. 备选：使用Gitee官方维护镜像 rm -rf LLaMA-Factory # 删除之前失败的文件夹 git clone https://gitee.com/mirrors_LLaMA-Factory/LLaMA-Factory.git

如果Git命令仍失败，可直接手动下载源码压缩包：访问https://github.com/hiyouga/LLaMA-Factory/archive/refs/heads/main.zip，解压后重命名为'LLaMA-Factory'即可。

坑2：CUDA不可用——PyTorch版本错配

相关免费在线工具

curl 转代码
解析常见 curl 参数并生成 fetch、axios、PHP curl 或 Python requests 示例代码。在线工具，curl 转代码在线工具，online
Base64 字符串编码/解码
将字符串编码和解码为其 Base64 格式表示形式即可。在线工具，Base64 字符串编码/解码在线工具，online
Base64 文件转换器
将字符串、文件或图像转换为其 Base64 表示形式。在线工具，Base64 文件转换器在线工具，online
Markdown转HTML
将 Markdown（GFM）转为 HTML 片段，浏览器内 marked 解析；与 HTML转Markdown 互为补充。在线工具，Markdown转HTML在线工具，online
HTML转Markdown
将 HTML 片段转为 GitHub Flavored Markdown，支持标题、列表、链接、代码块与表格等；浏览器内处理，可链接预填。在线工具，HTML转Markdown在线工具，online
JSON 压缩
通过删除不必要的空白来缩小和压缩JSON。在线工具，JSON 压缩在线工具，online

>>> import torch >>> torch.cuda.current_device() Traceback (most recent call last): File "<stdin>", line 1, in <module> File "...\torch\cuda\__init__.py", line 403, in _lazy_init raise AssertionError("Torch not compiled with CUDA enabled") AssertionError: Torch not compiled with CUDA enabled

PyTorch编译配置： PyTorch built with: ... - Build settings: ... USE_CUDA=0, ...

# 在PowerShell中执行，查看显卡信息 nvidia-smi

# 1. 激活llama_factory虚拟环境 conda activate llama_factory # 2. 卸载CPU版PyTorch pip uninstall torch -y pip cache purge # 清理缓存，避免安装冲突 # 3. 安装适配CUDA 12.5的PyTorch（cu124版本兼容CUDA 12.5） pip install torch==2.4.0 torchvision==0.19.0 torchaudio==2.4.0 --index-url https://download.pytorch.org/whl/cu124

>>> import torch >>> print("CUDA是否可用：", torch.cuda.is_available()) # 输出True即成功 >>> print("GPU名称：", torch.cuda.get_device_name(0)) # 输出NVIDIA GeForce MX230 >>> print("PyTorch版本：", torch.__version__) # 输出2.4.0+cu124

(base) PS E:\pc-project\LLaMA-Factory> & D:/python/miniconda3/python.exe e:/pc-project/LLaMA-Factory/src/webui.py Traceback (most recent call last): File "e:\pc-project\LLaMA-Factory\src\webui.py", line 7, in <module> from llamafactory.extras.misc import fix_proxy, is_env_enabled File "e:\pc-project\LLaMA-Factory\src\llamafactory\extras\misc.py", line 23, in <module> import torch ModuleNotFoundError: No module named 'torch'

# 1. 激活llama_factory虚拟环境 conda activate llama_factory # 2. 切换到LLaMA-Factory根目录 cd E:\pc-project\LLaMA-Factory # 3. 运行webui.py（适配2GB显存，添加优化参数） python src/webui.py --device cuda:0 --load_in_4bit --use_gradient_checkpointing

# 直接指定llama_factory环境的Python路径 & D:/python/miniconda3/envs/llama_factory/python.exe e:/pc-project/LLaMA-Factory/src/webui.py --device cuda:0 --load_in_4bit --use_gradient_checkpointing

python src/webui.py --device cuda:0 --load_in_4bit --use_gradient_checkpointing --offload_folder ./offload --verbose

# 1. 激活虚拟环境 conda activate llama_factory # 2. 切换到项目根目录 cd E:\pc-project\LLaMA-Factory # 3. 优化参数启动WebUI python src/webui.py --device cuda:0 --load_in_4bit --use_gradient_checkpointing --offload_folder ./offload --verbose

LLaMA-Factory环境配置与WebUI启动全攻略：从CUDA适配到依赖踩坑

一、问题背景：本地部署LLaMA-Factory的核心诉求

二、核心报错解析与分步解决方案

坑1：仓库克隆失败——网络限制与镜像选择

报错现象

原因分析

解决方案

坑2：CUDA不可用——PyTorch版本错配

更多推荐文章

相关免费在线工具

报错现象

原因分析

解决方案

坑3：依赖缺失——虚拟环境未激活

报错现象

原因分析

解决方案

坑4：WebUI启动无响应——低显存适配

问题现象

原因分析

解决方案

三、避坑总结与关键提醒

四、最终成功启动流程（一键复制）

更多推荐文章

相关免费在线工具

LLaMA-Factory环境配置与WebUI启动全攻略：从CUDA适配到依赖踩坑

一、问题背景：本地部署LLaMA-Factory的核心诉求

二、核心报错解析与分步解决方案

坑1：仓库克隆失败——网络限制与镜像选择

报错现象

原因分析

解决方案

坑2：CUDA不可用——PyTorch版本错配

微信扫一扫，关注极客日志

更多推荐文章

相关免费在线工具

报错现象

原因分析

解决方案

坑3：依赖缺失——虚拟环境未激活

报错现象

原因分析

解决方案

坑4：WebUI启动无响应——低显存适配

问题现象

原因分析

解决方案

三、避坑总结与关键提醒

四、最终成功启动流程（一键复制）

微信扫一扫，关注极客日志

更多推荐文章

相关免费在线工具