跳到主要内容
极客日志极客日志面向AI+效率的开发者社区
首页博客我的书AI学习GitHub 精选镜像AI 生图工具UI配色美学关于
搜索内容 / 工具 / 仓库 / 镜像...⌘K搜索
注册
博客列表
PythonAI算法

LLaMA-Factory 部署与大模型微调实战

基于 LLaMA-Factory 框架部署及微调大模型的步骤。内容包括 Python 与 CUDA 环境搭建、PyTorch 安装验证、模型仓库克隆、WebUI 服务启动、自定义数据集生成、训练参数配置、模型微调及最终导出。以 Qwen2.5 模型为例,演示了从环境准备到模型落地的全流程。

墨染流年发布于 2026/4/5更新于 2026/9/472 浏览

一、安装 LLaMA-Factory

1. Python 环境安装

安装成功后,输入 python 能出现版本信息表示安装成功。

2. CUDA 和 PyTorch 安装

2.1 PyTorch 安装

查看 PyTorch 与 CUDA 对应的版本,然后进行安装。PyTorch 官网地址:PyTorch

在终端中输入以下指令安装 PyTorch(以 CUDA 11.8 为例):

pip3 install torch torchvision torchaudio --index-url https://download.pytorch.org/whl/cu118

建议选用 CUDA 11.8 版本以确保兼容性。

到此 PyTorch 安装结束。

2.2 CUDA 安装

找到 CUDA 的历史版本。链接地址:CUDA Toolkit Archive | NVIDIA Developer

找到目标安装包下载安装。安装成功后在终端中输入:nvcc --version

如显示版本号,表示 CUDA 安装成功。

2.3 校验

校验 CUDA 和 PyTorch 是否匹配成功。

终端中输入:

import torch
print(torch.cuda.current_device())
print(torch.cuda.get_device_name(0))
print(torch.__version__)

如果出现异常错误,可能是环境没有处理好,需自行检查。

3. 下载 LLaMA-Factory 的 Git 仓库

git clone https://github.com/hiyouga/LLaMA-Factory.git

进入刚下载的 LLaMA-Factory 文件夹中,输入指令:

pip install -e '.[torch,metrics]'

验证安装是否成功。输入指令:llamafactory-cli version

如出现版本号表示安装成功。

二、下载模型

可从魔搭社区下载模型。示例选用 Qwen2.5-0.5B-Instruct 模型。

使用 Git 下载命令:

git clone https://www.modelscope.cn/Qwen/Qwen2.5-0.5B-Instruct.git

三、部署大模型

启动 llama-factory 的 WebUI,输入指令:

llamafactory-cli webui

注意:必须在 LLaMA-Factory 仓库根目录中输入该指令。

启动后的界面会显示服务地址。切换页面到部署模型的页面。

点击 Chat,模型名称从下拉列表中选择 Qwen2.5-0.5B-Instruct。

模型路径填写刚刚下载的模型路径。注意:模型名称和模型路径中的模型要对应。

填写好,进行加载模型。加载成功后,就可以进行聊天了。

四、模型微调

4.1 生成训练的数据集

代码示例如下:

import json
import random
from faker import Faker

def generate_thermal_dataset(output_path="thermal_dataset.json"):
    """生成智能家居温度调控指令数据集"""
    fake = Faker('zh_CN')
    base_phrases = ["有点", "非常", "特别", "实在", "真的", "确实", "越来越", "稍微", "极其"]
    heat_verbs = ["热","炎热","火热","酷热","炽热","闷热","灼热","滚烫","炙热","沸热","炙烤","加热","升温","燥热","湿热","高温","暖热"]
    quantifiers = ["了", "啦", "啊", "呢", ""]
    dataset = []
    for _ in range(2000):
        phrase = random.choice(base_phrases)
        verb = random.choice(heat_verbs)
        quantifier = random.choice(quantifiers)
        input_text = f"我{phrase}{verb}{quantifier}"
        output_json = {
            "Device": "AirConditioner",
            "Status": "on"
        }
        dataset.append({
            "instruction": "你是一个物联网数据处理专家,需要把自然语言指令转换为 JSON 结构化数据",
            "input": input_text,
            "output": json.dumps(output_json, ensure_ascii=False),
        })
    with open(output_path, "w", encoding="utf-8") as f:
        json.dump(dataset, f, indent=2, ensure_ascii=False)
    print(f"数据集已生成:{output_path}")

if __name__ == "__main__":
    generate_thermal_dataset()

该代码会生成 2000 条训练数据。

4.2 配置训练参数

找到 llama-factory 中的训练参数集的配置文件,即 data 文件夹中的 dataset_info 文件。打开文件并配置。

我们在 json 字符串中再加入一组配置。

配置完成后,在 data 文件夹中再新建一个 train.json 文件,用于保存生成出来的训练数据集。

在 WebUI 中配置上刚刚添加好的数据训练集。

预览数据集确认无误。

确保系统使用独立显卡进行计算。

WebUI 中点击开始训练。

可以看到已经开始训练,日志显示进度。

训练完成,看到 log 上面出现训练完毕,表示训练结束了。

4.3 合并导出

选择 export。

然后把这三个地方配置正确:

  1. Base Model Path (基础模型路径)
  2. Finetuning Type (微调类型)
  3. Output Dir (输出目录)

点击开始导出就能合并导出微调好的模型了。

4.4 加载合并后的模型

使用合并后的模型路径重新加载即可。

目录

  1. 一、安装 LLaMA-Factory
  2. 1. Python 环境安装
  3. 2. CUDA 和 PyTorch 安装
  4. 2.1 PyTorch 安装
  5. 2.2 CUDA 安装
  6. 2.3 校验
  7. 3. 下载 LLaMA-Factory 的 Git 仓库
  8. 二、下载模型
  9. 三、部署大模型
  10. 四、模型微调
  11. 4.1 生成训练的数据集
  12. 4.2 配置训练参数
  13. 4.3 合并导出
  14. 4.4 加载合并后的模型

更多推荐文章

查看全部
  • Git 查看 Commit 修改文件概要的常用命令与技巧
  • MaxBot 抢票机器人部署指南:从环境配置到实战策略
  • 轻量级 SVGA 动画播放器:Web 端流畅动画实现
  • 移动端 H5 开发与 PC 端 Web 开发的区别
  • DGX Spark 部署 vLLM + Open WebUI 运行 Qwen3-Coder-Next-FP8(CUDA 13.0 版)
  • AI+ 游戏开发:使用 DeepSeek 构建贪吃蛇游戏
  • Axios 错误处理的设计与进阶封装,实现网络层面的数据与状态解耦
  • OpenClaw 自动化 AI 助理使用指南与技能配置详解
  • OpenClaw 接入飞书机器人与 Kimi2.5 配置指南
  • Whisper 语音识别 GPU 加速实战指南
  • 2025 AI 技术成长复盘与深度学习实践心得
  • Python 语言学习:大学生学术与职业应用指南
  • C++ 与 ROS 中 int main(int argc, char* argv[]) 的区别
  • Python 基础:列表与元组的创建、操作及区别
  • Python 实现 MCP 客户端调用高德地图天气查询示例
  • 极化码 SC 译码算法原理、MATLAB 实现与优化策略
  • 基于 Python 的 Telegram 信息检索机器人搭建指南
  • 安川机器人与多种 PLC 的通讯配置及连接案例
  • FPGA 实现 HDMI 输出:从接口原理到 4K 显示全流程
  • 如何入门网络安全技术与伦理规范

相关免费在线工具

  • 加密/解密文本

    使用加密算法(如AES、TripleDES、Rabbit或RC4)加密和解密文本明文。 在线工具,加密/解密文本在线工具,online

  • RSA密钥对生成器

    生成新的随机RSA私钥和公钥pem证书。 在线工具,RSA密钥对生成器在线工具,online

  • Mermaid 预览与可视化编辑

    基于 Mermaid.js 实时预览流程图、时序图等图表,支持源码编辑与即时渲染。 在线工具,Mermaid 预览与可视化编辑在线工具,online

  • 随机西班牙地址生成器

    随机生成西班牙地址(支持马德里、加泰罗尼亚、安达卢西亚、瓦伦西亚筛选),支持数量快捷选择、显示全部与下载。 在线工具,随机西班牙地址生成器在线工具,online

  • Gemini 图片去水印

    基于开源反向 Alpha 混合算法去除 Gemini/Nano Banana 图片水印,支持批量处理与下载。 在线工具,Gemini 图片去水印在线工具,online

  • curl 转代码

    解析常见 curl 参数并生成 fetch、axios、PHP curl 或 Python requests 示例代码。 在线工具,curl 转代码在线工具,online