跳到主要内容
极客日志极客日志面向AI+效率的开发者社区
首页博客我的书AI学习GitHub 精选镜像AI 生图工具UI配色美学关于
搜索内容 / 工具 / 仓库 / 镜像...⌘K搜索
注册
博客列表
C++AI算法

Windows 7 编译运行 llama.cpp 部署 Qwen3 模型

介绍在 Windows 7 系统下通过本地编译 llama.cpp 并运行 Qwen3 大模型的完整流程。步骤包括准备 w64devkit 和 CMake 环境,克隆源码并替换特定 httplib.h 文件,配置 CMake 生成编译任务,执行编译生成服务器程序,最后通过浏览器访问本地服务进行对话。该方案解决了旧系统无法直接运行新版软件的问题,强调关闭杀毒软件以避免编译错误。

云朵棉花糖发布于 2026/4/5更新于 2026/9/1087 浏览
Windows 7 编译运行 llama.cpp 部署 Qwen3 模型

Windows 7 编译运行 llama.cpp 部署 Qwen3 模型

本指南专为不支持新版软件的 Windows 7 设计,通过本地编译实现大模型运行。

📋 0. 软件版本清单

请务必确保使用以下特定版本,以保证在 Win7 下的兼容性:

软件名称文件名 (根据截图)作用备注
编译环境w64devkit-x64-2.5.0.7z.exe提供 GCC 编译器核心工具
构建工具cmake-3.31.10-windows-x86_64.msi生成编译配置必须安装到默认路径
源码工具Git_for_Windows_(64bit)_v2.45.2.exe下载代码
浏览器Firefox Setup 115.30.0esr.exe唯一推荐Win7 支持的最后版本,用于打开聊天界面
备用浏览器109.0.5414.120_chrome_installer.exeChrome 109Win7 支持的最后 Chrome 版本

📥 第一阶段:下载代码并替换 httplib.h (使用 Git Bash)

操作环境:Windows 桌面/资源管理器

  1. 准备目录:建议在 C 盘根目录 下操作,路径短,不容易出错。
  2. 打开 Git:在 C 盘空白处右键 -> 'Open Git Bash here'。
  3. 执行命令(请一行一行复制运行):
# 1. 克隆 llama.cpp 仓库
git clone https://github.com/ggerganov/llama.cpp.git
# 2. 进入文件夹
cd llama.cpp
# 3. 【核心步骤】切换到支持 Qwen3 的特定版本 (Tag: b5092)
git checkout b5092
# 4. 【核心步骤】替换 /examples/server/httplib.h 文件
  1. 确认路径:确保代码文件夹就在 C:\llama.cpp。

🛠️ 第二阶段:准备编译环境

操作环境:w64devkit.exe 黑色终端

  1. 🛑 关闭杀毒软件 (Win7 必做)
    • 请务必彻底退出 360、腾讯管家、金山毒霸等。
    • 原因:Win7 下这些软件会拦截编译器生成的 conftest.exe 等临时文件,直接导致 Access Violation 报错。
  2. 启动编译终端
    • 解压 w64devkit-x64-2.5.0.7z.exe。
    • 双击运行文件夹内的 w64devkit.exe。
    • 在黑框中输入以下命令(注意路径写法):

进入代码目录

cd /c/llama.cpp 

⚙️ 第三阶段:清理与配置 (CMake)

操作环境:w64devkit.exe 黑色终端

  • 直接复制下面这行长命令运行:

  • 成功标志:屏幕滚动后显示 Generating done。

生成配置文件 (Win7 专用修复版)

"C:\Program Files\CMake\bin\cmake.exe" -G "MinGW Makefiles" -DLLAMA_CURL=OFF -DLLAMA_BUILD_TESTS=OFF -DCMAKE_C_COMPILER=gcc -DCMAKE_CXX_COMPILER=g++ 

清理环境 (防止旧缓存报错)

rm -f CMakeCache.txt 
rm -rf CMakeFiles 

🚀 第四阶段:执行编译

操作环境:w64devkit.exe 黑色终端

  • -j4 表示使用 4 线程加速,如果电脑配置极低可改为 -j2。
  1. 等待完成
    • 耐心等待进度条走到 [100%]。
    • 编译完成后,bin 文件夹下会出现 llama-server.exe。

开始编译

"C:\Program Files\CMake\bin\cmake.exe" --build . --config Release -j4 

✅ 第五阶段:验证结果

  • 在当前终端输入:

  • 看到 commit d3bd719 字样即为成功。

检查版本

./bin/llama-server.exe --version 

🤖 第六阶段:启动 Qwen3 模型 (Win7 专用方案)

Win7 的 CMD 窗口无法很好地显示聊天文字,必须使用浏览器模式。

准备工作
  • 安装 Firefox 115 ESR (Firefox Setup 115.30.0esr.exe)。这是 Win7 下最稳定、兼容性最好的现代浏览器。
情况 A:加载 .gguf 文件

假设模型文件在 C:\models\qwen3.gguf。

  • -c 4096: 上下文长度。如果内存大于 16G,可以设为 8192 或更高。

启动命令:

./bin/llama-server.exe -m "/c/models/qwen3.gguf" -c 4096 --host 0.0.0.0 --port 8080
情况 B:加载 Ollama 缓存模型

如果你用 Ollama 下载过 Qwen3,可以直接利用它的缓存文件(无需转换)。

  1. 找到 Blob 文件:
    • 路径:C:\Users\你的用户名\.ollama\models\blobs
    • 找到最大的那个文件(例如 sha256-abc1234...)。

启动命令:

./bin/llama-server.exe -m "/c/Users/Administrator/.ollama/models/blobs/sha256-你的文件名..." -c 4096 --host 0.0.0.0 --port 8080
🌐 最后一步:开始对话
  1. 当黑框显示 HTTP server listening 时,保持黑框开启(不要关闭)。
  2. 打开 Firefox 115 浏览器。
  3. 地址栏输入:http://127.0.0.1:8080
  4. 界面加载后,即可在浏览器中与 Qwen3 流畅对话!

目录

  1. Windows 7 编译运行 llama.cpp 部署 Qwen3 模型
  2. 📋 0. 软件版本清单
  3. 📥 第一阶段:下载代码并替换 httplib.h (使用 Git Bash)
  4. 1. 克隆 llama.cpp 仓库
  5. 2. 进入文件夹
  6. 3. 【核心步骤】切换到支持 Qwen3 的特定版本 (Tag: b5092)
  7. 4. 【核心步骤】替换 /examples/server/httplib.h 文件
  8. 🛠️ 第二阶段:准备编译环境
  9. ⚙️ 第三阶段:清理与配置 (CMake)
  10. 🚀 第四阶段:执行编译
  11. ✅ 第五阶段:验证结果
  12. 🤖 第六阶段:启动 Qwen3 模型 (Win7 专用方案)
  13. 准备工作
  14. 情况 A:加载 .gguf 文件
  15. 情况 B:加载 Ollama 缓存模型
  16. 🌐 最后一步:开始对话

更多推荐文章

查看全部
  • Git 和 TortoiseGit 安装配置指南
  • GitHub Codespaces 部署开源 AI 智能体 OpenClaw 指南
  • TeslaMate 开源特斯拉监控方案:安装与数据可视化指南
  • Java 内存泄漏问题的诊断与优化方法
  • QwQ-32B 本地部署与 WebUI 配置指南
  • 从 try-catch 回调到链式调用:更优雅的 async/await 错误处理方案
  • Windows 上 MySQL 8.4 免安装版部署笔记
  • TRAE CN + MCP:MasterGo 设计稿一键生成前端代码实战
  • Babylon.js Exporters 使用指南:3D 内容从建模到 Web 转换
  • VS Code 远程连接服务器后 GitHub Copilot 无法使用
  • 基于 Qwen3-VL 的无人收银系统技术解析
  • 大模型产品经理转型指南:核心技能与职业发展路径
  • SeaweedFS 分布式文件系统集群部署指南
  • Ubuntu 部署 OpenClaw 完整指南
  • AI 绘画与 GPU 算力:数字艺术创作新趋势
  • 医疗连续体机器人模块化控制界面设计与 Python 库应用(下)
  • 算法实战:位运算解决两数之和、唯一数字及消失数字问题
  • 复现 StreamVLN 具身导航:流式视觉语言导航实战
  • 数据结构:递归算法核心原理与实现
  • 鸿蒙 ArkTS 自动化测试实践:构建全链路缺陷防御体系

相关免费在线工具

  • 加密/解密文本

    使用加密算法(如AES、TripleDES、Rabbit或RC4)加密和解密文本明文。 在线工具,加密/解密文本在线工具,online

  • RSA密钥对生成器

    生成新的随机RSA私钥和公钥pem证书。 在线工具,RSA密钥对生成器在线工具,online

  • Mermaid 预览与可视化编辑

    基于 Mermaid.js 实时预览流程图、时序图等图表,支持源码编辑与即时渲染。 在线工具,Mermaid 预览与可视化编辑在线工具,online

  • 随机西班牙地址生成器

    随机生成西班牙地址(支持马德里、加泰罗尼亚、安达卢西亚、瓦伦西亚筛选),支持数量快捷选择、显示全部与下载。 在线工具,随机西班牙地址生成器在线工具,online

  • Gemini 图片去水印

    基于开源反向 Alpha 混合算法去除 Gemini/Nano Banana 图片水印,支持批量处理与下载。 在线工具,Gemini 图片去水印在线工具,online

  • Base64 字符串编码/解码

    将字符串编码和解码为其 Base64 格式表示形式即可。 在线工具,Base64 字符串编码/解码在线工具,online