跳到主要内容
极客日志极客日志面向AI+效率的开发者社区
首页博客我的书AI学习GitHub 精选镜像AI 生图工具UI配色美学关于
搜索内容 / 工具 / 仓库 / 镜像...⌘K搜索
注册
博客列表
C++AI算法

Windows 7 编译运行 llama.cpp 部署 Qwen 模型指南

介绍如何在 Windows 7 系统下通过本地编译 llama.cpp 来运行 Qwen 大模型。主要步骤包括准备特定版本的编译环境(w64devkit, CMake, Git),克隆源码并替换 httplib.h 文件,配置 CMake 生成构建文件,执行编译生成服务器程序,最后启动 llama-server 并通过浏览器访问聊天界面。该方案解决了 Win7 不支持新版软件的问题,实现了本地大模型部署。

CryptoLab发布于 2026/4/5更新于 2026/9/888 浏览
Windows 7 编译运行 llama.cpp 部署 Qwen 模型指南

Windows 7 编译运行 llama.cpp 部署 Qwen 模型指南

本文介绍如何在 Windows 7 系统下通过本地编译 llama.cpp 来运行 Qwen 大模型。

0. 软件版本清单

请务必确保使用以下特定版本,以保证在 Win7 下的兼容性:

软件名称文件名作用备注
编译环境w64devkit-x64-2.5.0.7z.exe提供 GCC 编译器核心工具
构建工具cmake-3.31.10-windows-x86_64.msi生成编译配置必须安装到默认路径
源码工具Git_for_Windows_(64bit)_v2.45.2.exe下载代码
浏览器Firefox Setup 115.30.0esr.exe唯一推荐Win7 支持的最后版本,用于打开聊天界面
备用浏览器109.0.5414.120_chrome_installer.exeChrome 109Win7 支持的最后 Chrome 版本

第一阶段:下载代码并替换 httplib.h (使用 Git Bash)

操作环境:Windows 桌面/资源管理器

  1. 准备目录:建议在 C 盘根目录 下操作,路径短,不容易出错。
  2. 打开 Git:在 C 盘空白处右键 -> 'Open Git Bash here'。
  3. 执行命令(请一行一行复制运行):
# 1. 克隆 llama.cpp 仓库
git clone https://github.com/ggerganov/llama.cpp.git
# 2. 进入文件夹
cd llama.cpp
# 3. 【核心步骤】切换到支持 Qwen 的特定版本 (Tag: b5092)
git checkout b5092
# 4. 【核心步骤】替换 /examples/server/httplib.h 文件
  1. 确认路径:确保代码文件夹就在 C:\llama.cpp。

第二阶段:准备编译环境

操作环境:w64devkit.exe 黑色终端

  1. 🛑 关闭杀毒软件 (Win7 必做)
    • 请务必等。
彻底退出 360、腾讯管家、金山毒霸
  • 原因:Win7 下这些软件会拦截编译器生成的 conftest.exe 等临时文件,直接导致 Access Violation 报错。
  • 启动编译终端
    • 解压 w64devkit-x64-2.5.0.7z.exe。
    • 双击运行文件夹内的 w64devkit.exe。
    • 在黑框中输入以下命令(注意路径写法):
  • 进入代码目录

    cd /c/llama.cpp 
    

    第三阶段:清理与配置 (CMake)

    操作环境:w64devkit.exe 黑色终端

    • 直接复制下面这行长命令运行:

    • 成功标志:屏幕滚动后显示 Generating done。

    生成配置文件 (Win7 专用修复版)

    "C:\Program Files\CMake\bin\cmake.exe" -G "MinGW Makefiles" -DLLAMA_CURL=OFF -DLLAMA_BUILD_TESTS=OFF -DCMAKE_C_COMPILER=gcc -DCMAKE_CXX_COMPILER=g++ 
    

    清理环境 (防止旧缓存报错)

    rm -f CMakeCache.txt
    rm -rf CMakeFiles 
    

    第四阶段:执行编译

    操作环境:w64devkit.exe 黑色终端

    • -j4 表示使用 4 线程加速,如果电脑配置极低可改为 -j2。
    1. 等待完成
      • 耐心等待进度条走到 [100%]。
      • 编译完成后,bin 文件夹下会出现 llama-server.exe。

    开始编译

    "C:\Program Files\CMake\bin\cmake.exe" --build . --config Release -j4 
    

    第五阶段:验证结果

    • 在当前终端输入:

    • 看到 commit d3bd719 字样即为成功。

    检查版本

    ./bin/llama-server.exe --version 
    

    第六阶段:启动 Qwen 模型 (Win7 专用方案)

    Win7 的 CMD 窗口无法很好地显示聊天文字,必须使用浏览器模式。

    准备工作
    • 安装 Firefox 115 ESR (Firefox Setup 115.30.0esr.exe)。这是 Win7 下最稳定、兼容性最好的现代浏览器。
    情况 A:加载 .gguf 文件

    假设模型文件在 C:\models\qwen3.gguf。

    • -c 4096: 上下文长度。如果内存大于 16G,可以设为 8192 或更高。

    启动命令:

    ./bin/llama-server.exe -m "/c/models/qwen3.gguf" -c 4096 --host 0.0.0.0 --port 8080
    
    情况 B:加载 Ollama 缓存模型

    如果你用 Ollama 下载过 Qwen,可以直接利用它的缓存文件(无需转换)。

    1. 找到 Blob 文件:
      • 路径:C:\Users\你的用户名\.ollama\models\blobs
      • 找到最大的那个文件(例如 sha256-abc1234...)。

    启动命令:

    ./bin/llama-server.exe -m "/c/Users/Administrator/.ollama/models/blobs/sha256-你的文件名..." -c 4096 --host 0.0.0.0 --port 8080
    
    🌐 最后一步:开始对话
    1. 当黑框显示 HTTP server listening 时,保持黑框开启(不要关闭)。
    2. 打开 Firefox 115 浏览器。
    3. 地址栏输入:http://127.0.0.1:8080
    4. 界面加载后,即可在浏览器中与 Qwen 流畅对话!

    目录

    1. Windows 7 编译运行 llama.cpp 部署 Qwen 模型指南
    2. 0. 软件版本清单
    3. 第一阶段:下载代码并替换 httplib.h (使用 Git Bash)
    4. 1. 克隆 llama.cpp 仓库
    5. 2. 进入文件夹
    6. 3. 【核心步骤】切换到支持 Qwen 的特定版本 (Tag: b5092)
    7. 4. 【核心步骤】替换 /examples/server/httplib.h 文件
    8. 第二阶段:准备编译环境
    9. 第三阶段:清理与配置 (CMake)
    10. 第四阶段:执行编译
    11. 第五阶段:验证结果
    12. 第六阶段:启动 Qwen 模型 (Win7 专用方案)
    13. 准备工作
    14. 情况 A:加载 .gguf 文件
    15. 情况 B:加载 Ollama 缓存模型
    16. 🌐 最后一步:开始对话

    更多推荐文章

    查看全部
    • 基于 Leaflet 与百度天气接口的空气质量 WebGIS 可视化实践
    • OpenClaw 跨平台卸载指南:Windows、macOS、Linux 及包管理器清理
    • 单链表与双向循环链表应用示例
    • Microsoft Visual C++ Build Tools 安装与配置指南
    • 企业为何需要私有化专属大模型:从 ChatGPT 到私有化部署
    • 线性 DP 五大经典模型:LIS、LCS、合唱队形、编辑距离详解
    • OpenClaw Skill:10 个提升 AI 模型能力的核心技能
    • 基于 SpringBoot+Vue 的网上摄影工作室管理系统设计与实现
    • YOLO26-Pose 零样本姿态估计技术解析
    • 自然语言处理在医疗健康领域的应用与实战
    • 网络安全挖洞实战指南:工具准备与漏洞提交流程
    • 基于 Rust 与 DeepSeek V3.2 构建高性能插件化 LLM 应用框架
    • RAG 评估指南:核心指标解析与代码实现
    • Python Flask 企业合同管理系统技术要点与选型对比
    • MBA 培训管理系统低代码开发实战指南
    • 大模型学习路线:掌握核心技术能力与关键技能
    • 基于 MCP Server - Figma AI Bridge 自动生成前端代码
    • Qwen3-32B 显存不足的低成本 GPU 优化部署方案
    • Gitea 轻量级私有化部署指南与常用 Git 命令
    • LangGraph 实战:从零构建人工智能航空客服助手

    相关免费在线工具

    • 加密/解密文本

      使用加密算法(如AES、TripleDES、Rabbit或RC4)加密和解密文本明文。 在线工具,加密/解密文本在线工具,online

    • RSA密钥对生成器

      生成新的随机RSA私钥和公钥pem证书。 在线工具,RSA密钥对生成器在线工具,online

    • Mermaid 预览与可视化编辑

      基于 Mermaid.js 实时预览流程图、时序图等图表,支持源码编辑与即时渲染。 在线工具,Mermaid 预览与可视化编辑在线工具,online

    • 随机西班牙地址生成器

      随机生成西班牙地址(支持马德里、加泰罗尼亚、安达卢西亚、瓦伦西亚筛选),支持数量快捷选择、显示全部与下载。 在线工具,随机西班牙地址生成器在线工具,online

    • Gemini 图片去水印

      基于开源反向 Alpha 混合算法去除 Gemini/Nano Banana 图片水印,支持批量处理与下载。 在线工具,Gemini 图片去水印在线工具,online

    • Base64 字符串编码/解码

      将字符串编码和解码为其 Base64 格式表示形式即可。 在线工具,Base64 字符串编码/解码在线工具,online