本地离线部署 AI 大模型:Ollama + Qwen3.5 + OpenClaw 实战指南
随着开源大模型的成熟,我们完全可以在本地运行 AI,无需联网、不上传数据,既免费又隐私。本文将带你一步步完成 Ollama + Qwen3.5:cloud(主力)+ Qwen3:0.6b(轻量备选)+ OpenClaw 的本地部署,实现一个属于自己的本地聊天助手,兼顾效果与低配置适配。
环境准备
- 操作系统:Windows 10 / Windows 11
- 内存:最低 8GB(推荐 16GB 更流畅)
- 显卡:无需独立显卡,CPU 即可运行
- 网络:仅在下载模型时需要,运行时可完全断网
安装步骤
1. 安装 Ollama
Ollama 是运行模型的核心工具,支持一键拉取和管理。
- 访问官网 https://ollama.com/ 下载 Windows 版本。
- 双击安装包,按提示完成安装。
- 安装完成后,Ollama 会自动在后台运行。
验证是否成功:打开 CMD 或 PowerShell,输入以下命令:
ollama --version
出现版本号即表示安装成功。
2. 下载并运行模型
根据电脑配置选择模型。优先推荐 qwen3.5:cloud(效果更好),8GB 内存低配电脑推荐 qwen3:0.6b(更流畅)。
2.1 主力模型:Qwen3.5:cloud
在命令行输入以下命令,首次运行会自动下载模型,完成后出现 >>> 即启动成功:
ollama run qwen3.5:cloud
此时可直接输入问题测试,例如:
你好,介绍一下自己

模型能正常回答,说明部署成功。
2.2 轻量备选:Qwen3:0.6b
若运行主力模型卡顿,可切换至超轻量模型:
ollama run qwen3:0.6b
同样输入 你好,介绍一下自己 进行测试。

3. 安装 OpenClaw 可视化界面
OpenClaw 提供类似 ChatGPT 的交互体验,无需敲命令。
- 访问 GitHub 发布页 https://github.com/sqzw-x/OpenClaw 下载 Windows 安装包。
- 解压或安装后打开软件。
- 点击右上角设置,配置连接信息:
- 模型选择:主力推荐
qwen3.5:cloud,低配选qwen3:0.6b - Ollama 地址:保持默认
http://localhost:11434
- 模型选择:主力推荐
- 保存设置,回到主界面即可开始对话。

性能表现
- 模型启动速度:约 3~10 秒
- 回答速度:流畅,满足日常使用
- 内存占用:
- Qwen3.5:cloud:约 2GB~4GB
- Qwen3:0.6b:约 1GB~1.5GB
可通过任务管理器'性能 - 内存'页面监控运行状态。

常见问题与解决
1. 模型下载特别慢
- 暂停下载后重新开始,进度通常不会丢失。
- 避开网络高峰期,如深夜时段下载。
2. OpenClaw 连接失败
- 确保 Ollama 正在后台运行(查看任务栏图标)。
- 重启 Ollama:右键任务栏图标 → Restart。
- 检查地址是否为
http://localhost:11434,切勿多写或少写字符。
3. 电脑卡顿、内存不足
- 关闭浏览器、视频软件等占用内存的程序。
- 切换至超轻量模型:
ollama run qwen3:0.6b
或使用更小参数模型(如 qwen3.5:4b)。
4. OpenClaw 不显示模型
- 重启 OpenClaw 软件,重新加载列表。
- 进入设置重新选择模型并保存。
- 确认 Ollama 已拉取模型:
ollama list
总结
通过 Ollama + Qwen3.5 + OpenClaw,我们实现了本地离线运行大模型,具备完全免费、无流量限制、数据隐私安全等特点。适合想学习 AI 部署的新手、注重隐私的用户以及日常办公场景,8GB 内存的低配电脑也能通过轻量模型轻松适配。


