先别急着下载什么,你得知道最终要的效果:在你自己电脑上运行一个 AI 模型,没有网络延迟,对话完全私密。DeepSeek 是最近不错的一个开源模型,我们要用 Ollama 这个轻量框架来加载它,最后再配个图形界面 Chatbox,用起来跟网页版差不多。
安装 Ollama
去 ollama.com 下载对应系统的安装包,Windows 是 .exe,Mac 是 .dmg。安装过程基本就是下一步,没什么坑。装完后,打开终端(Windows 按 Win+R 输入 cmd,Mac 是 Terminal),输入 ollama --version,如果出现版本号,那就没问题。
拉取并运行 DeepSeek 模型
DeepSeek 有多个参数版本,显存 8G 以内的电脑选 8b 版本比较稳妥,如果显卡好、内存足,可以试试 16b。直接在终端里跑:
ollama run deepseek-r1:8b
第一次会用你下载大约 5GB 的模型文件,等它走完。下载完成后,它就会启动一个对话界面。你可以试一句:
用幽默的方式解释一下量子纠缠
如果模型回过话来,就说明部署成功了。以后要再用,直接执行上面的命令就行,Ollama 会在后台常驻。
加上图形界面:Chatbox
终端交互虽然高效,但有些朋友更喜欢像 ChatGPT 那样的聊天窗口。Chatbox 可以帮你做到这一点。从官网下载安装好,打开设置,在模型配置里选:
- API 类型:Ollama API
- 模型名称:deepseek-r1:8b
点一下'检查连接',看到正常就完事了。另外,温度值可以调成 0.5 左右,回答不会太离谱也不会太死板。
让它跑得更顺
几个实际用起来有效的方法:
- 关掉其他吃内存的大程序,特别是浏览器
- 问复杂问题时,分拆成几个简单问题,模型理解得更好
- 偶尔用英文关键词提问,响应可能会快一些
- 定期重启一下 Ollama,释放内存(我一般一天重启一次)
踩坑记录
- 显存不足:换
8b版本,或者更新显卡驱动看能不能挤出点空间。 - 回答乱码:Chatbox 设置里把编码调成 UTF-8。
- 更新模型:想用新版本就执行:
ollama pull deepseek-r1:8b
现在你已经有了一套完全在本地的 AI 助手,想怎么用就怎么用,数据也不会离开你的电脑。

