
如果想在本地把 DeepSeek 跑起来,最省事的组合通常是 Ollama + CodeGPT。前者负责拉起本地模型,后者把模型接进 VSCode。思路不复杂,但实际用起来要先把'聊天'和'补全'分开看:一个负责问答和解释代码,另一个负责写代码时的实时建议。
安装 Ollama 和 CodeGPT
先装 Ollama。它的作用很直接,就是让本机能跑 LLM。官网是:https://ollama.com

按你的系统下载对应安装包,Windows、macOS、Linux 都有。装完后打开终端,跑一下:
ollama --version
能返回版本号,基本就没问题。
接着在 VSCode 里装 CodeGPT。打开扩展市场,搜 'CodeGPT' 安装即可。

这一步做完,VSCode 已经有了接本地模型的入口。
下载并配置模型
这里用两类模型就够了。
- 聊天模型:
deepseek-r1:1.5b - 自动补全模型:
deepseek-coder:base
前者偏问答、解释、修 bug,后者更适合写代码时补全中间内容,依赖中间填充(FIM)能力。
下载聊天模型 deepseek-r1:1.5b
在 VSCode 打开 CodeGPT,进入侧边栏里的'本地 LLM'部分,选择 Ollama 作为提供商,然后选 deepseek-r1:1.5b 下载。
下载完成后,就可以直接在编辑器里对代码发起查询了。选中一段代码,配合 # 引用额外文件,再用这些命令会比较顺手:

/fix:修复错误或给出改进建议/refactor:整理代码结构/Explain:解释这段代码
这类模型更适合处理局部问题,不需要把整个工程都喂进去,效率高,也更容易控制上下文。


