在Ubuntu 20.04上安装Ollama并部署大型语言模型：含Open WebUI图形界面教程

优质文章学习记录

10 Apr 2026 — 8 min read

在Ubuntu 20.04上安装Ollama并部署大型语言模型：含Open WebUI图形界面教程

引言

在人工智能浪潮席卷全球的今天，大型语言模型（LLM）不再是遥不可及的云端技术。借助 Ollama，每一位开发者都能轻松地将强大的模型部署在自己的本地计算机上，实现无缝、私密且可定制的AI体验。本文将带领您一步步在 Ubuntu 20.04 系统上完成 Ollama 的安装与模型部署，并最终搭建美观易用的图形化界面（Open webui）。

Ollama 是什么？

Ollama 是一个开源项目，专为在本地运行、管理和部署大型语言模型（如 Llama 3、Mistral、Gemma 等）而设计。

它的核心概念与优势非常清晰：

简单易用：通过简单的命令行工具，即可完成模型的下载（pull）、运行（run）和管理。一条命令就能启动与模型的对话。
丰富的模型库：它提供了官方支持的模型库（Ollama Search），包含deep-seek、qwen等数十种经过优化的大型语言模型，满足从代码生成到创意写作的各种需求。
“开箱即用”：它自动处理了模型运行所需的大部分复杂配置和环境依赖，用户无需关心繁琐的底层细节。

展示 Ollama 使用效果

想象一下，在您的终端中，直接与一个几十亿参数的大模型进行流畅的对话和代码编写，是一种怎样的体验？以下是在 Ubuntu 终端中运行 ollama run deepseek-coder:6.7b 后的截图：

本地部署语言模型的好处与局限性

选择在本地运行 Ollama，意味着选择了一种新的 AI 交互方式，但它也并非完美无缺。

优势 (Benefits)

数据隐私与安全：您的所有对话提示（Prompts）和模型生成的内容完全在本地处理，不会离开您的计算机。这对于处理敏感代码、商业数据或个人信息的用户至关重要。
完全离线可用：一旦模型下载完成，您就无需依赖互联网连接或担心API服务宕机，可以在任何没有网络的环境中使用。
可定制性：您可以尝试各种不同规模和专长的模型，甚至可以根据需要加载自定义模型（Modelfiles），灵活性远超固定的云端API。
无使用成本：除了电费和硬件成本外，没有按次收费或订阅费用，您可以无限次地与模型交互。

局限性 (Limitations)

硬件要求高：本地部署对计算机硬件，尤其是内存（RAM）和显存（VRAM） 有较高要求。运行大型模型可能需要数十GB的资源。
性能差异：虽然本地推理延迟低，但模型的能力和响应速度通常无法与 OpenAI GPT-4 这类顶级付费API相提并论，尤其是在复杂推理任务上。
知识陈旧：本地部署的模型知识库是静态的，其知识截止日期取决于它被训练的时间点，无法像一些云端模型那样实时获取最新信息。

环境准备

设备信息

lsb_release -a

检查储存空间及显存大小

储存空间至少预留十几G，因为一个模型的大小都在几个G左右
检查显存大小，显存大小决定了能运行模型的参数量

nvidia-smi

Ollama 下载与安装

1. 下载链接：

官网: https://ollama.com/
GitHub: https://github.com/ollama/ollama

2. 运行安装脚本：

curl -fsSL https://ollama.com/install.sh |sh

3. 管理Ollama服务：

# 启动 Ollama 服务sudo systemctl start ollama # 停止 Ollama 服务sudo systemctl stop ollama # 重启 Ollama 服务sudo systemctl restart ollama # 设置开机自启sudo systemctl enable ollama # 查看服务日志sudo journalctl -u ollama -f

4. 常用Ollama命令：

# 查看所有命令帮助 ollama --help # 运行模型（如果不存在会自动下载） ollama run <model-name># 运行模型并直接提问 ollama run <model-name>"你的问题"# 拉取（下载）模型 ollama pull <model-name># 列出已下载的模型 ollama list # 删除模型 ollama rm<model-name># 查看已下载模型的详细信息 ollama show llama3 # 查看模型配置 ollama show llama3 --modelfile

Ollama 部署并运行模型

现在 Ollama 已经安装完成，接下来是下载和运行各种大型语言模型

查看可用模型

通过命令行查看

# 查看本地已下载的模型 ollama list

通过模型库查看
访问Ollama官方的模型库：模型库，选择自己感兴趣的模型，注意参数量大小，一般先选择参数少一些的模型进行试验

下载模型

下载并运行deepseek-r1:7b模型

ollama run deepseek-r1:7b

运行模型

如果已经下载了deepseek-r1:7b，就不会重复下载而是启动命令行交互对话

ollama run deepseek-r1:7b

对话控制命令

在交互模式下，可以使用一些特殊命令：

# 退出对话 /bye 或者按 Ctrl + D # 清空对话上下文（开始新对话） /clear

设置参数

可以调整模型生成参数以获得不同效果：

# 设置温度（控制随机性，0-1） ollama run deepseek-r1:7b --temperature 0.7# 限制输出token数量 ollama run deepseek-r1:7b --num-predict 100# 指定随机种子（确保可重复性） ollama run deepseek-r1:7b --seed 42

安装Open WebUI 图形化界面

虽然命令行交互已经很强大，但对于日常使用来说，一个美观的图形界面能极大提升体验。Open WebUI（原名 Ollama WebUI）提供了一个类似 ChatGPT 的现代化 Web 界面，让您可以通过浏览器与本地模型进行交互。

Open WebUI 是什么？

Open WebUI 是一个功能强大的开源 Web 界面，专为 Ollama 和其他本地语言模型设计。它具有以下特点：

类ChatGPT体验：熟悉的聊天界面，支持多轮对话、对话历史管理
多模型支持：轻松切换不同的语言模型
可视化操作：图形化的模型管理和设置界面
高级功能：支持 RAG（检索增强生成）、文档上传、角色预设等
多用户支持：可注册多个账户，每个用户有自己的对话历史
完全本地化：所有数据仍然保存在本地，保障隐私安全

先决条件：安装 Docker

Open WebUI 通过 Docker 容器部署，因此需要先安装 Docker。参考以下安装教程Ubuntu 20.04 安装Docker 全过程

启动Docker 服务

# 确保Docker服务已启动sudo systemctl start docker sudo systemctl enable docker # 检查Docker服务状态sudo systemctl status docker

使用 Docker 一键部署 Open WebUI

安装好 Docker 后，只需一条命令即可部署 Open WebUI：

docker run -d --network="host" -v open-webui:/app/backend/data --name open-webui --restart always ghcr.io/open-webui/open-webui:main

部署完成后，检查容器状态：

docker ps

访问并使用Open WebUI

容器正常运行后，即可通过浏览器访问：

打开浏览器，访问：http://localhost:8080
首次注册：

点击 “Sign Up” 注册新账户
输入邮箱和密码（无需真实邮箱，仅用于本地识别）
确认密码并完成注册

登录系统：

使用刚才注册的邮箱和密码登录
首次登录会自动检测本地的 Ollama 服务

开始使用：

在左侧模型选择器中选择要使用的模型（如 llama3）
在输入框中开始对话

右侧可以查看对话历史、切换模型、调整参数等

跨越天堑：机器人脑部药物递送三大技术路径的可转化性分析研究

摘要血脑屏障是中枢神经系统药物研发最核心的瓶颈。尽管相关基础研究层出不穷，但“论文成果显著、临床转化缓慢”的悖论依然存在。本文认为，突破这一瓶颈的关键在于，将研究重心从“单点机制”转向构建一条“可验证、可复现、可监管”的全链条递送系统。为此，本文提出了一个衡量脑部递送技术可转化性的四维评价标尺：剂量可定义、闭环可监测、质控可标准化、可回退。基于此标尺，本文深度剖析了当前最具潜力的三条技术路径：（1）FUS/低强度聚焦超声联合微泡；（2）血管内可导航载体/机器人；（3）针对胶质母细胞瘤（GBM）的多功能纳米系统。通过精读关键临床试验、前沿工程研究和系统综述，我们抽离出可直接写入临床或产品方案的核心变量，识别了各自面临的最大转化风险，并提出了差异化的“押注”策略。分析表明，FUS+MB路径因其在“工程控制”上的成熟度，在近期（12-24个月）的转化确定性最高；血管内机器人代表了精准制导的未来趋势，

前端大数据渲染性能优化：Web Worker + 分片处理 + 渐进式渲染

当你的页面需要解析和渲染大量数据时，用户可能会面对长时间的白屏等待。本文将介绍一种"Web Worker 分片处理 + 主线程渐进式渲染"的优化方案，让用户在数据加载过程中就能看到内容逐步呈现。目录 1. 问题场景 2. 为什么传统方案不够好 3. 解决方案概述 4. 技术原理详解 5. 完整代码实现 6. 性能对比 7. 适用场景 8. 总结问题场景最近在做一个历史聊天记录恢复的功能，后端返回大量数据需要前端进行解析拼接在渲染到页面上，如果数据量大，聊天记录可能得十几秒才会显示，用户体验极差。我们需要解决的问题有两个，数据解析和DOM渲染为什么传统方案不够好方案一：直接同步处理 // ❌ 问题：阻塞主线程，页面完全卡死const transactions = rawData.map(item =>parseTransaction(item))setTransactions(

Selenium环境搭建完全指南：WebDriver版本匹配与生产级配置实践（Day 21-23）

引言：Web自动化的第一块多米诺骨牌如果你曾尝试在深夜配置Selenium环境，大概率经历过这样的场景：满怀信心地写下webdriver.Chrome()，回车执行，浏览器窗口一闪而逝——秒退。紧接着是SSL握手失败的红色堆栈，GitHub Issue的彻夜鏖战，以及第二天早晨同事轻描淡写的一句“哦，你Chrome版本没对齐吧”。环境搭建是Web自动化门槛最低、踩坑密度最高的环节。它不需要复杂的业务逻辑，却对细节有近乎偏执的要求：浏览器版本、驱动版本、系统架构、环境变量、二进制路径——任何一环脱节，整个自动化大厦便无从谈起。 Day 21-23的目标不是让你“跑通一个脚本”，而是建立对Selenium WebDriver底层交互机制的工程级认知。本文将从版本匹配的底层逻辑切入，覆盖跨平台配置、常见陷阱根治方案，并引入2026年主流的最佳实践工具链。读完本文，你将具备诊断并彻底解决环境问题的能力，而不再依赖“重装大法”。一、Selenium WebDriver的本质：不只是“驱动” 1.1 拆解黑箱：WebDriver协议与浏览器内核许多初学者将WebDriver误

Xinference-v1.17.1快速部署：GitHub Codespaces云端环境3分钟启动WebUI

Xinference-v1.17.1快速部署：GitHub Codespaces云端环境3分钟启动WebUI 1. 为什么这次更新值得你立刻试试？ Xinference-v1.17.1不是一次普通的小版本迭代。它把“开箱即用”这件事做到了新高度——你不需要本地装Python、不用配CUDA、甚至不用下载模型文件，只要一个浏览器，三分钟内就能看到完整的WebUI界面跑起来，还能直接和Qwen2、Phi-3、Gemma2这些热门模型对话。更关键的是，它彻底打破了“换模型=重装环境”的老套路。以前想试试Llama3还是DeepSeek-V2，得反复改配置、删缓存、调参数；现在只需要改一行代码，GPT的调用逻辑就自动切换成任意开源LLM。这不是概念演示，是实打实能在云上跑、在笔记本跑、在边缘设备跑的生产级推理平台。如果你试过用Ollama拉模型卡在99%、被vLLM的编译折磨到放弃、或者被FastChat的端口冲突搞崩溃……那这次，真的可以松一口气了。 2. 什么是Xinference？一句话说清它能帮你省多少事 Xinference（全称Xorbits Inference

在Ubuntu 20.04上安装Ollama并部署大型语言模型：含Open WebUI图形界面教程

引言

Ollama 是什么？

展示 Ollama 使用效果

本地部署语言模型的好处与局限性

优势 (Benefits)

局限性 (Limitations)

环境准备

设备信息

检查储存空间及显存大小

Ollama 下载与安装

1. 下载链接：

2. 运行安装脚本：

3. 管理Ollama服务：

4. 常用Ollama命令：

Ollama 部署并运行模型

查看可用模型

下载模型

运行模型

对话控制命令

设置参数

安装Open WebUI 图形化界面

Open WebUI 是什么？

先决条件：安装 Docker

启动Docker 服务

使用 Docker 一键部署 Open WebUI

访问并使用Open WebUI

Read more

跨越天堑：机器人脑部药物递送三大技术路径的可转化性分析研究

前端大数据渲染性能优化：Web Worker + 分片处理 + 渐进式渲染

Selenium环境搭建完全指南：WebDriver版本匹配与生产级配置实践（Day 21-23）

Xinference-v1.17.1快速部署：GitHub Codespaces云端环境3分钟启动WebUI