使用Docker安装Ollama及Open-WebUI完整教程

优质文章学习记录

11 Apr 2026 — 5 min read

作者：吴业亮
博客：wuyeliang.blog.ZEEKLOG.net

一、Ollama 简介及工作原理

1. Ollama 简介及原理

简介：Ollama 是一款轻量级、开源的大语言模型（LLM）运行工具，旨在简化本地部署和运行大语言模型的流程。它支持 Llama 3、Mistral、Gemini 等主流开源模型，用户无需复杂配置即可在本地设备（CPU 或 GPU）上快速启动模型，适用于开发测试、本地智能应用搭建等场景。
工作原理：
- 采用模型封装机制，将大语言模型的运行环境、依赖库及推理逻辑打包为标准化格式，实现模型的一键下载、启动和版本管理。
- 通过优化的推理引擎适配硬件架构，支持 CPU 基础运行和 GPU 加速（如 NVIDIA CUDA），减少资源占用并提升响应速度。
- 提供简洁的 REST API 和命令行接口，降低开发者集成门槛，无需深入了解模型底层细节即可调用。
- 支持容器化部署，确保跨环境一致性，避免依赖冲突问题。

2. Open-WebUI 简介及原理

简介：Open-WebUI 是一款开源的可视化界面工具，专为 Ollama 设计，提供直观的交互界面用于管理和使用大语言模型。它支持模型切换、对话历史记录、参数调整等功能，让本地大语言模型的使用更便捷。
工作原理：
- 作为前端交互层，通过 API 与 Ollama 后端通信，接收用户输入并将其转发给 Ollama 进行模型推理。
- 解析 Ollama 返回的结果并以自然语言对话形式展示给用户，同时记录对话历史并支持上下文关联。
- 提供模型管理功能，可直接在界面中下载、启动、停止 Ollama 支持的模型，简化模型运维流程。
- 支持容器化部署，与 Ollama 容器通过网络互通，实现快速搭建完整的本地大语言模型交互系统。

二、安装Docker

1. 安装Docker依赖

apt-getinstall ca-certificates curl gnupg lsb-release

2. 添加阿里云Docker软件源

curl -fsSL http://mirrors.aliyun.com/docker-ce/linux/ubuntu/gpg |sudo apt-key add -

3. 配置系统软件源

编辑/etc/apt/sources.list文件，添加以下内容（清华大学Ubuntu镜像源）：

# 默认注释了源码镜像以提高 apt update 速度，如有需要可自行取消注释 deb https://mirrors.tuna.tsinghua.edu.cn/ubuntu/ focal main restricted universe multiverse # deb-src https://mirrors.tuna.tsinghua.edu.cn/ubuntu/ focal main restricted universe multiverse deb https://mirrors.tuna.tsinghua.edu.cn/ubuntu/ focal-updates main restricted universe multiverse # deb-src https://mirrors.tuna.tsinghua.edu.cn/ubuntu/ focal-updates main restricted universe multiverse deb https://mirrors.tuna.tsinghua.edu.cn/ubuntu/ focal-backports main restricted universe multiverse # deb-src https://mirrors.tuna.tsinghua.edu.cn/ubuntu/ focal-backports main restricted universe multiverse # 安全更新软件源 deb http://security.ubuntu.com/ubuntu/ focal-security main restricted universe multiverse # deb-src http://security.ubuntu.com/ubuntu/ focal-security main restricted universe multiverse # 预发布软件源，不建议启用 # deb https://mirrors.tuna.tsinghua.edu.cn/ubuntu/ focal-proposed main restricted universe multiverse # # deb-src https://mirrors.tuna.tsinghua.edu.cn/ubuntu/ focal-proposed main restricted universe multiverse

4. 添加Docker软件源并更新密钥

add-apt-repository "deb [arch=amd64] http://mirrors.aliyun.com/docker-ce/linux/ubuntu $(lsb_release -cs) stable"sudo apt-key adv --keyserver keyserver.ubuntu.com --recv-keys DDCAE044F796ECB0

5. 安装Docker

apt-getinstall docker-ce docker-ce-cli containerd.io

6. 验证Docker安装

docker -v

7. 配置Docker国内镜像源

7.1 编辑配置文件`/etc/docker/daemon.json`

{"registry-mirrors":["https://docker.mirrors.ustc.edu.cn","https://hub-mirror.c.163.com","https://docker.m.daocloud.io","https://ghcr.io","https://mirror.baidubce.com","https://docker.nju.edu.cn"]}

7.2 重新加载并重启Docker

systemctl daemon-reload systemctl restart docker

三、安装英伟达显卡驱动（GPU支持）

1. 配置存储库

curl -fsSL https://nvidia.github.io/libnvidia-container/gpgkey |sudo gpg --dearmor -o /usr/share/keyrings/nvidia-container-toolkit-keyring.gpg

2. 设置源

创建并编辑nvidia-container-toolkit.list文件：

# 内容如下 deb https://mirrors.ustc.edu.cn/libnvidia-container/stable/deb/$(ARCH) / deb https://mirrors.ustc.edu.cn/libnvidia-container/stable/ubuntu18.04/$(ARCH) / #deb https://mirrors.ustc.edu.cn/libnvidia-container/experimental/deb/$(ARCH) /#deb https://mirrors.ustc.edu.cn/libnvidia-container/experimental/ubuntu18.04/$(ARCH) /

3. 更新包列表

sudoapt-get update

4. 安装NVIDIA Container Toolkit

apt-getinstall -y nvidia-container-toolkit

5. 配置Docker以支持Nvidia驱动

nvidia-ctk runtime configure --runtime=docker

6. 重启Docker服务

systemctl restart docker.service

四、使用Docker安装Ollama

1. 拉取Ollama镜像

官方镜像：

docker pull ollama/ollama:latest

国内镜像（推荐）：

docker pull dhub.kubesre.xyz/ollama/ollama:latest

2. 启动Ollama容器

docker run -d \ --gpus=all \ --restart=always \ -v /root/project/docker/ollama:/root/project/.ollama \ -p 11434:11434 \ --name ollama \ ollama/ollama

说明：此配置会让Ollama将模型保持加载在内存（显存）中

五、使用Docker安装Open-WebUI

1. 安装Main版本

docker run -d \ -p 15027:8080 \ --gpus all \ --add-host=host.docker.internal:host-gateway \ -v open-webui:/app/backend/data \ --name open-webui \ --restart always \ ghcr.nju.edu.cn/open-webui/open-webui:main

2. 安装CUDA版本（GPU加速）

docker run -d \ -p 15027:8080 \ --gpus all \ --add-host=host.docker.internal:host-gateway \ -v open-webui:/app/backend/data \ --name open-webui \ --restart always \ ghcr.nju.edu.cn/open-webui/open-webui:cuda

3. 访问Open-WebUI

打开浏览器访问以下地址进行登录：

http://192.168.1.129:15027/auth

Qwen3-VL-WEBUI部署教程：多用户并发访问的配置方案

Qwen3-VL-WEBUI部署教程：多用户并发访问的配置方案 1. 引言随着多模态大模型在实际业务场景中的广泛应用，视觉-语言模型（VLM）已成为智能客服、内容生成、自动化测试等领域的核心技术。阿里云推出的 Qwen3-VL 系列模型，作为目前 Qwen 家族中能力最强的视觉语言模型，具备强大的图文理解、空间推理、视频分析和代理交互能力，尤其适用于需要高并发、低延迟响应的企业级应用。本文将围绕开源项目 Qwen3-VL-WEBUI，详细介绍如何部署支持多用户并发访问的 Web 服务环境。该 WEBUI 内置了 Qwen3-VL-4B-Instruct 模型，开箱即用，并针对生产环境进行了优化，适合中小团队快速搭建私有化多模态服务平台。通过本教程，你将掌握： - 如何拉取并运行官方镜像 - 配置高性能推理后端以支持并发请求 - 调整 WebUI 参数实现负载均衡与资源隔离 - 实际部署中的常见问题与调优建议 2. Qwen3-VL-WEBUI 核心特性解析 2.

Apache SeaTunnel Web 完整使用指南：从零搭建可视化数据集成平台

Apache SeaTunnel Web 完整使用指南：从零搭建可视化数据集成平台【免费下载链接】seatunnel-webSeaTunnel is a distributed, high-performance data integration platform for the synchronization and transformation of massive data (offline & real-time). 项目地址: https://gitcode.com/gh_mirrors/se/seatunnel-web Apache SeaTunnel Web 是基于 SeaTunnel Connector API 和 Zeta Engine 开发的可视化管理平台，让数据集成工作变得前所未有的简单。无论您是数据工程师、开发人员还是运维人员，这个强大的 Web 控制台都能帮助您轻松管理海量数据的同步和转换任务。

ASP.NET Core 主机模型详解：Host、WebHost与WebApplication的对比与实践【代码之美】

🎀🎀🎀代码之美系列目录🎀🎀🎀 一、C# 命名规则规范二、C# 代码约定规范三、C# 参数类型约束四、浅析 B/S 应用程序体系结构原则五、浅析 C# Async 和 Await 六、浅析 ASP.NET Core SignalR 双工通信七、浅析 ASP.NET Core 和 MongoDB 创建 Web API 八、浅析 ASP.NET Web UI 框架 Razor Pages/MVC/Web API/

GLM-4.6V-Flash-WEB避坑指南：这些错误千万别犯

GLM-4.6V-Flash-WEB避坑指南：这些错误千万别犯你刚下载完 GLM-4.6V-Flash-WEB 镜像，兴奋地点开终端，输入 ./1键推理.sh，屏幕却突然卡住——几秒后弹出 CUDA out of memory；你拖进一张高清商品图，点击“提问”，界面转圈两分钟，最后返回空响应；你照着文档调用API，反复修改JSON格式，却始终收到 422 Unprocessable Entity；你自信满满地把服务暴露到公网，第二天发现日志里全是异常图片上传和高频恶意请求…… 这不是模型不行，而是你踩进了别人已经趟过的坑。 GLM-4.6V-Flash-WEB 是智谱AI最新开源的轻量级多模态视觉大模型，主打“单卡可跑、网页即用、API兼容”，但它的易用性有个前提：你得避开那些看似微小、实则致命的配置陷阱和操作误区。本文不讲原理、不堆参数，只聚焦一个目标：帮你把服务稳稳跑起来，且不翻车。全文基于真实部署记录整理，所有问题均来自ZEEKLOG星图用户反馈、GitHub