Ubuntu 本地化部署 DeepSeek R1 模型:Ollama+Docker
在 Ubuntu 系统上通过 Ollama 和 Docker 本地化部署 DeepSeek R1 模型的完整流程。主要步骤包括安装 NVIDIA 显卡驱动、配置 Docker 环境、安装 Ollama 服务、设置网络访问权限、下载指定模型以及启动模型进行交互。该方案适用于需要在本地运行大语言模型的场景。
博客作者
浴火重生
322
已发布文章
8.9K
博客获赞
806K
博客浏览
第 4 页
在 Ubuntu 系统上通过 Ollama 和 Docker 本地化部署 DeepSeek R1 模型的完整流程。主要步骤包括安装 NVIDIA 显卡驱动、配置 Docker 环境、安装 Ollama 服务、设置网络访问权限、下载指定模型以及启动模型进行交互。该方案适用于需要在本地运行大语言模型的场景。

一款基于 Android 和 AR 眼镜的亲戚称呼助手应用。通过集成特定 SDK,利用蓝牙通信将手机存储的亲戚信息(姓名、称呼、关系、话术)实时同步至 AR 眼镜端显示。文章详细阐述了项目搭建、数据模型设计、蓝牙连接流程、UI 实现及常见坑点(如权限申请、场景控制顺序、编码问题)。该方案解决了春节走亲访友时记不住亲戚称呼的痛点,提供了隐蔽且便捷的交互体验。

如何使用 Rust 语言结合智谱 AI 的 GLM-5 模型,从零构建一个支持流式输出、多语言切换及文件批处理的 AI 翻译命令行工具。内容涵盖系统环境配置、依赖管理、异步网络编程、SSE 流式数据处理、命令行参数解析以及二进制发布优化。通过模块化设计实现了文本与文件翻译功能,并演示了编译构建与实战测试过程,展示了 Rust 在高性能网络 IO 密集型应用中…

Flutter 中两种核心多页切换模式:底部导航(BottomNavigationBar)和顶部选项卡(TabBar)。详细对比了经典款与 Material 3 风格组件的区别,演示了 TabBar 配合 DefaultTabController 的使用。重点解决了页面切换时的状态丢失问题,提供了 IndexedStack 和 AutomaticKeepAl…
介绍如何使用 LFM2.5-1.2B-Thinking 模型打造个人 AI 写作助手。该模型专为设备端设计,体积小、响应快,可通过 Ollama 在本地电脑轻松部署。文章详细说明了环境准备、三步部署流程及首次对话方法。实战部分涵盖日常办公(邮件、报告)、内容创作(博客、创意)及学习辅助场景。此外,还分享了有效沟通指令、迭代优化技巧及常见问题解决方法,通过实际…

AI 生成内容(AIGC)正成为科技领域热点,涵盖文本、图像及视频生成。探讨了 AIGC 市场现状与挑战,包括快速迭代的生成模型。详细分析了在文本、图像及跨模态内容生成的应用场景,并提供了基于 Transformers 和 Diffusers 的代码示例。针对数据质量、模型偏差及内容真实性等技术挑战提出了清洗、增强验证等解决方案。未来趋势指向多模态生成主流化…

在 Windows 系统下安装 Neo4j Desktop 2.0 时如何自定义安装路径以节省 C 盘空间的方法。主要步骤包括创建专用文件夹、配置环境变量 NEO4J_DESKTOP_DATA_PATH,以及使用命令行参数执行静默安装。完成后可验证快捷方式及文件存放位置确认安装成功。

基于 Faster-Whisper 实现本地实时语音转文本的完整流程。内容包括环境搭建(安装 faster-whisper 和 pyaudio)、模型下载配置、Python 录音转录脚本编写以及常见报错处理(如 cuDNN 版本、CUDA 路径冲突、onnxruntime 兼容性问题)。通过本教程,开发者可快速部署离线语音识别功能,保障数据隐私并降低调用成本…

对比了智写 AI、DeepSeek、通义千问等七款工具在降低英文 AI 检测率方面的表现。测试基于学术引言场景,评估降重效果、文本质量及场景契合度。结果显示垂直工具在降 AI 率上表现更优,通用大模型适合辅助创作但难以完全规避检测。建议结合人工修改以确保学术诚信。
介绍 Z-Image-GGUF 开源模型及其基于 GGUF 量化技术的本地化部署方案。通过降低显存需求,使消费级显卡即可运行通义实验室的 Z-Image 文生图模型。内容涵盖 GGUF 原理、ComfyUI 工作流配置、提示词工程技巧及参数调优方法。旨在帮助用户在本地构建隐私安全的 AI 绘画工作流,适用于概念设计、素材生成及教育演示等场景,实现技术普惠。

在.NET 项目中集成 GoView 低代码可视化大屏的完整方案。主要步骤包括环境准备、构建 GoView 前端、将静态资源嵌入.NET 项目、配置路由及 API 接口。进阶方案涵盖身份验证(JWT)、动态主题切换及数据缓存优化。同时解决了跨域、静态文件 404、API 路径及性能等常见问题。该方案适用于需要将数据可视化功能嵌入现有.NET 企业级应用的场景…
介绍使用 LLaMA-Factory 框架进行大模型微调的方案,通过 LoRA 技术和按需付费云算力降低实验成本。内容包括环境搭建、数据准备、参数配置、训练监控及常见问题解决。支持主流开源模型,适合资源受限场景下的模型定制与验证。

Go Web 开发的基础知识,涵盖 HTTP 状态码分类与含义、HTTP 协议核心概念(版本演进、缓存、HTTPS、Cookie/Session)、MySQL 数据库操作(使用 sqlx 包)、模板引擎、文件上传下载以及控制器模式。重点讲解了 GET 与 POST 方法的区别及常见应用场景,适合初学者构建 Go Web 应用基础。

Xilinx Vivado 工具中 IP 核的授权机制与分类。Vivado 内置 IP 分为免费(Included)和付费(Purchase)两类。付费 IP 需购买 License 才能使用,常见状态包括未找到许可证(Customization disabled)、设计链接许可(Design Linking,不可生成 bit)和已购买许可(无限制)。文章详…

ToDesk 推出的 ToClaw AI 桌面自动化助手。针对原生 OpenClaw 部署难、成本高、门槛高的问题,ToClaw 通过云端封装实现了零门槛使用。其核心功能包括跨设备协同、自然语言交互、文件整理、定时任务及丰富的办公技能库(如文档处理、网页自动化)。相比竞品,ToClaw 在公测期提供免费积分模式,降低了 AI 自动化技术的应用门槛,适合普通用…
介绍图数据库 Neo4j 及其图算法在大数据分析中的应用。通过对比传统关系型数据库,阐述了节点、关系和属性的概念。详细讲解了中心性算法(如 PageRank)、路径算法(如 Dijkstra)和社区发现算法(如标签传播)。结合电商用户行为分析场景,演示了如何利用图技术解决关联挖掘、欺诈检测和智能推荐等实际问题,帮助读者掌握从数据建模到算法落地的全流程技巧。
对比了 RTD1296PB 与 RK3568 两款 ARM 处理器在 NAS 及智能家居场景下的性能表现。RK3568 凭借 4 核 Cortex-A55 架构和 22nm 制程,在 CPU 算力和散热控制上优于 RTD1296PB,文件压缩速度提升约 15-20%,满载温度更低。RTD1296PB 则在视频播放功耗控制方面具有优势,适合蓝光播放器等场景。存…

讲解使用 HTML 和 CSS 实现边框流动特效的方法。通过伪元素、圆锥渐变和动画技术,无需 JavaScript 即可创建动态边框效果。内容包含基础实现、按钮悬停效果、常见兼容性问题(如 Safari、iOS)、性能优化技巧(transform、will-change)以及无障碍访问建议。旨在帮助开发者提升页面交互体验。
对 VS Code 中远程调用 Claude Agent 出现无效请求错误提供排查方案。主要涉及 API 密钥配置验证、请求参数格式检查、网络代理调整、插件版本更新及日志分析。通过命令行测试独立 API 请求可辅助定位问题根源,确保参数与环境配置正确即可解决该问题。
FLUX.1-dev 本地部署方案解决显存瓶颈与隐私问题,提供影院级画质与稳定性。通过 Flask WebUI 实现直观操作,支持 RTX 4090D 等环境优化。Prompt 工程需从抽象平台词转向具体物理光影描述,遵循主体加细节加场景公式。善用负面提示词排除瑕疵,结合种子控制与历史画廊进行迭代创作。建立私人提示词库提升效率,实现可控、私密的高清视觉生成工…