
Windows 本地运行 DeepSeek 大模型简易教程
在 Windows 系统上通过 Docker、CUDA、Ollama 和 Open-WebUI 本地部署开源大语言模型。首先安装 Docker 桌面环境,其次配置 NVIDIA CUDA 驱动以支持 GPU 加速,接着使用 Ollama 命令行工具下载并运行模型,最后通过 Open-WebUI 提供图形化界面进行交互。整个过程无需云端 API,实现离线私有化…
博客作者
非主流
348
已发布文章
12K
博客获赞
805K
博客浏览
第 16 页

在 Windows 系统上通过 Docker、CUDA、Ollama 和 Open-WebUI 本地部署开源大语言模型。首先安装 Docker 桌面环境,其次配置 NVIDIA CUDA 驱动以支持 GPU 加速,接着使用 Ollama 命令行工具下载并运行模型,最后通过 Open-WebUI 提供图形化界面进行交互。整个过程无需云端 API,实现离线私有化…

这篇教程围绕 Windows 下 AUTOMATIC1111 版 Stable Diffusion WebUI 的本地部署展开,覆盖了 Python、Git 和显卡环境准备,项目克隆,webui-user.bat 启动,pip 镜像与 GitHub 下载加速,模型目录放置,以及 HuggingFace 代理和 tokenizer 本地加载等常见问题处理。最后…

Coze 工作流是智能体实现复杂任务自动化的核心机制,通过结构化指令编排连接大模型能力与业务场景。主要包含两种模式:Workflow 面向数据自动化处理,适用于标准化、批量化任务;Chatflow 基于对话场景,支持多轮交互动态调整逻辑。案例显示,旅行规划需工作流分步执行查询、判断与邮件发送,餐厅订座中工作流处理明确指令,对话流处理开放式咨询。该工具降低开发…
Vue 项目构建流程涵盖依赖安装、环境变量配置及生产环境打包。通过 webpack-bundle-analyzer 分析体积,利用代码分割、CDN 引入等手段优化性能。部署方案支持静态托管、Nginx 服务器及 Docker 容器化。常见问题如资源路径、跨域及缓存可通过配置文件调整解决。集成 GitHub Actions 或 Jenkins 可实现 CI/C…

通过 Dify MCP Server 插件,可将工作流或 Chatflow 发布为标准 MCP 服务端点。配置环境变量暴露公网 IP 后,外部客户端如 Cherry Studio 或魔搭社区即可直接调用。重点在于 App Input Schema 的定义及网络连通性验证,实现 Dify 应用与第三方工具的无缝集成。

Android Lifecycle 组件用于感知 Activity 和 Fragment 的生命周期变化。通过实现 LifecycleObserver 接口并使用 @OnLifecycleEvent 注解,开发者可以将生命周期逻辑从 Activity/Fragment 中解耦,避免方法臃肿。LifecycleOwner 接口提供 getLifecycle()…

网络安全挖漏洞常用工具包括 AWVS、AppScan 和 BurpSuite,适合不同阶段的安全人员使用。文章详细梳理了从零基础到进阶的网络安全学习路线,涵盖理论、渗透测试、系统、网络、数据库、Web 安全及脚本编程等模块,为从业者提供系统的成长路径参考。

Jupyter Notebook 是一种基于 Web 的交互式计算环境,广泛用于数据分析、机器学习和科学计算。详细阐述了在 Windows、Linux 和 macOS 系统下通过 Anaconda 和 pip 两种方式安装 Jupyter Notebook 的步骤,包括镜像源配置、环境变量设置及启动方法。内容涵盖常见安装问题的排查、配置文件生成、访问密码设置…

网络安全自学指南涵盖误区规避、环境准备、六阶段学习路线及资源推荐。内容涉及操作系统、计算机网络、Web 安全、内网渗透等核心知识,并提供经典书籍清单。强调以实战为主,避免盲目收集资料,建议掌握 Python 编程及基础网络协议,构建攻防技能栈。

采访了五位从互联网、传媒、法律、区块链及创业领域转行 AI 行业的职场人,探讨了他们的转型经历、工作内容及对未来的看法。内容涵盖从互联网大厂到 AI 开发程序员的技能重塑,传媒工作者成为 Prompt 工程师的效率提升,律师转型法律 AI 产品经理的职业平衡,区块链从业者转向 AIGC 产品规划,以及连续创业者对生成式 AI 器术道的理解。文章分析了 AI…

综述了大模型的关键技术与应用。内容涵盖模型设计,包括 Transformer 架构演化、计算效率优化、长上下文推理及多模态能力;模型训练,涉及数据质量、预训练、精调、对齐训练、合成数据及安全性;推理优化技术,如内存管理、算子融合、模型压缩、并行推理及服务调度;以及企业级应用,包括规划、架构设计及 Agent、RAG、插件技术应用。文章分析了大模型的发展趋势、…

详细解析了冻结语言模型参数进行 Prompt 微调的三种主流技术:Prefix-Tuning、Prompt-Tuning 和 P-Tuning。这些方法属于参数高效微调(PEFT)范畴,通过引入连续向量作为 Prompt,大幅降低了微调参数量,实现了轻量级替代方案。Prefix-Tuning 适用于生成任务,通过 MLP 分解优化稳定性;Prompt-Tun…

鸿蒙系统发布后,原生语言支持尚不完善,Flutter 凭借跨平台能力、高性能渲染及庞大的开发者基础,成为潜在的主流选择。文章分析了 Flutter 在鸿蒙生态中的适配可能性,探讨了 Dart 语言特性及其与 TypeScript 结合的前景。同时梳理了从环境搭建、异步编程到状态管理、网络请求等核心学习路径,为开发者转型提供技术参考与方向建议。

Langchain-Chatchat 是基于 Langchain 框架和 ChatGLM 等大语言模型实现的开源检索增强生成 (RAG) 知识库项目,支持离线私有部署。项目利用 FastChat 接入多种开源模型,通过 FastAPI 提供 API 服务或 Streamlit 构建 WebUI。部署方式包括 Docker 一键部署和本地源码部署,支持 GPU…

如何裁剪大语言模型(LLM)的词表以降低参数量。以 Bloom 模型为例,阐述了词表裁剪的核心原理,包括 Embedding 层和 LM Head 权重的映射与复制。提供了完整的 Python 代码实现,展示了如何验证新词表是否为原词表子集、如何更新模型配置以及如何进行一致性检查。实验结果显示,裁剪后模型参数量可显著减少,且生成结果保持一致。文章还补充了关于…

深入探讨了大语言模型面临的主要安全威胁,包括越狱攻击、提示注入和数据投毒。越狱攻击通过角色扮演、编码转换或特殊后缀绕过安全限制;提示注入利用隐藏文本劫持模型指令;数据投毒则在训练阶段植入后门触发恶意行为。文章详细分析了各类攻击的原理与案例,并提出了输入过滤、输出护栏、RLHF 优化、数据清洗及红队测试等防御策略。构建安全的 LLM 环境需多层防护与持续评估,…

深入探讨了 AI Agent 的 Plan-and-Execute 架构。对比传统 ReAct 架构在效率与记忆上的不足,该方案通过规划器生成多步计划并由执行器分步实施,显著提升了任务完成率和成本效益。文章基于 LangGraph 提供了完整的 Python 实现示例,涵盖状态定义、节点编排及重规划机制,为开发者构建复杂智能体系统提供了实践参考。

详细解析了 AI 产品经理的入行必备知识,涵盖市场主流 AI 产品类型如对话生成、AI 绘图、虚拟助手及陪伴类产品。深入剖析了 AI 产品的底层逻辑,包括基础模型能力、应用框架层的编排决策以及产品应用层。文章还提供了市场增长与变现思路,涉及付费订阅、数据销售及垂直领域赋能模式。最后给出了系统的学习路线图,涵盖大模型系统设计、提示词工程、RAG 技术应用、微调…

系统梳理了 AI 大模型在医疗、心理健康、法律、金融、教育及交通等多个垂直行业的应用现状。内容涵盖 DoctorGLM、HuatuoGPT、ChatLaw、FinGPT 等代表性开源模型的技术特点与项目地址,同时介绍了 PromptCBLUE、LEXTREME、FinEval 等行业评测基准。文章旨在展示大模型如何通过指令微调与领域知识融合,解决各行业的专业…

Ollama 是基于 Go 语言开发的本地大模型运行框架。 Ollama 的安装步骤、常用命令及模型下载方法。支持 Llama 3、Mistral 等多种模型,可通过终端直接对话或使用 API 进行流式/非流式调用。适用于本地部署、隐私保护及离线场景的开发需求。