本地大模型在内网部署 Llama/Qwen 及安全增强实践
详细阐述了在企业内网物理隔离环境下部署本地大模型(如 Llama、Qwen)的技术方案。内容涵盖基座模型选型策略、GPU 显存算力规划与量化计算、推理框架(vLLM/Ollama)的性能调优及 API 安全加固。此外,文章深入讲解了利用 LoRA 进行参数高效微调(SFT)及 DPO 对齐的方法,构建具备安全价值观的专用模型,并介绍了其在 SOC 降噪、逆向…
博客作者
与晚风对话
329
已发布文章
10K
博客获赞
570K
博客浏览
第 6 页
详细阐述了在企业内网物理隔离环境下部署本地大模型(如 Llama、Qwen)的技术方案。内容涵盖基座模型选型策略、GPU 显存算力规划与量化计算、推理框架(vLLM/Ollama)的性能调优及 API 安全加固。此外,文章深入讲解了利用 LoRA 进行参数高效微调(SFT)及 DPO 对齐的方法,构建具备安全价值观的专用模型,并介绍了其在 SOC 降噪、逆向…
对比了 Unsloth 和 LLaMA Factory 两款大语言模型微调工具。Unsloth 侧重极致速度与显存优化,适合单卡资源受限场景;LLaMA Factory 侧重零代码与全场景支持,适合新手及企业级流程。文章从核心定位、性能、功能、上手难度及适用场景五个维度详细分析,帮助用户根据实际需求选择合适工具。
解决 VS Code 通过 SSH 远程连接时 Copilot 无法使用 Claude 模型及 Agent 模式报错的问题。原因为强制扩展在本地运行导致工作区路径识别异常。解决方案是在远程服务器端配置代理,而非在本地强制扩展运行,从而确保远程工作区正常访问且模型可用。
介绍 Qwen3-Embedding-4B 模型的本地化部署实践。该模型支持 32k 长文本,输出 2560 维向量,适用于检索和知识管理。教程提供两种方案:一是基于 llama.cpp 的轻量级部署,利用 GGUF 量化在消费级显卡运行;二是结合 vLLM 与 Open WebUI 构建可视化知识库系统,支持 RAG 检索。内容涵盖环境准备、模型下载、服务…
OpenArm 是一款 7 自由度开源人形机械臂,采用模块化设计和开放源码,适合机器人技术学习与创新。其硬件具备高回驱电机和顺从性结构,支持 1kHz 高频控制,峰值负载 6kg。项目基于 ROS2 环境,使用 CAN-FD 通信。涵盖硬件架构解析、快速部署指南、安全系统设计及性能优化技巧,旨在帮助用户掌握人机协作技术并应用于科研或工业场景。
Windows 10/11 系统下 USB-Blaster 驱动常因驱动程序签名强制(DSE)机制导致无法识别或显示无效。驱动工作原理,提供了标准安装、手动指定 INF 文件及绕过签名限制三种解决方案,并包含清理残留、批量部署等调试技巧及验证方法,确保硬件连接稳定。

探讨 Flutter 组件 sse_stream 在 OpenHarmony 端的深度适配。重点解决高并发 Server-Sent Events(SSE)场景下的背压处理问题,防止 UI 线程阻塞导致 ANR。通过引入节流器(Throttler)、缓冲区控制及智能重连机制,实现工业级 AI 响应流的稳定传输。文章涵盖原理分析、API 详解、后台连接治理及综合…

如何在腾讯云轻量应用服务器上部署 OpenClaw 智能体。主要步骤包括购买预装镜像的服务器、进入应用管理界面、配置各类大模型 API(如 GLM、混元、通义千问)、连接 QQ 和飞书机器人通道、安装和管理技能(skill)。此外还涵盖了服务器文件管理、日志查看、数据持久化备份以及具体使用案例,如点餐和任务管理。文章强调了安全部署、Token 成本控制及命令…

2026 年 4 月 22 日至 24 日,深圳会展中心将举办第二届 FAIR plus 机器人全产业链接会。活动涵盖核心零部件、人工智能算法、整机研发等展品范围,新增初创企业、科研机构及国际展团展区。学术论坛联合中科院深圳先进院及德国 VDMA 举办,发布《2025 年深圳市机器人产业发展白皮书》。旨在搭建全球协作平台,促进机器人智能化发展及产业链协同创新…

一个基于YOLOv8/v11与LLM大模型的Web目标检测系统,采用Django+Vue3前后端分离架构。系统支持目标检测、图像分类、实例分割、关键点检测及旋转框检测等多种任务,可实现摄像头实时识别。通过集成DeepSeek等大模型,系统具备视觉感知与智能分析能力,支持单/双模型联合识别(如人脸表情识别),适用于安防、科研、工业质检等场景。

JavaScript 中 var、let、const 的区别,涵盖作用域、变量提升、可重复声明及修改性。通过代码示例对比三者特性,提供最佳实践建议:优先使用 const 声明常量或不可变引用,需要修改时使用 let,避免使用 var。结合循环变量、状态管理及 DOM 操作等场景,帮助开发者规范变量声明,减少潜在 Bug。

Spring Web MVC 核心概念、MVC 架构及与 Spring Boot 区别。内容包括项目搭建、核心注解应用(如@RequestMapping)、请求参数接收(基础、对象、数组、JSON)、文件上传、Cookie 与 Session 管理、响应处理及静态资源返回。结合加法计算器、用户登录、图书管理等实战案例,演示 Postman 接口测试与 Lom…
SBUS 协议是遥控器与接收机间常用的串行数字通信协议,相比传统 PWM 和 PPM,具有单线传输多通道、抗干扰强、延迟低等优势。 SBUS 工作原理,包括反向电平逻辑 UART 实现、100kbps 波特率配置及 25 字节帧结构。内容涵盖硬件接口设计(如 SN74LVC1G240、74HC14 反相器方案)、STM32 代码解析示例及故障检测机制,适用于…

介绍 Neo4j 图数据库的快速上手方法,涵盖 Desktop、Docker 及压缩包三种安装方式。详细讲解 Neo4j Browser 界面操作,包括 Cypher 语言的节点创建、关系建立、查询、更新与删除等 CRUD 操作。此外还包含索引约束优化、CSV 数据导入流程以及常见故障排查指南,帮助开发者从零掌握图数据存储与查询的核心技能。

OpenClaw 默认配置往往只发挥 20% 的能力。总结了 5 步高效调教方法:首先通过 SOUL.md 等文件设定 AI 人格与偏好;其次构建分层记忆结构并开启 memorySearch 增强检索;接着利用自定义 Skill 扩展视频下载、PPT 生成等实际能力;然后通过 HEARTBEAT.md 配置心跳机制实现主动巡检;最后采用多模型分级策略降低 T…
DeepSeek-R1-Distill-Llama-70B 是基于 Llama-3.3-70B-Instruct 基座,通过强化学习与指令微调蒸馏而成的开源推理模型。它在数学、代码及逻辑推理任务上表现优异,MATH-500 准确率达 94.5%,超越 o1-mini。支持 vLLM、SGLang 等多种部署方案,可本地化运行以降低成本。该模型采用双阶段蒸馏策…

Web2Executable 是一款基于 NW.js 的工具,可将网页或 Node.js 应用封装为跨平台桌面程序。支持图形界面和命令行两种模式,无需复杂配置即可生成 Windows、macOS 和 Linux 应用。安装方法、基本配置流程、自动化构建脚本及 CI/CD 集成示例,并对比了 Electron 和 Tauri 等竞品,提供了性能优化建议与常见问…

介绍 OpenClaw 的三种核心交互方式:Web 控制台、TUI 终端和聊天软件集成。重点讲解 Web 控制台的配置与功能模块,TUI 终端的启动与命令使用,以及钉钉等聊天软件的接入流程。涵盖设备配对、Token 认证、技能市场调用及常见问题排查,帮助用户实现多端协同办公。
在统信 UOS 操作系统和申威 CPU 架构环境下部署 Lychee-Rerank 相关性评分工具的完整流程。内容包括系统环境准备、Python 虚拟环境搭建、依赖包安装(针对 SW64 架构的特殊处理)、项目代码获取与配置、模型文件准备(使用 Qwen2.5-1.5B 替代)、服务启动及界面操作指南。此外,还总结了常见问题解决方案及性能优化建议,旨在为用户…

2025 年 12 月三大运营商高层人事变动频繁,工信部成立人形机器人与具身智能标准化技术委员会。中国移动、电信、联通均布局 AI+ 机器人业务,通过标准协同推动从连接服务向智能服务转型,开启万亿级市场变革。