
大语言模型原理、应用与演进路线
大语言模型的发展从统计方法走到预训练与微调,核心能力集中在上下文理解、少样本适应、多模态和一定的推理能力。文章梳理了 GPT、LLaMA、PaLM 等代表模型,以及数据清洗、分词、位置编码、预训练、LoRA 微调、RLHF/DPO 对齐和解码策略等构建环节,也说明了幻觉、知识时效性和无持久记忆这些常见问题。面向应用,提示工程、RAG、工具调用和 Agent…
博客作者
清风竹影
357
已发布文章
9.8K
博客获赞
739K
博客浏览
第 1 页

大语言模型的发展从统计方法走到预训练与微调,核心能力集中在上下文理解、少样本适应、多模态和一定的推理能力。文章梳理了 GPT、LLaMA、PaLM 等代表模型,以及数据清洗、分词、位置编码、预训练、LoRA 微调、RLHF/DPO 对齐和解码策略等构建环节,也说明了幻觉、知识时效性和无持久记忆这些常见问题。面向应用,提示工程、RAG、工具调用和 Agent…
这篇内容围绕 Nginx 的安装、编译参数、systemd 启动方式、主配置文件结构以及常见模块展开,覆盖了虚拟主机、location 匹配、长连接、Basic 认证、错误页、日志、try_files、状态页、gzip、rewrite、HTTPS、反向代理、FastCGI、memcache 缓存和 IO 模型等实操点。整体更像一份可直接照着改的配置速查与实验…

说明了火山引擎豆包 API 的完整开通流程:先注册火山引擎账号并在产品列表中找到豆包大模型,创建 API Key 后还要到开通管理里把 Doubao-Seed-1.8 服务打开,完成实名认证和安心模式设置。随后给出一段可直接测试的 Chat API cURL 示例,提醒 Bearer 后要留空格、model 名称要对应实际版本,并建议用更短的提示词降低 To…
OpenClaw 是开源自托管 AI Agent 系统,官方《橙皮书》更适合理解架构、部署、渠道接入、记忆层和安全配置;社区《蓝皮书》则偏实战,覆盖安装、模型配置、案例、Skill 开发和常见踩坑。两者结合能把'怎么搭起来'和'怎么落地'连成一条完整路径,适合想自己掌握数据、并且愿意处理配置与运维细节的人。
在 Windows 上可以用 Ollama 本地运行 DeepSeek-R1,再配合 OpenClaw 作为调度中枢,通过安装不同的 Skill 扩展开发、数据分析、写作和视频辅助能力。文章整理了硬件要求、Ollama 和 Node.js 的安装步骤、OpenClaw 初始化与状态检查、Skill 包的克隆与启用方法,以及常见的卡顿、路径和网络问题处理方式。…

OpenClaw 中 web_search、web_fetch、tavily-search 等概念常被混淆。本文梳理了它们的分工:web_search 是搜索能力接口,web_fetch 负责抓取页面,Tavily 等为扩展 skill 而非原生 provider。给出了先搜索后抓取的标准工作流、命令行测试方法和对话提示词模板,并总结了常见误区和排障步骤。
分析了微信视频号视频文件的加密特征,发现其头部被异或加密。通过调试浏览器请求回调,定位到简单的异或解密函数M,其密钥数组来自WebAssembly模块,引出了对WASM逆向的需求。
Whisper-WebUI 是一款基于 Gradio 的开源语音转文字工具,集成了原生 Whisper、faster-whisper 等多种引擎。它通过智能音频预处理流水线(如 Silero VAD)和背景音乐分离功能提升识别准确率。相比原生方案,faster-whisper 引擎在显存占用和处理速度上优势明显,适合个人电脑运行。支持视频转录、会议记录及教育…

Web Scraper 是一款基于浏览器的无代码爬虫工具,特别适合不熟悉编程的新手快速采集网页数据。以知乎评论抓取为例,演示如何配置选择器、处理滚动加载及导出数据。相比 Python 脚本,该方案学习成本低,能覆盖日常 90% 的数据获取场景,有效提升工作效率。

宇树机器人在 2026 年春晚的武术表演展示了人形机器人的最新技术进展。文章拆解了 H2 机器人的硬件升级与算法架构,包括自研电机、MPC 控制及强化学习应用。同时分析了其在工业制造、文旅演艺等场景的商业化落地案例,并探讨了产业链就业机会与政策支持。内容涵盖运动控制、供应链布局及行业对比,为技术从业者提供入行参考。

笔记本 CPU 环境下运行 Faster-Whisper 需权衡识别准确率与运行速度。Tiny 模式资源占用低但精度有限;Base 模式平衡性好,推荐首选;Distil-large 模式精度高但 CPU 负载大,非实时场景慎用。开启 int8 量化可显著降低内存占用并提升推理速度。建议优先尝试 Base 模型配合 int8 量化配置。

PX4 飞控固件更新可通过 QGroundControl 工具完成。支持在线安装稳定版、测试版或自定义固件。指定版本固件需从 GitHub Releases 下载对应文件(如 px4_fmu-v5_default.px4),在 QGC 中选择高级设置并导入本地固件文件进行烧录。操作前需断开 USB 连接并断电,按提示插拔即可刷新固件版本。

OpenClaw 通过统一的 message 工具接口实现了与 Telegram Bot 的深度集成,支持消息收发、群组管理及媒体处理。详细阐述了从 Bot 创建、Webhook 配置到消息命令处理的全流程,涵盖文本、Markdown、HTML 及文件发送方式。重点介绍了内联键盘、投票、群组权限等高级功能,并结合客服、任务管理等实战案例提供最佳实践建议,包括…
HTML5 结合 AI 技术实现智能前端场景渲染。文章解析 HTML5 核心特性与前端 AI 推理概念,阐述 Canvas 绘图、AI 接口封装及数据交互机制。通过智能表单、天气展示等案例演示实践方法,总结性能优化与渐进增强最佳实践。涵盖常见问题解答、未来趋势分析及职业发展建议,助力开发者掌握前端智能化开发技能。
Whisper-large-v3 部署常遇启动失败、识别不准及显存溢出等问题。基于真实环境验证,涵盖 FFmpeg 依赖检查、CUDA 版本匹配、端口占用排查等启动前置条件;详解语言检测误判原因及手动指定语言策略;提供 fp16 半精度优化与流式录音修复方案以解决性能瓶颈;规范音频预处理标准(单声道 16kHz);并展示通过 API 生成 SRT 字幕及批量…
DeepSeek-R1-Distill-Llama-8B 模型通过知识蒸馏优化,在保持小参数规模的同时具备强大的推理能力。演示了如何使用 Ollama 部署该模型,并基于 Python 构建智能问答系统。内容包括环境配置、基础问答功能实现、多轮对话增强、提示词工程优化及生产环境 Docker 部署方案。系统集成了错误处理与日志监控机制,适用于教育辅导、技术支…
基于 llama.cpp 在单 GPU 环境下部署 Qwen3.5 模型,通过 SSH 端口转发实现本地安全访问。流程涵盖环境搭建、模型量化下载、服务启动及 OpenAI 兼容接口测试。结合 Python 脚本与 rich 库开发终端股票筛选工具,演示了大模型在垂直场景的代码生成与应用集成能力,同时总结了量化精度与推理稳定性的权衡经验。

文心一言 4.5 开源版本本地化部署流程及性能测试。介绍 ERNIE 4.5 架构特点如 MoE 和多模态异构设计,详述基于 FastDeploy 工具在 Linux 环境下的安装步骤,包括虚拟环境配置、依赖库安装及模型拉取。通过通识、中文语境及写作能力测试验证了 0.3B 轻量级模型的实际表现,结果显示其响应速度快且具备一定生成能力,适合低资源场景应用。

面对社交电商及物联网产生的复杂关系网,传统数据库在处理关联运算时面临瓶颈,图数据库应运而生。聚焦 Neo4j 图数据库,解析其核心特点与功能优势,对比其与关系型及文档型数据库的差异。同时梳理了 SpringBoot 整合 Neo4j 的环境准备与代码实现路径,为构建高性能关系计算系统提供技术参考。

通义万相 2.1 是一款支持 1080P 无时长限制视频生成的开源模型,具备模拟自然动作及还原物理规律的能力。部署该模型需要依托高性能计算集群,利用 NVIDIA A100 等 GPU 算力及 Kubernetes 架构进行资源调度。通过集成 PyTorch 和 TensorFlow 框架,结合智能动态推理机制,可实现多模态数据的精准处理。该方案适用于 AI…