
上手 Llama 3:推理与 LoRA 微调实践
Meta 开源 Llama 3 模型,提供 8B 和 70B 参数版本,在 15T tokens 上训练,引入分组查询注意力和 128K 词表优化。本文记录从环境配置到推理和 LoRA 微调的实战流程,覆盖 Transformers 与 llama.cpp 两种推理方式,以及基于 Swift 框架的微调命令和硬件要求。
博客作者
偷走时光
348
已发布文章
17K
博客获赞
869K
博客浏览
第 1 页

Meta 开源 Llama 3 模型,提供 8B 和 70B 参数版本,在 15T tokens 上训练,引入分组查询注意力和 128K 词表优化。本文记录从环境配置到推理和 LoRA 微调的实战流程,覆盖 Transformers 与 llama.cpp 两种推理方式,以及基于 Swift 框架的微调命令和硬件要求。

这段内容讲的是用 Python 和 Selenium 串起一个抢票自动化流程:先准备浏览器、驱动和 stealth.min.js,再通过模拟滑动轨迹处理淘宝登录滑块,最后完成登录、进入购票页、点击购买和提交。代码里保留了轨迹生成、iframe 切换和 ActionChains 拖拽的写法,思路清楚,但真正容易出问题的还是滑块识别和页面状态变化。

基于 Spring Boot 和 Vue.js 的库存管理系统采用前后端分离架构,后端负责权限、库存、采购和流程流转,前端提供管理界面与数据可视化。文章梳理了商品、采购订单和用户权限三张核心表的字段设计,并给出 Redis 缓存、复合索引、JWT 认证、RBAC 权限控制、外部系统对接以及监控部署方案。整体思路是优先保证库存数据一致性、权限可控和查询性能,适…
ImGui 适合给 C++ 程序快速加调试窗口、参数面板和内部工具界面。文章先说明它的即时模式特点和适用场景,再用 GLFW + OpenGL 3 作为后端,给出 CMake 配置和主循环骨架,完成 ImGui 上下文初始化、每帧刷新与渲染。后半部分演示了滑条、复选框、输入框和下拉框等常用控件,并强调 UI 状态与业务逻辑分离,避免后期维护变乱。

Clawdbot 安装本身不复杂,关键在于它默认只监听本地端口,外网访问需要先做反向代理,再补上 HTTPS 和访问控制。文章整理了在常见 Linux 发行版和部分国产系统上的安装方式、初始化命令、设备授权流程,以及通过 Nginx 配置 BasicAuth 的做法。整体思路是先让服务跑起来,再把公网暴露面收紧,既能用网页控制台,也能避免把管理入口直接放到公…

在 Windows 上安装 JDK 23 的完整过程:选择 x64 Installer 下载安装,自定义路径到 D:\\JDK;配置环境变量 JAVA_HOME 和 Path 中的 %JAVA_HOME%\\bin;用 java -version 和 javac -version 验证;编写 HelloWorld.java 并编译运行,同时注意 Window…

基于 Spring AI 与 IntelliJ Platform SDK 开发了一款能感知项目上下文的 AI 代码助手 IDEA 插件。后端利用 Maven API 和 JavaParser 解析包结构与依赖,结合精心设计的 Prompt 工程实现 Controller、Service、Mapper 的一键生成与语法校验;前端通过 Swing 构建对话窗口,…
针对豆包 AI 生成视频的水印问题,分享了手机端免安装软件的解析方案。通过微信小程序搜索特定工具粘贴链接即可快速去除,支持即梦、千问及主流短视频平台。此外还介绍了专业软件如 HitPaw 处理复杂水印,以及利用剪辑软件裁剪遮盖的替代思路。根据设备条件和水印类型选择合适方式,可高效保存无水印视频。

Python AI 开发环境配置涉及 Anaconda、PyCharm 及 Claude Code 工具链的安装与集成。教程覆盖 Windows 与 macOS 系统,详细演示 Conda 环境初始化、虚拟环境创建、Node.js 依赖安装以及 Claude Code CLI 和 PyCharm 插件的配置流程。包含环境变量设置、代理配置及常见报错排查方案,…

RunningHub 是基于开源生态的图形音视频 AIGC 应用共创平台,采用模块化节点系统与云端算力整合。其核心优势包括设计能力平权化、成本重构及生态闭环,支持开发者通过 Python/JS 上传节点获取收益。平台提供 7000+ 预置节点库,兼容 ComfyUI 架构,实现零代码工作流拖拽。相比传统方案,硬件要求降低,视频生成时长突破至 120 秒,批量…
基于 Ubuntu 22.04 的 8 卡 RTX 5090 服务器部署 llama.cpp 完整流程。涵盖 Blackwell 架构驱动安装(需使用 open-dkms)、CUDA 12.4 环境配置及源码编译优化。重点演示多 GPU 并行推理设置,包括显存分配、Flash Attention 开启及 NUMA 调度策略。实测显示在 Qwen3 32B 模…

飞书 lark-cli 命令行工具面向 AI Agent 时代构建企业级基础设施。采用元数据驱动设计,支持 200+ 命令覆盖 11 个业务域及 19 个 AI Skills。架构包含 Shortcuts、API Commands 和 Raw API 三层,强调 AI 友好性,提供 Schema 自省、dry-run 预览、结构化输出及安全权限管理。相比 M…

Flutter 集成 bip340 库在鸿蒙系统上实现 Schnorr 签名。该方案利用 secp256k1 曲线特性,支持签名线性聚合,提升验证效率并增强隐私保护。通过纯 Dart 实现避免重型 C 库依赖,结合 Isolate 并发处理确保 UI 流畅。适用于 Web3 应用及高安通讯协议,提供抗延展性签名能力。
Hunyuan-MT-7B WebUI 本地部署基于 Docker 容器化方案,无需手动配置 CUDA 或环境依赖。步骤包括确认硬件(GPU 显存≥12GB)、拉取预置镜像、启动容器映射端口 8080、执行内部脚本加载模型。支持 38 种语言翻译,含少数民族语言优化。提供健康检查命令验证服务状态,支持 INT4 量化降低显存占用。内置 RESTful API…

OpenClaw 作为新兴 AI 智能体框架,凭借跨应用操作和自动化能力引发关注。百度、腾讯等大厂纷纷布局移动端及云端服务,提供一键部署或零部署体验。然而,随着热度攀升,安全风险如提示词注入、插件投毒等问题也随之显现。用户需强化网络控制与凭证管理,理性看待技术红利与安全边界,避免盲目跟风。
Token 是大语言模型处理文本的最小意义单位,通过词汇表映射为数值 ID。文章解析了 Token 的定义、特点及对上下文窗口、训练成本的影响,介绍了字节对编码(BPE)等分词技术,并通过代码示例展示了如何监控 Token 消耗。同时探讨了截断、微调等应对长度限制的策略,以及多模态 Token 化的未来趋势。

本文基于 Spring AI 与 IntelliJ Platform SDK,详解如何从零构建支持上下文感知的 IDE 代码助手。通过整合 JavaParser 与 Maven API 解析项目结构,结合 Prompt 工程实现 Controller、Service、Mapper 的完整生成及性能优化。方案涵盖前后端架构设计、核心功能实现、私有化部署及常见踩…

扩散模型作为当前主流生成模型,经历了从DDPM像素级扩散到Stable Diffusion潜在空间优化,再到DiT Transformer架构的演进。DDPM奠定理论基础但推理慢;Stable Diffusion通过潜在空间降低计算成本并支持文生图;DiT引入Transformer提升扩展性与训练稳定性。文章梳理了各阶段特点、架构差异及业界主流应用趋势。
ESP32 无人机远程识别实战方案涵盖硬件选型、固件编译烧录、DroneCAN 参数配置及安全签名机制。重点解析 LOCK_LEVEL 安全等级设置、密钥生成流程及常见问题排查,帮助开发者在保障设备安全的前提下完成合规部署。涉及环境准备、Make 编译、Python 脚本签名及 Web 管理界面配置,适用于商业、测试及教育等多种场景。
Windows 本地部署 Ollama 结合 OpenClaw 智能中枢,无需云端 API 即可实现 APP 开发、数据分析、文案写作及视频剪辑等自动化任务。通过安装特定 Skill 包,赋予大模型调用外部工具的能力,支持私有化运行与数据隐私保护。文章涵盖硬件配置要求、Ollama 模型下载、OpenClaw 环境搭建及技能激活步骤,提供常见问题解决方案,帮…