大模型微调主要框架 Firefly vs LLaMA Factory 全方位对比表

优质文章学习记录

07 Apr 2026 — 5 min read

Firefly vs LLaMA Factory 全方位对比表 + 生物医药垂类微调选型建议

一、核心维度对比表格

对比维度	Firefly（流萤）	LLaMA Factory
开发主体	个人开源：杨建新（YeungNLP），前Shopee NLP工程师，中山大学硕士	社区开源：hiyouga核心维护，全球开源社区协同迭代
项目定位	聚焦中文大模型的轻量化训练框架+配套中文优化模型	通用型全栈大模型微调框架，无语言/模型偏向，极致兼容
支持基座模型	以中文友好模型为主（Llama系列、Qwen、ChatGLM、Firefly自训模型），覆盖有限但深度适配	全主流开源模型全覆盖（Llama、Qwen、Mistral、DeepSeek、GLM、Yi、Firefly等），几乎无适配成本
支持微调方式	基础SFT、LoRA/QLoRA、增量预训练，进阶对齐方法较少	SFT、DPO/IPO/KTO、RLHF、预训练、多模态微调，全流程对齐方案完整
中文优化	原生深度优化：中文分词、语料、表达逻辑专项适配，中文生成质感最优	通用框架无原生中文特化，依赖基座模型本身中文能力，可通过数据弥补
使用门槛	配置简洁、脚本轻量化，中文新手教程充足，上手快	UI/命令行双模式，模板化YAML配置，零代码WebUI，新手友好度拉满
硬件显存优化	支持4/8bit量化、QLoRA，单卡消费级显卡可跑7B~13B模型	量化、LoRA、梯度检查点、多卡并行等优化更全面，大参数模型适配性更强
文档&社区	中文文档完善，作者公众号/知乎答疑，社区规模中等，问题响应较快	国内外社区双活跃，Issue/教程/二次开发案例极多，复杂问题解决方案丰富
部署导出	支持基础量化导出、本地推理，生产级部署工具链简易	多格式导出（LoRA合并、GGUF、GPTQ、AWQ），对接主流推理框架，生产部署完整
扩展性	聚焦中文SFT场景，自定义扩展、多任务适配能力一般	插件化架构，可自定义数据集格式、训练策略、新增模型，扩展性极强
维护频率	稳定迭代，更新节奏偏个人开源节奏	高频更新，新模型、新算法第一时间集成
适用核心人群	中文垂类开发者、个人科研、轻量化中文对话任务	全场景开发者、多模型测试、进阶对齐、复杂垂类、工程化落地

二、核心差异一句话总结

Firefly：专精中文场景，小而精，配置简单，中文生成效果上限高，适合纯中文垂类快速微调。
LLaMA Factory：全能通用框架，大而全，兼容所有模型与微调方法，社区生态无敌，适合试错、多模型对比、进阶训练。

三、通用场景快速选型规则

纯中文对话/文案/国内垂类任务 → 优先 Firefly
多模型轮换测试、需DPO/RLHF进阶对齐、多模态微调 → 必选 LLaMA Factory
新手零基础、追求一键运行、不想处理代码适配 → 优先 LLaMA Factory（WebUI）
追求极致中文流畅度、轻量化脚本、极简部署 → 优先 Firefly
企业生产落地、多格式导出、分布式训练 → 优先 LLaMA Factory

四、结合你的「小分子药物筛选/生物医药垂类」专属建议

结合你做AI生物医药、小分子药物筛选、论文相关垂类微调的需求，给出针对性结论：

1. 优先推荐方案：LLaMA Factory

核心适配理由：

生物医药场景会用到Llama、DeepSeek、Qwen、Yi等多类基座模型，LLaMA Factory无适配成本，可快速对比不同基座在医药数据上的效果。
垂类微调常需要迭代数据、尝试LoRA/量化参数，甚至后续做DPO对齐优化回答准确性，LLaMA Factory全流程支持。
本地消费级显卡训练、低显存环境下，其量化与显存优化比Firefly更细致，大参数模型训练稳定性更好。
生物医药文献多为中英混合，LLaMA Factory不绑定中文特化，可灵活适配双语垂类数据，通用性更强。
社区海量医药/科研垂类微调案例、踩坑文档，遇到训练报错、参数不合理问题更容易找到解决方案。

2. 可选备选方案：Firefly

仅适用于：

你的训练数据100%为中文医药文献、中文问答，极致追求中文表达流畅度。
仅固定使用1~2款中文基座（Qwen/ChatGLM），不做多模型对比，只需要快速完成基础SFT。

3. 最优折中实操方案（兼顾两者优势，最推荐你使用）

采用 LLaMA Factory 框架 + Firefly系列基座模型 组合：

用LLaMA Factory的易用UI、参数优化、全格式支持，降低训练与部署成本。
加载Hugging Face上的Firefly预训练模型（Firefly-Llama、Firefly-Qwen），保留中文深度优化的基础能力。
注入你的小分子药物筛选、DrugBank、ZINC20相关垂类数据做LoRA微调，兼顾通用框架兼容性与中文生成质量。
训练完成后通过LLaMA Factory导出量化模型，本地推理或后续部署都更灵活。

五、极简最终结论

做小分子药物筛选这类科研垂类、多模型测试、双语数据、长期迭代 → 直接用 LLaMA Factory
仅做纯中文医药对话、极简快速微调、不折腾框架 → 用 Firefly
想要兼顾中文效果与框架易用性 → LLaMA Factory 微调 Firefly 基座模型（最适合你的场景）

需要我进一步给出适配生物医药数据格式的LLaMA Factory训练YAML模板、LoRA参数推荐，以及本地显卡（3090/4090）的显存优化配置吗？

AI绘画建筑设计提示词：从基础到高级的完整创作指南

一、核心逻辑：高质量建筑提示词的 7 大组成部分 AI 对建筑的理解需要 “分层引导”，一个完整的提示词通常包含 7 个关键模块，你可根据需求灵活组合或删减，基础逻辑为：先明确 “画什么”，再定义 “怎么画”，最后优化 “画得好”。具体结构如下： [主体/建筑类型] + [风格/建筑师参考] + [环境/场景设定] + [细节与材质] + [构图与视角] + [灯光与氛围] + [画质/技术参数] 这一结构能让 AI 清晰捕捉设计核心，避免因信息模糊导致的 “偏离预期”，是高效创作的基础框架。二、分模块详解：建筑提示词词汇库与应用技巧 1. 主体 / 建筑类型：明确 “画什么” 的核心这是提示词的 “根基”，需精准定义建筑的功能与形态，避免笼统表述。

Modelsim仿真软件的，安装/破解/使用教程大全

仿真前言作为一名FPGA工程师，在做FPGA开发时，使用仿真一定是最重要的，有些人喜欢写完代码直接上板子调试，根本不会做一点点仿真；如果是简单的逻辑代码，有十足的把握，那就不用仿真，可以直接上板子调试，但是，如果您是在做工程的开发，很多代码都是第一次编写调试，那么，代码的仿真是一定要做的，你要问我为啥，我个人觉得，每次把自己写完的代码，放到modelsim上面仿真看一下波形，就像考试的时候，拿着参考答案在做题一样的感觉，各个波形的变化你都会看的一清二楚，但是如果你用在线逻辑分析仪看RTL的仿真，那真的是太耗费时间；我知道这个时候就会有人说了，Modelsima仿真有啥用呀，和下板子调试完全是两个概念，包括信号延迟，信号质量，眼图等都不一样，说的也对，但是实际情况是，这些人眼高手低，觉得仿真这种操作太麻烦；仿真虽然不能完全模拟真实的硬件信号，硬件延迟也没法准确仿真，但是他能让你在开发的时候，规避掉95%的因为代码引起的错误，这会让你在调试阶段节省很多时间；然后剩下的调试你必须要在硬件调试时才会发现并且解决；在调试阶段，FPGA为

【论文阅读】SWE-CI: Evaluating Agent Capabilities in Maintaining Codebases via Continuous Integration

SWE-CI：基于持续集成评估智能体在代码库维护中的能力 * 论文链接 * 摘要 * 1. 简介 * 2. 评估智能体维护代码库的能力 * 2.1 任务形式化 * 2.2 归一化变更 * 2.3 EvoScore（演进得分） * 3 SWE-CI * 3.1 数据构建（Data curation） * Step 1: Repository Collection * Step 2: Commit Span Extraction * Step 3: Environment Construction * Step 4: Case Filtering * 3.2 双智能体评估协议 * 4 Experiments * 4.1 Experiment

无人机 | MAVROS安装与基础知识梳理(附ROS C++仿真案例)

目录 * 1 MAVROS简介 * 2 MAVROS安装 * 3 MAVROS基础知识 * 3.1 MAVROS坐标系 * 3.2 MAVROS常用话题 * 3.2.1 `/mavros/state` * 3.2.2 `/mavros/setpoint_position/local` * 3.2.3 `/mavros/local_position/odom` * 3.2.4 `/mavros/setpoint_raw/local` * 3.2.5 `/mavros/setpoint_raw/attitude` * 3.3 MAVROS常用服务 * 3.