DeerFlow 2.0:字节开源的超级 Agent 框架,让 AI 真正干活

DeerFlow 2.0:字节开源的超级 Agent 框架,让 AI 真正干活

作者:madprinter
日期:2026-03-24
项目地址:https://github.com/bytedance/deer-flow

项目介绍

DeerFlow(Deep Exploration and Efficient Research Flow)是字节跳动开源的一款超级 Agent 框架。2026 年 2 月 28 日,DeerFlow 2.0 正式发布后迅速登顶 GitHub Trending 榜首,目前已有近 40,000 颗星。

与传统的 AI 框架不同,DeerFlow 不仅仅是一个"聊天机器人",它是一个真正能干活的 Agent 运行环境。它拥有自己的文件系统、沙箱执行环境、长期记忆系统,可以自主规划任务并调度多个子 Agent 协同工作。

为什么 DeerFlow 值得关注?

  1. 大厂背书:字节跳动出品,经过真实业务场景验证
  2. 架构先进:基于 LangGraph 和 LangChain 构建,设计优雅
  3. 功能完整:开箱即用的文件系统、记忆系统、沙箱执行
  4. 高度可扩展:支持自定义技能、工具、MCP 服务器
  5. 多模型支持:兼容 OpenAI API 格式的所有大模型

核心功能

1. 技能系统(Skills)

DeerFlow 的核心是技能系统。每个技能是一个结构化的能力模块,包含工作流程、最佳实践和相关资源引用。

内置技能包括:

  • 🔍 深度研究(Research)
  • 📝 报告生成(Report Generation)
  • 📊 PPT 制作(Slide Creation)
  • 🌐 网页生成(Web Page)
  • 🎨 图片/视频生成(Image/Video Generation)

技能按需加载,不会一次性占用大量上下文,这对 Token 敏感的模型非常友好。

/mnt/skills/public ├── research/SKILL.md ├── report-generation/SKILL.md ├── slide-creation/SKILL.md ├── web-page/SKILL.md └── image-generation/SKILL.md 

2. 子 Agent 系统(Sub-Agents)

复杂任务很少能一次完成。DeerFlow 可以将任务分解,动态生成多个子 Agent 并行执行。

  • 每个子 Agent 有独立的作用域上下文
  • 子 Agent 可以并行执行,提高效率
  • 主 Agent 负责汇总所有结果,生成最终输出

例如:一个研究任务可以分解为十多个子 Agent,每个探索不同角度,最终汇聚成一份完整报告。

3. 沙箱执行环境(Sandbox)

DeerFlow 不只是"说说而已",它有自己的"电脑"——每个任务在独立的 Docker 容器中运行:

  • ✅ 完整的文件系统
  • ✅ Bash 命令执行
  • ✅ 代码运行能力
  • ✅ 图片查看能力
  • ✅ 会话隔离,零污染
/mnt/user-data/ ├── uploads/ # 用户上传的文件 ├── workspace/ # Agent 工作目录 └── outputs/ # 最终交付物 

4. 长期记忆(Long-Term Memory)

大多数 Agent 在对话结束后就忘记一切。DeerFlow 会记住:

  • 用户画像和偏好
  • 技术栈信息
  • 重复的工作流程
  • 历史交互经验

记忆本地存储,完全由用户控制。系统会自动去重,避免重复信息无限累积。

5. 多通道集成(IM Channels)

DeerFlow 支持多种即时通讯工具接入:

通道传输方式难度
TelegramBot API (长轮询)简单
SlackSocket Mode中等
飞书/LarkWebSocket中等

无需公网 IP,所有通道配置后即可自动启动。

6. Claude Code 集成

通过 claude-to-deerflow 技能,可以直接在 Claude Code 中与 DeerFlow 交互:

npx skills add https://github.com/bytedance/deer-flow --skill claude-to-deerflow 

支持的功能:

  • 发送任务并获取流式响应
  • 选择执行模式:flash/fast/standard/pro/ultra
  • 查看健康状态、模型、技能列表
  • 管理对话线程和历史
  • 上传文件进行分析

使用方法

快速开始

1. 克隆项目
git clone https://github.com/bytedance/deer-flow.git cd deer-flow 
2. 生成配置文件
make config 

这会基于模板创建本地配置文件。

3. 配置模型

编辑 config.yaml,配置至少一个模型:

models:-name: gpt-4display_name: GPT-4use: langchain_openai:ChatOpenAI model: gpt-4api_key: $OPENAI_API_KEY max_tokens:4096temperature:0.7-name: openrouter-gemini-2.5-flash display_name: Gemini 2.5 Flash (OpenRouter) use: langchain_openai:ChatOpenAI model: google/gemini-2.5-flash-preview api_key: $OPENAI_API_KEY base_url: https://openrouter.ai/api/v1 
4. 设置 API Key

推荐方式:编辑项目根目录的 .env 文件

TAVILY_API_KEY=your-tavily-api-key OPENAI_API_KEY=your-openai-api-key INFOQUEST_API_KEY=your-infoquest-api-key 
5. 启动服务

Docker 方式(推荐)

make docker-init # 拉取沙箱镜像(只需一次)make docker-start # 启动服务

本地开发方式

make check # 检查依赖makeinstall# 安装依赖make dev # 启动服务

访问:http://localhost:2026

推荐模型

DeerFlow 官方推荐使用以下模型以获得最佳体验:

  • Doubao-Seed-2.0-Code
  • DeepSeek v3.2
  • Kimi 2.5

这些模型支持:

  • 长上下文(100k+ tokens)
  • 强大的推理能力
  • 多模态输入
  • 可靠的工具调用

飞书/钉钉集成示例

config.yaml 中配置:

channels:feishu:enabled:trueapp_id: $FEISHU_APP_ID app_secret: $FEISHU_APP_SECRET slack:enabled:truebot_token: $SLACK_BOT_TOKEN app_token: $SLACK_APP_TOKEN 

.env 中设置对应的密钥即可。

技术架构

DeerFlow 2.0 是完全重写的版本,与 1.x 没有任何代码共享。核心架构:

┌─────────────────────────────────────────┐ │ Gateway (API Gateway) │ ├─────────────────────────────────────────┤ │ LangGraph Agent Server │ ├──────────────┬──────────────┬───────────┤ │ Skills │ Tools │ Memory │ ├──────────────┴──────────────┴───────────┤ │ Sandbox (Docker/K8s) │ └─────────────────────────────────────────┘ 
  • Gateway:统一 API 入口,处理认证、路由、会话管理
  • LangGraph Server:Agent 编排引擎
  • Skills/Tools:可扩展的能力模块
  • Memory:长期记忆存储
  • Sandbox:隔离执行环境

实际应用场景

DeerFlow 已经超越最初的研究工具定位,社区开发者用它实现了:

  • 📊 数据管道自动化
  • 📽️ PPT/幻灯片自动生成
  • 📈 数据看板搭建
  • 📝 内容工作流自动化
  • 🔍 深度市场调研
  • 💻 代码生成和审查

总结

DeerFlow 2.0 代表了一个重要趋势:AI Agent 正在从"聊天"走向"干活"

它不是又一个聊天机器人包装器,而是一个真正能让 AI 执行复杂任务的运行环境。通过沙箱隔离、多 Agent 协作、长期记忆等设计,DeerFlow 解决了传统 Agent 框架的几个关键痛点:

  1. 上下文限制:通过子 Agent 分解和上下文摘要
  2. 执行能力:通过沙箱提供真实的执行环境
  3. 记忆缺失:通过长期记忆系统跨会话学习
  4. 扩展困难:通过技能和 MCP 服务器轻松扩展

如果你正在构建 AI 应用,或者想让 AI 帮你完成实际工作,DeerFlow 绝对值得关注。


相关资源

  • 项目地址:https://github.com/bytedance/deer-flow
  • 官方网站:https://deerflow.tech
  • 中文文档:https://github.com/bytedance/deer-flow/blob/main/README_zh.md
  • InfoQuest 搜索工具:https://docs.byteplus.com/en/docs/InfoQuest/What_is_Info_Quest

Read more

从人类视频到机器人跳舞:BeyondMimic 全流程解析与 rl_sar 部署实践

从人类视频到机器人跳舞:BeyondMimic 全流程解析与 rl_sar 部署实践

0. 前言 让人形机器人学会跳舞,听起来像是科幻电影中的场景,但在强化学习和运动模仿技术的推动下,这件事正在变得越来越现实。本文将完整介绍一条从"人类 RGB 视频"到"真实机器人跳舞"的技术链路:首先通过视觉算法从视频中提取人体运动轨迹,然后将人体模型重定向到机器人关节空间,接着在仿真环境中进行强化学习训练,最后在 MuJoCo 中验证并部署到真实的 Unitree G1 人形机器人上。 整条流程涉及四个核心开源项目:GVHMR(视频到人体模型)、GMR(人体到机器人重定向)、BeyondMimic(强化学习训练框架)、以及 rl_sar(仿真验证与真机部署框架)。本文不仅会逐一拆解每个环节的原理和操作步骤,还会深入分析 BeyondMimic 的算法设计,并详细记录将训练产物迁移到 rl_sar 项目中进行 sim2sim 和 sim2real 部署时遇到的关键问题与解决方案。 下图展示了

FPGA实现MIPI协议全解析 + MIPI协议完整时序规范

FPGA实现MIPI协议全解析 + MIPI协议完整时序规范

一、MIPI协议核心基础认知 百度网盘链接:https://pan.baidu.com/s/1rDsLAXGj8WbX82teSkhuIw?pwd=1234 提取码: 1234 包含FPGA系统学习资料,免费分享 1. MIPI协议定义与核心特点 MIPI(Mobile Industry Processor Interface,移动产业处理器接口)是由MIPI联盟制定的高速串行差分接口协议,最初为手机、平板等移动设备设计,目前广泛应用于FPGA/嵌入式的图像采集(摄像头)、显示驱动(液晶屏)、高速数据传输 场景。 核心特点: ✅ 采用差分信号传输,抗干扰能力强、EMI电磁辐射小; ✅ 支持高低速双模切换,兼顾高速大数据传输和低速控制指令传输; ✅ 串行传输,引脚数量极少(对比并行RGB的几十根引脚,MIPI仅需时钟+1~4路数据差分对),硬件设计简洁; ✅ 传输速率高:单lane(数据通道)速率可达1Gbps~

FPGA开发常用软件盘点:Vivado、Quartus、ModelSim全面对比

FPGA开发常用软件盘点:Vivado、Quartus、ModelSim全面对比

在FPGA开发过程中,EDA工具(Electronic Design Automation) 是工程师的生产力核心。不同厂商的FPGA芯片通常配套不同的开发工具,但在项目实践中,很多工程师往往会接触多种EDA软件。 本文将带你系统梳理三款FPGA开发中最常用的软件:Vivado、Quartus、ModelSim,从功能、适用场景、优缺点等多个维度进行全面对比,助你快速入门并合理选择。 一、Vivado —— Xilinx官方旗舰开发平台 1. 基本简介 Vivado是Xilinx(现为AMD)推出的综合性FPGA开发环境,主要面向7系列、UltraScale、Versal等高端FPGA器件。 它集成了综合、布局布线、时序分析、仿真、硬件调试等完整流程,是Xilinx FPGA开发的首选工具。 2. 核心功能 * RTL综合与实现:支持Verilog、VHDL和SystemVerilog,自动进行逻辑优化与布局布线。 * IP Integrator:可视化模块连接工具,适合SoC级设计。 * 仿真与调试:内置Vivado Simulator,也可外接ModelSim进行

Windows 10/11 部署 OpenClaw 完全指南:从环境搭建到机器人互联

摘要:本文详细介绍了在 Windows x64 架构下部署开源机器人控制框架 OpenClaw 的完整流程。针对 Windows 平台特有的 C++ 编译环境难题(sharp 库依赖),提供了“一键脚本”与“手动安装”双重解决方案,并深入解析了云端大模型配置与局域网稳定连接的核心技巧,助您快速打造高性能的机器人控制中枢。 📋 前言:为什么选择 Windows 部署? OpenClaw 是一个强大的开源机器人控制框架,支持语音交互、视觉感知与大模型决策。虽然 macOS 是开发者的首选,但 Windows 10/11 (x64) 凭借广泛的硬件兼容性和强大的 GPU 生态,同样是部署 OpenClaw 的优秀平台。 核心挑战: Windows 环境下最大的痛点在于 C++ 编译环境。OpenClaw 依赖的高性能图像处理库