Seedance 2.0 完整操作手册：AI 视频创作进入人人都是导演时代

优质文章学习记录

10 Apr 2026 — 10 min read

这两天，字节的AI视频模型Seedance 2.0 彻底出圈了

到处都是 Seedance 2.0 的生成AI作品

有人用它做出了电影级的追逐戏，有人用它复刻了广告大片的运镜，还有人拿它做古装穿越剧和各种武打动作片，画面精致到让人分不清是AI生成的还是真人拍的。

不夸张地说，Seedance 2.0 这波更新，直接把AI视频生成的门槛踩到了地板上。

为什么这么火？因为它解决了一个所有创作者都头疼的问题：以前AI视频只能"生成"，现在终于能"控制"了。

用图片、视频、音频、文字自由组合，人人都能当导演

我们都知道，以前做 AI 视频，你只能打字描述想要什么画面，或者最多放一张图当起始帧。说实话，这种方式表达能力太有限了——你脑子里想的是电影级别的镜头感，打出来的却只是干巴巴的一段话。

现在不一样了。

它不再只是一个"文生视频"工具了，而是变成了一个真正能听懂你想法的多模态视频创作平台。你可以同时丢给它图片、视频、音频、文字，告诉它每个素材分别干嘛用，然后它帮你把这些东西揉在一起，生成一段完整的视频。

听起来有点抽象？没关系，下面我把所有功能和玩法拆开了讲。

先搞清楚：Seedance 2.0 到底能干嘛？

最核心的变化就一个词：多模态。

以前的视频生成工具，输入基本就两种：文字描述，或者一张首帧图。你想控制镜头怎么动、角色做什么表情、背景音乐什么节奏，基本只能靠提示词硬写，写得好不好全凭经验。

Seedance 2.0 直接把输入扩展到了四种模态：

图片：最多上传 9 张，可以指定角色长相、场景风格、服装细节、商品外观，甚至分镜脚本图都行。

视频：最多上传 3 个（总时长不超过 15 秒），可以让模型参考里面的运镜方式、动作节奏、转场特效，相当于给模型一个"样片"。

音频：支持 MP3 上传，最多 3 个（总时长不超过 15 秒），可以指定背景音乐、音效风格、甚至参考某个视频里的旁白音色。

文字：自然语言描述，写清楚你想要什么画面、什么动作、什么节奏就行。

这四种输入可以自由组合，混合上传的文件总上限是 12 个。生成的视频时长最长 15 秒，可以自由选择 4 到 15 秒，而且自带音效和配乐。

简单来说，你终于可以像一个真正的导演一样去"指挥"AI了：用图片定风格，用视频定动作，用音频定节奏，用文字定剧情。

核心参数一览

先看看 Seedance 2.0 能接受什么输入、能输出什么：

参数	说明
图片输入	最多 9 张
视频输入	最多 3 个，总时长不超过 15 秒
音频输入	支持 MP3，最多 3 个，总时长不超过 15 秒
文字输入	自然语言描述（中英文都行）
生成时长	4-15 秒，自由选择
声音输出	自带音效和配乐
文件总上限	所有素材加起来最多 12 个文件

小建议：素材不是越多越好。优先上传对画面或节奏影响最大的素材，合理分配数量。

怎么用？操作方式详解

第一步：选对入口

打开即梦，找到 Seedance 2.0，你会看到两个入口：

首尾帧入口：只上传首帧图 + 文字描述时用这个
全能参考入口：需要多模态组合（图片 + 视频 + 音频 + 文字）时用这个

怎么选？记住一个原则：素材只有一张图加文字，走首尾帧；素材超过一张图，或者有视频、音频参与，走全能参考。

大部分情况下选择全能参考即可，它支持各种参考输入，也就是最新的 seedance 2.0能发挥最大能力的方式。

第二步：上传你的素材

点击上传按钮，从本地选文件。图片、视频、音频都可以直接拖进去。上传成功后，所有素材会出现在输入框区域，鼠标悬停可以预览内容。

小建议：上传前想好哪些素材最关键。总共只能传 12 个文件，优先上传对画面风格和节奏影响最大的素材。

第三步：用"@"给每个素材分配任务（最关键）

这一步是 Seedance 2.0 最核心的操作，也是很多新手容易忽略的地方。

上传完素材后，你需要在提示词里通过 @素材名来告诉模型，每个素材具体干什么用。模型不会自己猜，你不说清楚，它就可能乱用。

比如：

@图片1 作为首帧
@视频1 参考镜头语言
@音频1 用于配乐

怎么唤起@：

方法一：在输入框里直接打一个"@"字符，会自动弹出已上传素材的列表，点击你要引用的素材，它就落入输入框了。

方法二：点击输入框旁边参数工具栏的"@"按钮，同样会弹出素材列表。

@的正确写法示例：

指定首帧和参考：@图片1 作为首帧，参考 @视频1 的镜头语言，@音频1 用于配乐

指定角色形象：@图片1 的女生作为主角，@图片2 的男生作为配角

指定运镜参考：完全参考 @视频1 的所有运镜效果和转场

指定场景参考：左边场景参考 @图片3，右边场景参考 @图片4

指定动作参考：@图片1 的人物参考 @视频1 中的舞蹈动作

指定音色参考：旁白的音色参考 @视频1

踩坑提醒：素材多的时候，一定反复检查每个@引用有没有对上号。把图片当成视频引用，或者把角色A的图标成角色B，模型生成出来就会很混乱。

鼠标放在你@的素材上，悬停可以预览素材，避免插入错误

第四步：写好你的提示词

@分配完任务后，剩下的就是用自然语言描述你想要的画面和动作。

写提示词的四个技巧：

技巧一：按时间线分段写。如果视频里有多个画面或剧情转折，建议按秒数分段描述。

比如：

0-3秒画面：男主手里举起一个篮球，抬头望向镜头，说"我只是想喝杯酒，该不会要穿越了吧……"

4-8秒画面：镜头突然剧烈晃动，场景切换成古宅的雨夜，一个穿着古装的女主冷冽地望向镜头方向。

9-13秒画面：镜头切到一个穿着明代服饰的人物……

这样写模型能更准确地把握每段画面的节奏和内容。

技巧二：明确说"参考"还是"编辑"。这两个概念不一样。"参考 @视频1 的运镜"意思是借鉴它的镜头运动方式来生成新内容；"将 @视频1 中的女生换成戏曲花旦"意思是在原视频基础上做修改。写清楚，模型才能正确响应。

技巧三：镜头语言写具体。不用怕写多，模型现在的理解能力很强。推、拉、摇、移、跟拍、环绕、俯拍、仰拍、一镜到底、希区柯克变焦、鱼眼镜头……这些专业术语它都认识。不懂术语也没关系，用大白话描述也行，比如"镜头从背后慢慢转到正面"。

技巧四：连续动作加过渡描述。如果你想让角色做一系列连贯动作，记得写上过渡关系，比如"角色从跳跃直接过渡到翻滚，保持动作连贯流畅"，避免画面出现不自然的跳切。

第五步：选择生成时长，点击生成

在 4 到 15 秒之间选一个你需要的时长。

注意：如果你是在做视频延长（比如把一段已有视频往后接 5 秒），那这里选的时长是"新增部分"的时长，不是总时长。想延长 5 秒就选 5 秒。

然后点生成，等结果就好。不满意可以多生成几次，AI本身有随机性，同样的输入每次结果都会有差异，挑最满意的那条。

写在最后

Seedance 2.0 刷屏不是没有道理的。它不只是画质变好了、动作更流畅了，更关键的是它改变了AI视频创作的交互方式。

通过多模态输入和@引用机制，创作者第一次能够精准地告诉AI"我要什么"，而不是写完提示词然后听天由命。

当然它还在持续进化中，有些极端复杂的场景可能还不够完美。但从目前的能力来看，它已经是一个真正能用在实际创作中的生产力工具了。

建议大家先收藏这篇指南，然后打开即梦动手试试。看别人的作品刷屏不过瘾，自己上手才是真的爽！

立即体验 Seedance 2.0 ！

以上基于 Seedance 2.0 官方使用手册整理

开源的AI编码代理OpenCode

和之前在Instantbox中安装OpenCode 在别的容器中安装 OpenCode 不同，本次使用的是官方原生的 Docker 镜像简介什么是 OpenCode？ OpenCode 是一个开源的 AI 编码代理（AI Coding Agent），通过大语言模型（LLM）自动化编程任务，从任务理解、代码生成到执行测试和自我修正，形成闭环。它支持终端、桌面应用和 IDE 集成，让开发者用自然语言描述需求，代理就能独立完成编码工作。主要特点 * 完全开源：采用 MIT 许可证，您可以自由使用、修改和分发。 * 模型无锁定：您可以灵活配置并使用任何您喜欢的 AI 模型，无论是云端 API 还是本地模型。 * 多种代理模式： * build 代理：拥有完全的系统访问权限，专为编码、调试和测试等开发工作设计。

OpenClaw 接入飞书完整教程10分钟搭建专属 AI 助手

🦞 OpenClaw × 飞书 · 2026 最新教程零代码配置 · WebSocket 长连接 · 流式卡片输出 · 支持文档/多维表格自动化完整踩坑记录，小白也能跑通 📅 2026-03-15⏱ 阅读约 12 分钟 📑 文章目录 1. 为什么选 OpenClaw 接入飞书？ 2. 前置准备清单 3. 第一步：创建飞书自建应用 4. 第二步：配置权限 & 事件订阅 5. 第三步：安装 OpenClaw & 添加飞书渠道 6. 第四步：启动网关 & 验证连接 7. 核心配置参数详解 8. 进阶玩法：文档 / 多维表格 / 定时任务 9.

非技术岗转向AI岗位的现实评估与规划

当下AI浪潮席卷各行各业，2025年AI岗位需求月均增长15%，长三角缺口超30万，72%的企业明确接受跨专业背景，非技术岗转型AI已成为职场人突破瓶颈的重要方向。但转型并非“跟风上车”，需先清晰认知自身适配性、行业现实门槛，再制定可落地的规划，才能避免盲目投入、高效突破。本文将从现实评估、分阶段规划、避坑指南三方面，为非技术岗转AI提供实操性参考，助力转行者找准方向、少走弯路。一、非技术岗转向AI岗位的现实评估（客观认知，理性入局）（一）转型机遇：非技术岗的独特优势的非技术岗并非转型AI的“劣势群体”，反而其积累的业务经验的能成为转型核心竞争力，这也是很多跨专业转行者弯道超车的关键。具体优势体现在三点： 1. 业务场景洞察力更强：无论是运营、市场、行政还是金融、医疗等领域的非技术岗，长期深耕业务一线，能精准捕捉AI落地的真实需求——比如银行风控经理懂反欺诈场景痛点，骨科医生清楚手术机器人的临床适配需求，这种对场景的理解，是纯技术人员难以快速替代的。 2. 跨部门沟通效率更高：AI岗位的核心价值是“技术落地”，而非单纯的技术研发，非技术岗长期积累的沟通协调、需

脉向AI｜当豆包手机遭遇“全网封杀“：GUI Agent是通向AGI的必经之路吗？

💡 这是「脉向AI」的深度对话 ✨ 只做一件事：邀请真正在AI一线的实践者，拆解影响千万职场人未来的真实变革这是「脉向AI」的第一期。这个栏目是脉脉与「人民公园说AI」联手打造的思想实验室。我们坚持做一件看似简单却极有价值的事：邀请真正站在AI浪潮前沿的实践者，拆解那些影响千万职场人未来的真实变革。不贩卖焦虑，不堆砌术语，而是让大家看到： * 🌐 这些技术变革背后的商业逻辑是什么？ * 💼 它将如何重塑我们的工作方式？ * 🧭 普通职场人该如何在这个浪潮中找准自己的定位？本期，我们聚焦一个近期刷屏科技圈却又被大众忽视的话题：为什么从华为到小米，从OPPO到vivo，几乎所有国产手机厂商都在系统层面屏蔽了字节跳动的豆包AI手机功能？ 💬 "表面上是商业竞争，实质是各方对'AI时代用户入口'控制权的争夺。这将直接影响未来3-5年每个人的工作方式与职业选择。" —— 张和，本期嘉宾 👤 一、嘉宾张和：站在操作系统与AI融合前沿的战略操盘手 🎓 专业背景 ✅ 前头部手机厂商OS战略规划负责人 ✅ 12年操作系统与AI融合实战经验 ✅ 主导3代AI原生