豆包 Seedance 2.5 AI 视频生成器 - 30 秒一镜成片,50 个素材随心参考
豆包 Seedance 2.5 是字节跳动 Seed 团队于 2026 年 7 月 31 日正式发布的新一代视频创作模型,已陆续上线即梦 AI、豆包专业版等平台。它延续 Seedance 2.0 统一的多模态音视频联合生成架构,重点突破三大能力:单次生成 30 秒并支持多轮延长的长叙事能力、最多 30 张图片 + 10 段视频 + 10 段音频的多模态参考能力,以及支持时间戳精准控制的编辑能力。Seedance 2.5 让 AI 视频从「生成一个片段」走向「完成一段创作」。
适用场景:影视短剧 | 广告与产品营销 | 音乐与舞台演出 | 教育科普 | 工业仿真
Seedance 2.5 核心特性
下面这部创意短片全片由 Seedance 2.5 独立生成:
🎬 30 秒长叙事,一镜成片
Seedance 2.5 将单次视频生成时长从 15 秒提升至 30 秒,并进一步提升长视频中的叙事能力:
- 完整故事结构:30 秒内组织多个有逻辑关联的镜头,故事从铺垫、推进、转折到收尾逐步展开,而不是简单延续一个画面
- 自然运镜衔接:主体在多次切镜中保持稳定,音画始终对齐,长视频更连贯
- 更符合物理规律:水袖摆动、人物奔跑等运动轨迹更自然
- 弱化「油腻感」:系统优化物体材质、人物肤质与眼神、光影和画面饱和度,减少字幕与背景音乐不受控的情况,成片更接近实拍质感
文生视频提示词:一镜到底手持稳定器跟拍,镜头从红色厚重幕布缝隙缓缓推进,进入暖色后台化妆间。年轻女歌手背对镜头整理耳机,工作人员提醒她准备登台。她回头看向镜头,开始唱起 City Pop。镜头后退跟拍,歌手穿过幕布进后台通道,与舞伴自然互动,一位工作人员把麦克风递给她。随后歌手与舞伴登上舞台,镜头绕至背面,红黑舞美、LED 屏、追光、烟雾与反光地板逐渐展开。镜头最终拉远至体育馆全景,呈现满场观众、灯牌、荧光棒与欢呼声,营造年轻自由的演唱会高潮氛围。
参考生视频提示词:16:9 宽幅电影级质感,一镜到底,丝滑运镜,无剪辑。场景参考 @图片 4。0-5 秒:@图片 2 霸王近景开场,镜头缓慢环绕上半身并过渡至中景;霸王旋身翻转,随后身体与靠旗从镜头前快速掠过,形成自然遮挡,镜头顺势绕至 @图片 1 虞姬身侧。6-10 秒:镜头稳定环绕 @图片 1 虞姬中景,跟随水袖动作完成环绕运镜,虞姬抬臂、挑腕、展袖、半转身,最后收袖定格,侧身看向霸王。11-20 秒:@图片 3 武生出场完成后空翻腾动作,随后霸王居中,武生在对侧进退攻防,虞姬位于霸王侧后方以水袖配合,形成刚柔对比。镜头从武生中近景缓慢后拉至舞台大景,结尾三人面向观众同步京剧落幕亮相。
🔗 多轮视频延长
在已有的 Seedance 2.5 生成结果上自然衔接后续镜头:
- 主体场景一致:延长过程中保持人物主体、场景环境、画面风格和声音音效一致
- 叙事节奏连贯:新镜头承接上一段内容继续发展,而不是重新开始
- 数分钟长内容:最终生成数分钟具有统一视听语言的连贯内容,减少拆分镜头、反复拼接和处理衔接的成本
参考生视频提示词:延长视频,衔接 @视频 1 画面内容和主体继续生成一个 30 秒的视频,保持人物主体、场景、画面风格、声音音效一致。小男孩抱着足球沿车厢跑,地铁停稳后侧边门打开,他立刻冲出,男主紧追。两人一路穿过站台跑到街上,惊动街边路人,男主最终追上并抓住他,小男孩委屈抬头,男主慢慢消气,摸摸他的头,露出无奈笑容。
📎 50 个多模态参考素材
Seedance 2.5 单次最多支持输入 30 张图片、10 段视频、10 段音频作为参考:
- 综合理解素材:理解不同素材中的画面构图、场景、风格、人物、道具等元素,并按指令用于视频生成
- 多人物稳定还原:在多人同框、群像叙事等复杂场景中,同时还原多个人物的形象与声音
- 运动参考与创意参考:更好理解参考视频的意图与镜头语言,从动态迁移升级为创意演绎
参考生视频提示词:30 秒音乐会片段,16:9 横屏,电影感写实,真实音乐厅光影,暖金色舞台灯,正式古典音乐会氛围。场景 @图一,钢琴家参考 @图二,大提琴参考 @图三,小提琴参考 @图四,主唱参考 @图五,管弦等其他乐队参考 @图六到图十,合唱团参考图十一到图十四,观众席参考 @图十五到图十八。开场高位俯拍音乐厅全景,钢琴家落键,主唱进入追光演唱,镜头自然带过小提琴、大提琴与管弦乐队,小提琴明亮,大提琴温暖。后段合唱团加入,主唱与第一排观众短暂眼神交流,观众微笑点头。结尾镜头后移,演唱结束,观众跟随鼓掌。
🧊 白模参考与光照控制
用无纹理的 3D 白模搭好镜头,再交给 Seedance 2.5 渲染成片:
- 空间调度:用白模定义画面空间结构、主体姿态、运动轨迹和镜头机位
- 构图可预期:复杂镜头的构图和调度更接近创作预期
- 真实光照:基于白模的空间信息,生成符合物理规律的光源方向、色温、强度和阴影投射
参考生视频提示词:参考 @白模 1 的运镜、镜头节奏、景别变化、主体轨迹和镜头调度。参考 @图片 2 的角色外形、场景、材质、光照、色彩和童话氛围,将白模渲染为梦幻温暖、儿童幻想感、3D 动画短片。剧情依次为:幻想天空飞行 → 云海神兽伴飞 → 俯冲入海 → 鳐鱼海底穿梭 → 镜面时空裂缝 → 宇宙摘星 → 幻化回房间 → 爸爸盖被 → 合上绘本定格。
参考生视频提示词:参考 @白模 1 的运镜、构图、景别、空间关系、零件位置、模型结构、装配顺序和运动轨迹。参考 @图片 1 的材质、光照、色彩、反射和氛围,将白模渲染为高端真实汽车拼装片段。
✂️ 时间戳精准编辑
无需从头生成,即可打磨细节:
- 时间戳控制:在提示词中指定每个时间段发生的故事、画面视角、运镜和整体节奏
- 定向修改:针对指定片段里的角色、动作、声音或剧情进行修改,保持修改前后的连贯性和真实感
- 绿幕编辑:保持主体不变,替换不同场景、讲述不同故事,并根据新场景渲染衣服飘动、头发状态、步态节奏和光影
- 运镜编辑:保持人物、动作及画风不变,只重新设计镜头运动
参考生视频提示词:把 @视频 1 绿幕背景渲染场景、障碍、服装和配角:0-4 秒:户外训练,障碍换石头、砖块、轮胎、木箱;4-10 秒:休息室,朋友鼓励;10-15 秒:国际赛场,训练杆换原创防守球员和门将,主角进球。整体写实电影级。
参考生视频提示词:编辑 @视频 1,保持人物、动作及画风不变,仅调整运镜。15 秒分段运镜设计:0–4 秒,微型 FPV 贴锅穿行,跟随弹起的吐司后横甩至咖啡;4–7 秒,推近并沿锅边横移,跟随煎蛋翻起落回;7–11 秒,急速升至顶视角,匀速下压扫过餐盘和钥匙;11–15 秒,手持近镜跟随双手快速横甩,最后推近早餐,再拉回双人中景。全程连贯稳定。
Seedance 2.5 技术参数
| 项目 | Seedance 2.5 |
|---|---|
| 开发方 | 字节跳动 Seed |
| 发布时间 | 2026 年 7 月 31 日 |
| 架构 | 统一的多模态音视频联合生成架构 |
| 视频时长 | 单次 4–30 秒,支持多轮延长 |
| 分辨率 | 480P / 720P / 1080P |
| 图片参考 | 最多 30 张 |
| 视频参考 | 最多 10 段 |
| 音频参考 | 最多 10 段 |
| 输出 | 音画同步的视频 |
| 进阶控制 | 白模参考、时间戳编辑、绿幕编辑、运镜编辑 |
Seedance 2.5 与 Seedance 2.0 对比
| 对比项 | Seedance 2.5 | Seedance 2.0 |
|---|---|---|
| 单次最长时长 | 30 秒 | 15 秒 |
| 分辨率 | 最高 1080P | 最高 720P |
| 视频延长 | 多轮延长,人物与节奏保持连贯 | 向后延长、前传生成、轨道补全 |
| 参考素材 | 30 张图片 + 10 段视频 + 10 段音频 | 图片、视频、音频参考 |
| 白模参考 | 支持,并可控制光照 | — |
| 编辑能力 | 时间戳精准编辑、绿幕、运镜、参考编辑 | 主体替换、对象增删改、局部重绘 |
| 画面质感 | 优化材质、肤质与光影,弱化「油腻感」 | 指令精准、材质真实 |
| 更适合 | 长叙事短剧、音乐 MV、群像场景、专业制作 | 短广告、产品展示、单镜头精准控制 |
适用场景与使用案例
🎬 影视短剧与音乐 MV
- 一镜到底长镜头:一次生成 30 秒带完整故事的连续镜头,适合短剧、预告片
- 舞台与音乐演出:歌手、舞伴、乐队、合唱团同框,人物形象和声音稳定还原
- 长篇连续叙事:多次延长串联成数分钟的完整故事
📱 广告与产品营销
- 替换产品与元素:替换产品、风格、面孔、光线或背景,同时保留原有运动和构图
- 品牌一致性:用数十张参考图锁定产品细节、角色设定和品牌资产
- 绿幕批量出片:一次绿幕拍摄,渲染出多个场景和故事版本,快速产出投放素材
🎓 教育与科普
Seedance 2.5 可以把课文背后的历史背景、人物和情节转化为视频,把科学原理、历史事件、实验过程变成动态演示,降低老师制作教学视频的门槛。
参考生视频提示词:东方写意风格。南宋临安街景,热闹的街上几个孩子边跑边闹,孩子们嘴里张嘴念着「蓦然回首,那人却在,灯火阑珊处」。镜头始终跟随孩子们奔跑,带过热闹的街景。镜头上摇,此人正是 @图片 1 辛弃疾。辛弃疾回头,远处是在灯火阑珊中的男子,镜头连贯。
🏭 工业与专业制作
- 工业仿真演示:把白模渲染成真实质感的装配流程、流程培训和设备演示视频
- 合成训练数据:生成高质量合成视频数据,帮助训练机器人的感知和操作能力
- 自动驾驶测试:模拟极端天气、复杂路况等低频场景,为系统测试和训练提供更多样本
如何使用 Seedance 2.5 创建视频
1. 访问平台
前往 AIGCVA 应用中心,选择 Seedance 2.5。
2. 准备输入素材
- 文本提示词:描述故事、镜头、运镜和声音,需要精准控制节奏时按时间戳分段书写
- 参考图片:人物、场景、产品、风格(最多 30 张)
- 参考视频:动作、运镜、白模或待编辑的原视频(最多 10 段)
- 参考音频:人声、音乐或音效(最多 10 段)
3. 选择视频设置
- 时长:单次 4–30 秒
- 分辨率:480P、720P 或 1080P
- 模式:文生视频或参考生视频
4. 生成、延长与编辑
- 点击生成,得到第一段 30 秒视频
- 对结果进行延长,保持人物和场景一致继续讲故事
- 对指定时间段、运镜或绿幕背景进行定向编辑,无需从头生成
Seedance 2.5 最佳实践
- 按时间戳写提示词:把提示词拆成「0-5 秒」「6-10 秒」「11-20 秒」等分段,精确控制每一段发生什么
- 给每个参考素材编号:明确写出 @图片 1、@视频 1、@白模 1,并说明每个素材控制哪个元素
- 规划完整故事:用满 30 秒安排铺垫、推进和收尾,而不是只描述一个动作
- 复杂镜头用白模:运镜路径复杂或多主体调度时,白模参考的结果最可控
- 局部问题用编辑:某一段不满意时,用时间戳编辑只修改那一段
Seedance 2.5 提示词示例
30 秒产品广告
30 秒一镜到底广告片,16:9,电影感写实,清晨柔光。
0-8 秒:镜头穿过厨房窗户推进,年轻女生在磨咖啡豆,背景是磨豆声和鸟鸣。
9-18 秒:镜头跟随她走到阳台,把 @图片 1 的咖啡倒进玻璃杯,热气升起,包装上的品牌 Logo 清晰可见。
19-30 秒:她抿了一口微笑,镜头后拉露出日出时的城市天际线,温柔女声说:「慢慢开始新的一天。」多参考人物场景
咖啡馆场景参考 @图片 1,咖啡师是 @图片 2,顾客是 @图片 3,吧台上的猫是 @图片 4,背景音乐使用 @音频 1。
顾客推门进来和咖啡师打招呼,猫伸了个懒腰跳下吧台,咖啡师递上一杯心形拉花拿铁。三个角色形象保持一致。视频延长
延长 @视频 1,继续生成 30 秒,保持人物、场景、画风和声音一致。
雨停了,女孩收起雨伞走出小巷,走进热闹的夜市;镜头从背后跟拍,再绕到正面中景,她停在一个灯笼摊前。时间戳编辑
编辑 @视频 1,保持人物、运镜和画风不变。
仅修改 6-10 秒:把红色跑车换成白色复古敞篷车,背景声音从街道车流声换成海浪声。Seedance 2.5 常见问题
Seedance 2.5 是什么?
Seedance 2.5 是字节跳动 Seed 团队于 2026 年 7 月 31 日正式发布的新一代视频创作模型。它延续了 Seedance 2.0 统一的多模态音视频联合生成架构,重点突破长叙事能力、多模态参考能力和编辑能力,让视频生成从「生成一个片段」走向「完成一段创作」。
Seedance 2.5 一次能生成多长的视频?
Seedance 2.5 单次最长可生成 30 秒高质量音视频,是 Seedance 2.0(15 秒)的两倍,时长可在 4–30 秒之间选择。同时支持多轮延长,延长过程中保持人物、场景和叙事节奏连贯,可以制作数分钟具有统一视听语言的内容。
Seedance 2.5 最多支持多少参考素材?
Seedance 2.5 单次最多可输入 30 张图片、10 段视频和 10 段音频,共 50 个多模态参考素材。模型能综合理解各素材中的构图、场景、风格、人物和道具,在多人同框、群像叙事中也能同时还原多个人物的形象与声音。
Seedance 2.5 的白模参考是什么?
白模参考是指用无纹理 3D 模型搭出画面的空间结构、主体姿态、运动轨迹和镜头机位,再让 Seedance 2.5 参考这套结构生成视频。模型还会利用白模的空间信息生成符合物理规律的光照,包括光源方向、色温、强度和阴影投射。
Seedance 2.5 有哪些编辑能力?
Seedance 2.5 支持时间戳精准控制,可针对指定片段里的角色、动作、声音或剧情进行定向修改,并保持修改前后连贯。同时强化了绿幕编辑、视角与运镜编辑、参考编辑等能力,满足影视、广告等专业创作需求。
Seedance 2.5 和 Seedance 2.0 有什么区别?
Seedance 2.5 将单次生成时长从 15 秒提升到 30 秒,新增多轮延长;参考素材扩容到 30 张图片、10 段视频、10 段音频;新增白模参考与光照控制、时间戳精准编辑,绿幕编辑能力更强;还系统优化了材质、肤质、光影和饱和度,有效弱化 AI 视频常见的「油腻感」。
Seedance 2.5 免费吗?
Seedance 2.5 在 AIGCVA 平台提供免费使用额度,注册用户可获得免费生成次数,高频用户可充值 VA 币获取更多额度。
生成的视频可以商用吗?
可以,通过 AIGCVA 平台生成的视频支持商业使用,具体商用条款请参阅平台服务协议。
Seedance 2.5 技术优势总结
- 30 秒一镜成片:单次生成包含多个关联镜头的完整故事
- 多轮延长:人物、场景、节奏保持连贯,轻松制作数分钟长内容
- 50 个多模态参考:单次最多 30 张图片、10 段视频、10 段音频
- 白模参考控制:用 3D 白模规划调度与运镜,光照符合物理规律
- 时间戳精准编辑:定向修改指定片段,无需从头生成
- 专业编辑能力:绿幕编辑、视角运镜编辑、参考编辑一应俱全
- 更接近实拍质感:优化材质、肤质与光影,弱化「油腻感」
开始使用 Seedance 2.5
用字节跳动最新视频模型,一镜讲完一个完整故事: