豆包AI助手
当前位置:首页>AI模型>Seedance 2.5:字节跳动推出的新一代 AI 视频生成模型

Seedance 2.5:字节跳动推出的新一代 AI 视频生成模型

Seedance 2.5是什么

Seedance 2.5 是字节跳动 Seed 团队推出的新一代多模态音视频生成模型,延续 Seedance 2.0 的统一音视频联合生成架构,重点提升长叙事、多模态素材参考和视频编辑能力。模型可单次生成最长30秒的视频,并通过连续延长制作数分钟内容,面向影视短片、广告营销、教育内容和工业仿真等专业场景。

Seedance 2.5 的模型特性

  • 30秒长叙事生成:单次视频生成时长由15秒提升至30秒,可在一段视频中组织多个具有逻辑关联的镜头,完成铺垫、推进、转折和收尾,而不只是延续单一画面。
  • 支持视频连续延长:用户可以在已有视频基础上生成后续内容,并尽量保持人物主体、场景环境、画面风格、声音和叙事节奏的一致。项目主页目前明确标注支持两次视频延长。
  • 大规模多模态参考:单次最多可输入30张图片、10段视频和10段音频,模型能够综合参考人物、场景、商品、动作、运镜、构图、音色和音乐等信息,完成多主体、多场景和多镜头视频创作。
  • 白模与运动参考:支持使用无纹理3D白模控制空间结构、人物姿态、运动轨迹、景别和镜头机位,再结合角色、材质、风格和光照参考生成完整画面,适合需要精确构图与镜头调度的专业创作。
  • 时间戳精准控制:创作者可以在提示词中指定不同时间段的剧情、动作、视角、声音和运镜,也可以在生成后对指定片段中的角色、动作、声音或故事内容进行定向修改。
  • 专业视频编辑能力:强化绿幕替换、视角调整、运镜编辑和参考编辑,可在尽量保持主体与动作不变的情况下修改背景、服装、配角、镜头运动和剧情内容。
  • 画面与音频质量优化:针对AI视频中常见的过度磨皮、饱和度过高和画面“油腻感”进行了优化,同时减少字幕、背景音乐等元素不受控制的情况,提升材质、肤质、眼神、光影、运动和音画同步表现。

Seedance 2.5的应用场景

  • 影视与广告创作: 用 30 秒长叙事加多轮延长完成分镜连贯的短片、广告片,配合绿幕编辑与参考编辑满足专业制作流程中的反复打磨需求。
  • 短剧与音乐内容: 一镜到底跟拍、多主体同框演出等复杂调度可由单条 prompt 加参考素材完成,适合演唱会、舞台表演类内容的快速试制。
  • 教育课件制作: 把课文背后的历史背景、人物与情节转化为动态画面,或将科学原理、实验过程等抽象内容做成演示视频。豆包爱学 App 的「豆包课堂」已在使用。
  • 具身智能与机器人训练: 生成高质量合成视频数据,用于训练机器人的感知与操作能力。
  • 工业制造仿真: 用于工业仿真、流程培训与设备演示,可参考白模的装配顺序与运动轨迹渲染出高真实度的产品演示片段。
  • 自动驾驶测试: 模拟极端天气、复杂路况等真实采集中低频出现的场景,为系统测试与训练补充样本。

如何使用Seedance 2.5

  1. 在即梦 AI 中体验: 进入即梦网页端的视频生成模块,在模型选择处切换到 Seedance 2.5。
  2. 在豆包专业版中体验: 进入豆包视频生成功能,模型选择 Seedance 2.5。
  3. 准备参考素材: 按需上传图片、视频、音频,并在 prompt 中用「@图片 1」「@视频 1」「@白模 1」等方式指明每份素材约束的是场景、主体、运镜还是风格。
  4. 分段撰写 prompt: 用「0-5 秒」「6-10 秒」这类时间戳分段描述镜头与剧情,生成后再对不满意的片段做定向编辑。
  5. API 接入: https://ark.volcengine.com/region:cn-beijing/model/detail?name=doubao-seedance-2-5/

常见问题

Q:Seedance 2.5 和 Seedance 2.0 有什么区别?

A:两者共用同一套多模态音视频联合生成架构。2.5 的主要变化在三处:单次生成时长从 15 秒提升到 30 秒并支持多轮延长;参考素材上限提高到 30 张图片、10 段视频、10 段音频,并新增白模、运动、创意等参考类型;新增时间戳定向编辑,以及绿幕、视角与运镜编辑能力。

Q:Seedance 2.5 的 API 现在能用吗?

A:官方说明 API 服务将在近期上线火山方舟,截至收录时尚未正式开放。现阶段可通过即梦 AI 网页端与豆包专业版直接使用。

Q:单次真的只能生成 30 秒吗?

A:单次生成上限为 30 秒,但模型支持在已有结果上多轮延长,延长时会保持主体、场景与叙事节奏的一致性,因此实际可产出数分钟的连贯内容。

Q:Seedance 2.5 开源吗?

A:不开源。它是字节跳动的闭源商用模型,通过火山引擎的平台与产品提供服务。

Q:视频里的声音也是模型生成的吗?

A:是。Seedance 2.5 采用音视频联合生成架构,画面与音效、对白同步产出,并可接收音频作为参考素材来约束声音表现。

©版权声明:如无特殊说明,本站所有内容均为AIHub.cn原创发布和所有。任何个人或组织,在未征得本站同意时,禁止复制、盗用、采集、发布本站内容到任何网站、书籍等各类媒体平台。否则,我站将依法保留追究相关法律责任的权利。