7月31日,字节跳动Seed团队正式发布新一代视频创作模型Seedance 2.5。这是继Seedance 2.0之后,字节跳动在视频生成领域的又一次重大升级。

单次30秒,补齐AI长叙事短板

Seedance 2.5最核心的突破,是将单次视频生成时长从15秒提升至30秒,并支持多轮延长。这意味着,AI视频不再只是生成一个零散片段,而是可以完成一段有起承转合的完整创作。

官方展示了一个极具说服力的案例:一镜到底的歌手登台演出片段——镜头从红色幕布缝隙推进至暖色后台化妆间,女歌手整理耳机、工作人员提醒登台,她穿过通道与舞伴互动并接过麦克风,最终登上舞台,镜头拉远至体育馆全景。30秒内,模型组织起铺垫、推进、转折、收尾多个逻辑关联的镜头。

多轮延长能力同样惊艳——模型可在已有视频基础上继续生成30秒,并保持人物主体、场景、画面风格乃至声音和音效的一致性。配合优化后的场景过渡逻辑,能够产出长达数分钟、视听风格统一的连贯视频。

多模态参考:30张图+10段视频+10段音频一起“投喂”

Seedance 2.5支持用户单次输入最多30张图片、10段视频、10段音频作为参考素材。模型可综合理解不同素材中的画面构图、场景、风格、人物、道具等元素,并按指令精准用于视频生成。

在多人同框和群像叙事场景中,Seedance 2.5可同时还原多个人物形象与声音,并保持主体特征稳定。官方展示的30秒音乐会片段采用16:9横屏、电影感写实风格,参考素材覆盖了钢琴家、大提琴、小提琴、主唱、管弦乐队、合唱团和观众席。

此外,模型新增了白模参考、绿幕参考能力,让复杂项目与工业化创作更加可控。同时增加了视频局部编辑能力,支持在维持整体画面节奏的前提下,对背景、商品、人物等局部元素进行精准修改。模型还支持精准的时间戳控制,可定向编辑视频内容,并强化了绿幕编辑、视角编辑、参考编辑等多种专业编辑能力。

从“能生成”到“可交付”,产业落地全面铺开

Seedance 2.5的目标是让视频生成从“生成一个片段”转向“完成一段创作”。此次升级将视频生成从“能生成”推向“可修改、可迭代、可交付”的新阶段。

发布当日,徐工集团、小鹏汽车、智元机器人、灵初智能、微分智飞、穹彻智能、Xspark AI等多家企业已确认合作,将率先引入该模型能力。徐工集团将其应用于工业操作培训与工序SOP视频生成;小鹏汽车将Seedance集成至内部AI设计平台,辅助产品设计可视化;穹彻智能借助视频生成扩充具身智能大模型训练数据;微分智飞则在飞行具身领域,用Seedance产出高质量训练数据。香港科技大学副教授王帅评价称,视频生成模型正从“生成内容”走向“理解世界”,从“辅助创意”走向“提升生产力”。

已上线即梦AI与豆包专业版,API即将开放

目前,Seedance 2.5已陆续上线即梦AI、豆包专业版等字节旗下产品。面向企业开发者的API服务也将于近期接入火山方舟。

Seed团队在官方公告中表示:“未来将继续探索更长的连贯叙事、更懂用户的生成与编辑体验,并进一步增强模型对物理世界规律的理解”。当AI视频开始懂得“讲故事”,短视频创作的工具箱恐怕又要重写一回了。