同一天,字节Seed团队把视频模型的竞争点从「更清晰」拔到了「更像一段完整创作」。
字节跳动Seed是公司面向前沿模型研究与产品化的团队,Seedance系列定位视频创作模型,已通过即梦AI、豆包等入口触达大量创作者与企业用户。所谓长叙事,不是把同一个镜头无脑拖长,而是让模型在几十秒里组织铺垫、推进、转折与收尾,并在多轮延长时保住主体、场景与视听风格。对广告、短剧、教学演示来说,这比「多清晰一点」更能省掉拼接与返工。
7月31日,字节跳动Seed团队正式发布新一代视频创作模型Seedance 2.5。官方称,Seedance 2.0之后,用户期待正从「生成一个片段」走向「完成一段创作」;2.5延续统一的多模态音视频联合生成架构,重点突破长叙事、多模态参考与编辑能力。产品已陆续上线即梦AI、豆包专业版等平台,API服务计划近期上线火山方舟。
三大能力升级:
白模参考值得单独说一句。创作者可以用无纹理的三维模型先搭好空间结构、主体姿态、运动轨迹和机位,再让模型按这套「骨架」生成成片——就像先排一场戏的走位,再往上贴材质与光影。对复杂调度与工业演示,这种「先结构、后外观」的路径,往往比纯文生视频更可控。
如果说MiniMax H3更强调全模态统一理解、开源与性价比,Seedance 2.5更强调长叙事交付与工业化参考编辑。两者同日放量,说明视频生成的主战场已经不只是秒级样片比美,而是谁能进入广告投放、教育内容、工业仿真与具身/自动驾驶数据合成等生产线。字节选择先把能力铺进即梦与豆包的消费与创作入口,再通过火山方舟承接企业API,是典型的「先占使用习惯、再收平台调用」节奏。
对创作者,30秒直出降低了「先拆镜再拼接」的成本;对企业,参考上限与编辑精度决定它能不能进真实项目,而不是只停在演示视频。下一观察点是火山方舟API落地节奏,以及30秒直出与多轮延长在真实项目里能否稳住主体一致性和物理合理性——尤其是极多主体交互、复杂运动是否仍然容易穿帮。