7 月 31 日,字节跳动正式发布新一代视频生成模型 Seedance 2.5。该模型在生成时长、多模态理解、编辑精度等核心维度实现全面升级,目前已上线豆包、即梦、扣子、小云雀等字节旗下产品,并将于近期通过火山引擎面向企业用户开放。

Seedance 2.5

此次发布标志着视频生成技术正从辅助创意向提升生产力跨越,加速向实体产业深度融合。

四大核心能力跃迁

相较于年初发布的 Seedance 2.0,Seedance 2.5 在四大核心能力上实现了关键突破,精准击中了过往视频生成难以适配产业级需求的痛点:

单次生成 30 秒,高保真时序延长:

模型单次生成视频时长上限提升至30秒,并具备高保真时序延长能力。在更长时长内,模型能保持人物、场景与镜头的高度一致性,无需后期拼接即可完整呈现剧情推进与情绪起伏,完美适配广告TVC、品牌故事片等对叙事完整性要求极高的场景。

全模态参考扩容至50个素材:

单次支持最多30张图片、10段视频和10段音频组合上传。此外,新增对复杂3D白模、绿幕及品牌VI资产的参考能力,让企业前期投入的专业设计资产能够被原样稳定输出,大幅降低定制化内容的生产成本。

即梦 AI Seedance 2.5

专业级局部编辑,实现“一次创作、多版交付”:新增精准的视频局部编辑能力,在维持整体画面、镜头与节奏不变的前提下,可对背景、商品、人物等局部元素进行定向修改。结合精准的时间戳控制,彻底解决了过往生成视频不可迭代、返工成本高的行业难题。

原生支持10余种语言与复杂指令控制:

全面适配多语言、多版本的工业化生产需求,能够精准响应多层次的镜头调度与场景描述,服务面向全球的创作与商业化场景。

从内容创作到实体产业,多赛道落地提速

Seedance 2.5 的发布,将视频生成的应用边界从内容创作领域延伸至智能驾驶、具身智能、实体制造等实体经济赛道。发布当日,徐工集团、小鹏汽车、灵初智能、微分智飞、穹彻智能等多家企业已确认合作,率先引入该模型能力展开场景落地探索:

具身智能与机器人训练:在具身智能领域,模型可生成符合物理规律、场景复杂的交互数据。例如,穹彻智能和微分智飞借助Seedance自动生成多样化的机器人交互场景,无需依赖实体机器人逐一采集,即可产出高质量训练数据,大幅提升机器人的跨环境泛化能力。

自动驾驶仿真:在智驾领域,Seedance 2.5可快速合成暴雨、大雾、罕见路况、突发事故等真实采集难以覆盖的边缘场景素材,有效补齐智驾系统的训练盲区,提升复杂工况下的行驶稳定性。

工业制造与出海营销:徐工集团将模型应用于工业操作培训与工序SOP视频生成,淘汰了传统高成本的实拍与3D动画模式;小鹏汽车则将其集成至内部AI设计平台,辅助产品设计并批量输出多语言版本的用户说明书视频,加快全球化落地速度。

业内专家指出,新一代视频生成模型正在经历关键转变。香港科技大学计算机科学与工程系副教授王帅表示,随着模型对物理规律理解能力的增强,视频生成正从生成内容走向理解世界,有望成为具身智能、机器人仿真、自动驾驶等领域的重要基础能力。中国科学院软件研究所研究员张立波也认为,未来随着感知维度的拓展与多模态技术的迭代,视频生成模型的深层次理解能力还将持续跃迁。

Seedance 2.5 带来的视频生成能力,正在打破实体产业传统内容生产的高门槛、高成本瓶颈,成为推动各行业数字化效率升级的重要新基建。

Logo

DAMO开发者矩阵,由阿里巴巴达摩院和中国互联网协会联合发起,致力于探讨最前沿的技术趋势与应用成果,搭建高质量的交流与分享平台,推动技术创新与产业应用链接,围绕“人工智能与新型计算”构建开放共享的开发者生态。

更多推荐