字节跳动发布 Seedance2.5 音视频模型:单次生成30秒,支持多轮延长
字节跳动旗下 Seed 团队近日推出新一代音视频联合生成模型 Seedance2.5,主打"一镜成片"能力,面向影视创作、广告制作等产业场景提供端到端解决方案。
在生成时长方面,Seedance2.5 将单次输出上限从15秒提升至30秒,并支持多轮无缝延长,使复杂叙事的连贯性得到保障。画面质感上,模型针对材质纹理、光影层次及人物肤质进行了专项优化,缓解了此前 AI 生成视频常见的"塑料感"问题。
多模态参考能力是本次升级的另一重点。创作者单次最多可输入30张图片、10段视频及10段音频作为参考素材;新增的白模参考与光照控制机制,则进一步提升了物理光影一致性与运动轨迹的稳定性。
后期可控性方面,用户可基于时间戳对画面视角、运镜节奏、绿幕背景等要素进行定向调整,减少传统流程中的拼接成本。目前,Seedance2.5 已陆续接入即梦 AI、豆包专业版等平台,API 服务将于近期通过火山方舟上线。