产品、模型发布、视频生成 量子位

即梦上线Seedance 2.5视频生成模型,30秒原生直出成行业独家

即梦平台正式上线Seedance 2.5视频生成模型,支持30秒视频原生直出,无需分段拼接即可保持人物、场景与镜头一致性。该模型还提供高保真时序延长和多模态参考能力,为创作者提供更高效的工业化视频生产工具,标志着视频生成技术从短片段向长时长、高可控方向迈出关键一步。

视频生成赛道正在经历一场从“秒级片段”到“分钟级叙事”的范式转移。今日,字节跳动旗下的一站式AI创作平台即梦(Jimeng)正式上线了新一代视频生成模型Seedance 2.5,其最核心的突破在于支持30秒视频的原生直出,且无需任何分段拼接或后期合成。这一能力在当前国内乃至全球的视频生成模型中尚属独家,标志着AI视频创作正式迈入“长时长、高可控”的工业化生产新阶段。

在Seedance 2.5出现之前,主流视频生成模型(如Sora、Runway、可灵等)普遍将单次生成时长限制在5至15秒之间。创作者若想获得一个完整的30秒镜头,往往需要生成多个片段,再借助剪辑软件进行拼接,并反复调整提示词以维持人物外貌、场景光线和镜头运动的连贯性。这一过程不仅耗时费力,且极易出现角色“变脸”、场景跳变等一致性崩坏问题。Seedance 2.5通过原生架构设计,在模型内部实现了长达30秒的时空连贯性建模,能够在一次推理中直接输出完整的长镜头视频,从根源上消除了拼接痕迹。据即梦官方技术说明,该模型在生成过程中会对全局人物身份、场景布局、物体物理属性进行统一编码,确保在30秒的时间轴上,主角的服装细节、面部特征以及环境光影始终保持高度一致,甚至能处理复杂的连续动作,如人物从室内走到室外、转身对话、物体持续运动等。

除了30秒原生直出这一杀手锏,Seedance 2.5还提供了两项面向专业创作场景的增强能力。其一是高保真时序延长,即用户可以在已有视频片段的基础上,让模型智能预测并续写后续3至10秒的内容,且续写部分与原始片段在运动轨迹、色调和景深上无缝衔接。这一功能对于需要“补拍”或“延长镜头”的影视预演、广告分镜工作流尤为实用。其二是多模态参考能力,模型支持同时输入多张参考图(如角色设定图、场景概念图)以及一段参考视频(用于提取动作或运镜风格),从而实现对生成内容的精细控制。例如,创作者可以上传一张主角正面照和一张背面照,模型便能自动锁定该角色的三维特征,在30秒内任意角度旋转拍摄都不会失真;或者上传一段手持镜头的晃动视频作为参考,模型即可模仿该运镜节奏生成新内容。

从行业影响来看,Seedance 2.5的发布具有多重意义。对于独立创作者而言,它大幅降低了制作中长视频的门槛——过去需要数小时剪辑和反复抽卡才能完成的30秒短片,现在只需一次提示词输入即可获得,且质量稳定。对于影视、广告、游戏等工业化内容生产方,30秒原生直出意味着AI可以承担起完整的“镜头内叙事”任务,例如产品宣传片中的连贯展示、短剧中的长对话场景、游戏过场动画等,这将显著压缩从创意到成片的周期。同时,高保真时序延长和多模态参考能力也使得AI视频工具从“灵感草稿机”向“可落地的生产管线”进化,为专业团队提供了更可靠的协作基础。

当然,我们也应看到,30秒原生直出只是视频生成技术长跑中的一个里程碑。目前该模型在处理极端复杂的物理交互(如流体飞溅、大量粒子碰撞)时仍可能存在瑕疵,且生成速度与算力成本也是实际部署中需要权衡的因素。但不可否认的是,Seedance 2.5的推出,让“AI拍电影”不再是一句空泛的口号,而是正在成为创作者手中实实在在的工具。随着即梦平台对这一模型的开放,我们有理由期待更多具有完整叙事结构的AI原生视频作品涌现,并推动整个视频内容生态的创作效率与艺术表达边界同步拓展。