字节跳动视频生成模型 Seedance 2.0 在海外引发热议后,马斯克也在 X 上就相关内容评论称“It’s happening fast”。这条公开表态没有展开技术细节,却把外界对该模型的关注推高到了更大��围。
字节跳动披露,Seedance 2.0 已正式发布,并已全面接入豆包和即梦产品,同时上线火山方舟体验中心供用户试用。面向企业端,字节跳动称,预计 2 月中下旬 将把 Seedance 2.0 的 API 服务上线火山方舟。
多模态输入与长叙事生成被列为核心能力
从产品定位看,字节跳动把 Seedance 2.0 指向更接近专业生产的场景。该模型支持文字、图片、音频、视频四种模态混合输入,可参考构图、动作、运镜、特效和声音等元素完成生成。
官方介绍还提到,模型支持原声音画同步和多轨并行输出,可处理背景音乐、环境音效或人物解说,并强调音频节奏与画面内容的匹配。另一项重点能力是多镜头长叙事生成,模型可自动解析叙事逻辑,生成镜头序列,并尽量保持角色、光影、风格和氛围统一。视频编辑与视频延长能力也被纳入工作流设计中。
字节跳动承认仍有短板
虽然字节跳动称 Seedance 2.0 的综合表现达到行业领先水平,但同时明确表示该模型“还远不完美��。现阶段的不足包括细节稳定性、多人口型匹配、多主体一致性、文字还原精度以及复杂编辑效果等。
在使用边界上,字节跳动也给出了限制:目前 Seedance 2.0 限制真人图像或视频作为主体参考;若需使用真人作为主体参考,须经本人验证或取得授权。这意味着部分商业素材制作流程仍会受到约束。
2 月 14 日还有一轮升级发布
字节跳动火山引擎已初步确定于 2026 年 2 月 14 日 发布豆包大模型一系列升级,涉及豆包大模型 2.0、音视频创作模型 Seedance 2.0、图像创作模型 Seedream 5.0 Preview,并表示基础模型能力和企业级 Agent 能力将有大幅提升。
眼下,Seedance 2.0 已从内测走向更完整的产品化阶段。马斯克的评论带来了更高曝光,字节跳动则把模型能力、限制和后续发布时间一并摆上台面。

