返回多模态参考

多模态参考

即梦
2026-08-03 14:33:00

即梦 Seedance 2.5 上线后核心功能与工作流梳理

即梦 Seedance 2.5 已正式全量上线,官方同步发布使用手册。相较 2.0 版本,新版把原生生成时长提升至 30 秒,并支持延长到 60 秒,超长视频模式最高支持 180 秒。手册重点围绕时间戳文本控制、多模态参考、白模与绿幕编辑、多语种支持及推荐工作流展开,核心目标是提升视频生成的可控性、一致性和后期编辑效率。

80
即梦 Seedance 2.5 上线后核心功能与工作流梳理
MiniMax
2026-07-31 03:52:34

MiniMax 发布全模态模型 H3,称 2K 视频生成成本降至同级三分之一

MiniMax 于 7 月 31 日发布新一代全模态生成模型 H3,并表示将于近日开源模型权重。该模型支持文字、图片、音频、视频混合输入,可一次生成音画同步的 2K 视频。官方称其 2K 视频生成价格为每秒 0.8 元人民币,15 秒内容约 12 元,并主打 Omni-Reference 多模态参考、视频编辑、多镜头叙事与动作迁移等能力。

690
MiniMax 发布全模态模型 H3,称 2K 视频生成成本降至同级三分之一
字节跳动
2026-07-22 07:07:25

豆包推出 Seed Audio 1.0,一次生成最长 2 分钟完整音轨

字节跳动旗下豆包团队本周发布音频生成模型 Seed Audio 1.0,并在火山方舟体验中心开放创作者测试,企业端 API 也同步邀测。该模型将人声、配乐、音效和环境声纳入同一声学表征,可一次生成最长接近 2 分钟的完整音轨,支持 20 多种语言,并支持零样本多模态参考、100 毫秒级时间轴控制,已整合进豆包 App,国际开发者可通过 BytePlus 接入。

640
豆包推出 Seed Audio 1.0,一次生成最长 2 分钟完整音轨