谷歌推出 Gemini Omni 1.1 Flash 视频模型,支持 40 秒扩展与 4K 输出

谷歌推出 Gemini Omni 1.1 Flash 视频模型,支持 40 秒扩展与 4K 输出

N
News Editor
2026-08-29 14:37:45
谷歌发布原生多模态视频生成与编辑模型 Gemini Omni 1.1 Flash,支持基于最长 10 秒上下文做场景扩展,总时长可达 40 秒,并可通过固定首尾帧控制摄像机运动。该模型还支持参考视频保持角色一致性,先以 360p 生成草稿再升级到 4K,现已通过 Gemini API 向 Google AI Studio 和 Gemini Enterprise Agent Platform 提供。

Techub News 消息,谷歌发布原生多模态视频生成与编辑模型 Gemini Omni 1.1 Flash。

该版本支持基于最长 10 秒上下文进行场景扩展,总扩展时长可达 40 秒,也支持通过固定首尾帧控制摄像机运动。用户还可以提供视频片段作为参考,以保持角色一致性,并先以 360p 分辨率快速生成草稿,再升级至 4K 输出。

目前,这一模型已通过 Gemini API 在 Google AI Studio 和 Gemini Enterprise Agent Platform 提供。Adobe、Figma Weave、GMI Cloud 和 Runway 已作为生产用户接入。

价格方面,输入视频代币成本为每百万 1.5 美元,视频输出代币成本为每百万 17.5 美元,720p 视频生成成本约为每秒 0.1 美元。所有生成视频均带有 SynthID 水印。

消息援引 MarkTechPost 报道。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
2800

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。