Techub News 消息,谷歌发布原生多模态视频生成与编辑模型 Gemini Omni 1.1 Flash。
该版本支持基于最长 10 秒上下文进行场景扩展,总扩展时长可达 40 秒,也支持通过固定首尾帧控制摄像机运动。用户还可以提供视频片段作为参考,以保持角色一致性,并先以 360p 分辨率快速生成草稿,再升级至 4K 输出。
目前,这一模型已通过 Gemini API 在 Google AI Studio 和 Gemini Enterprise Agent Platform 提供。Adobe、Figma Weave、GMI Cloud 和 Runway 已作为生产用户接入。
价格方面,输入视频代币成本为每百万 1.5 美元,视频输出代币成本为每百万 17.5 美元,720p 视频生成成本约为每秒 0.1 美元。所有生成视频均带有 SynthID 水印。
消息援引 MarkTechPost 报道。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

