Google I/O 2026发布Gemini Omni:对话式视频编辑,本周免费登陆YouTube Shorts

Google I/O 2026发布Gemini Omni:对话式视频编辑,本周免费登陆YouTube Shorts

N
News Editor 01
2026-07-23 00:30:14
Google在I/O 2026大会上正式推出多模态视频模型Gemini Omni,支持文本、图片、语音生成视频,并具备对话式编辑功能,可自然语言修改视角和动作。Flash版本即日对付费用户开放,本周将免费整合至YouTube Shorts。
GoogleGemini OmniAI视频生成对话式编辑YouTube Shorts

Google I/O 2026开发者大会今日举行,此前多次泄露的全新多模态模型——Gemini Omni终于正式亮相。这款专注于视频生成与编辑的模型,被视为Google整合旗下AI媒体生成系统的集大成之作,业界预计将重塑视频创作生态。

三大核心亮点:从生成到对话式编辑

根据官方展示,Gemini Omni具备以下主要功能:

首先是全能的生成与混剪(Remix)。用户可以通过纯文本、图片、音频、现有视频,甚至手绘草图作为起点,让AI“从任何输入创造任何内容”。其次是革命性的对话式编辑——用户直接在聊天界面用自然语言下达修改指令,例如“改变摄像机视角”、“调整为黄昏光线”或“替换画面中的物体”。AI会基于前一次结果进行多轮迭代,同时保持人物一致性与物理法则。第三是高保真物理模拟。早期Demo显示,无论是教授在黑板上写数学证明,还是两人吃意大利面的复杂互动,Gemini Omni都表现出极高的文本一致性与真实感。

上线时程:付费用户即日体验,YouTube Shorts本周免费

Google公布了分阶段释放计划:即日起,Google AI Plus、Pro及Ultra订阅用户可在Gemini App与Flow by Google中体验Gemini Omni Flash版本。本周内,该功能将免费整合至YouTube Shorts和YouTube Create App。后续将通过API面向全球开发者与企业开放。

业界分析认为,Gemini Omni可能基于Google最强的视频生成模型Veo(如Veo 3.1)扩展而来,但它不再是单一视频管道,而是强调图文影音无缝融合的统一多模态体验。为保障安全,生成的视频均附有安全水印并受内容限制规范。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
300

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。