谷歌近日发布了两款生成式AI模型:视频生成模型Gemini Omni Flash与图像生成模型Nano Banana 2 Lite。前者内置Gemini世界知识,支持多模态输入(文本、图像、视频)和对话式视频编辑,用户可通过自然语言指令调整视频内容;后者作为升级版,实现“4秒出图”的超快生成速度,并支持低成本批量图像生成,适合大规模商业应用。
端到端AIGC工作流:图像到视频无缝衔接
两款模型可串联使用:先用Nano Banana 2 Lite生成高质量图像,再通过Gemini Omni Flash将其转化为动态视频,打通图像到视频的端到端AIGC流程。这一组合瞄准电商商品展示、装修效果预览、短视频内容创作等垂直场景,有望大幅降低内容制作门槛与成本。
此次发布延续了谷歌在生成式AI领域的快速迭代节奏,进一步压缩了从输入到输出的时间延迟。Nano Banana 2 Lite的4秒出图性能,加上Gemini Omni Flash的实时视频编辑能力,为商业化落地提供了技术基础。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

