Opera,这家全球第五大桌面浏览器开发商,近日宣布与谷歌云达成深度合作协议,将谷歌的Gemini大语言模型和Imagen 2图像生成模型直接集成到其内置AI助手Aria中。这项更新已在Opera Developer(预发布版)中上线,允许用户通过Aria生成高质量图片,并支持语音交互,标志着浏览器AI竞赛的进一步白热化。
从PaLM 2到Gemini:Aria的智能化升级
Aria最初于2023年5月推出,最初依赖OpenAI的ChatGPT,随后转向谷歌的PaLM 2模型。随着谷歌将AI重心转向Gemini,Opera此次更新使Aria能够根据任务智能选择模型:文本对话调用Gemini 1.5 Pro,图像生成则使用Imagen 2。Opera合作负责人Per Wetterdal表示:“我们很高兴将长达二十年的合作拓展至生成式AI领域,进一步强化我们的浏览器AI服务。”值得注意的是,Opera并未放弃与OpenAI的集成——用户仍可通过界面上独立的ChatGPT按钮(基于GPT-4和DALL-E 3)获取不同风格的AI体验。
AI浏览器大战:新格局浮现
AI正在重塑浏览器市场格局。曾经被戏称为“只为下载Chrome”的微软Edge,凭借全面引入Copilot(基于OpenAI技术)在2023年底超越Safari,成为全球第二大桌面浏览器。而谷歌Chrome虽占据主导,但缺少默认内置AI助手,这给了竞争对手创新空间。Opera此次与谷歌云合作,实际上推出了一款“谷歌AI原生浏览器”,直接对标微软的Copilot路径。谷歌北欧区董事总经理Eva Fors表示:“我们认为AI的未来将是开放的,很高兴通过为Opera提供最好的AI基础设施来提升我们长期合作。”
与此同时,隐私导向的浏览器Brave也推出了自己的AI助手Leo,基于Mixtral 8x7B、Claude Instant等开源模型,且所有推理在Brave自有服务器上完成,不保留用户数据。但Leo目前尚不支持图像生成。
体验对比与市场影响
在实际测试中,Opera的Aria显示出独特的优势。例如,简单的提示词“一只吃汉堡的狗”即可生成逼真图像,而微软Copilot则要求更详细的描述才能产出类似效果。分析人士指出,Imagen 2在真实感和一致性方面优于DALL-E 3,而Gemini 1.5 Pro在聊天机器人竞技场排名中仅次于GPT-4o。对于用户而言,现在在浏览器AI方面有了三大明确选择:Opera(谷歌AI)、Edge(微软OpenAI)和Brave(开源隐私AI)。Opera的此轮更新不仅强化了其产品竞争力,也为谷歌AI开辟了新的用户触达渠道,可能会打破浏览器市场现有的AI赋能竞争格局。
目前,该图像生成和Gemini对话功能仅在Opera桌面开发版中可用,移动端尚未支持。Opera表示,稳定版将在后续更新中推送。随着AI逐步渗透到基础工具中,浏览器的定义正在被重新书写。

