Opera,这家全球桌面浏览器市场份额排名第五的公司,近日宣布与Google Cloud达成新合作,将Google最新的AI模型集成到其内置AI助手Aria中。从本周二开始,Opera Developer版本的用户即可体验使用Google Imagen 2模型进行图像生成,以及采用Gemini驱动的聊天功能。此外,Aria还通过Google的文本转语音模型支持了更具对话风格的语音回复。
深化二十年合作,AI成为新引擎
Opera合作负责人Per Wetterdal在官方声明中表示:“我们很高兴宣布将这一合作深化到生成式AI领域,以进一步强化我们的浏览器AI服务。”他特别提到双方已有超过二十年的合作历史。此次更新在Opera Developer(预发布公测版)中立即上线,随后将陆续迁移至Opera Beta和稳定版。
Aria最早于2023年5月推出,最初基于OpenAI的ChatGPT,之后切换到Google的PaLM 2,而PaLM 2已成过去式。现在Aria会根据用户指令智能判断使用Gemini进行文本回复,还是用Imagen 2生成图像。Google Cloud北欧区董事总经理Eva Fors表示:“我们相信AI的未来将是开放的。能为Opera在浏览器领域的AI创新提供支持,我们感到非常高兴。”
AI浏览器战争:Opera vs Edge vs Brave
人工智能的集成正在深刻改变浏览器市场格局。虽然Google Chrome仍稳居第一,但其缺乏原生的内置AI助手,给了其他玩家可乘之机。微软凭借Edge中的Copilot实现了逆袭,在2023年底已超越Safari成为第二。而Opera与Google Cloud的此次合作,为用户提供了一种基于Google生态的AI浏览器选择,与微软Edge的Copilot(基于OpenAI)和Brave的Leo(基于Mistral和Anthropic)形成三足鼎立之势。
在图像生成方面,Imagen 2的写实性和连贯性被认为优于DALL-E 3。据Decrypt进行的对比测试,Aria在理解简短提示词时表现得更加灵活且富有创意。例如,输入“一只吃汉堡的狗”,Aria直接生成了逼真的图像,而Copilot则要求用户提供更详细的描述,在补充“戴墨镜”后才生成了一幅3D渲染风格的图像。不过,Copilot在纯文本对话中可能略占优势。
Brave的AI助手Leo则主打隐私,所有模型均托管在Brave自己的服务器上,不会保留用户对话记录。目前Leo还不支持图像生成。
保留与OpenAI的合作,但重心已转移
值得注意的是,Opera并未完全放弃与OpenAI的集成,用户仍可通过另一个按钮使用由GPT-4和DALL-E 3驱动的聊天功能。但此次与Google的深入合作——包括在冰岛启用由NVIDIA DGX技术驱动的绿色能源AI集群——表明Opera已将AI创新的重心押注在Google生态上。
Opera的Aria在移动浏览器上仍运行旧版,尚未获得Gemini更新,但桌面版的体验已先一步升级。随着AI浏览器竞赛的持续,用户正享受越来越多的选择:想要Google能力的选Opera,想要微软能力的选Edge,注重隐私的选Brave。正如文章所言,Aria的图像生成能力值得任何浏览器用户尝试跳出隐私泡泡。

