浏览器厂商Opera宣布,已与Google进一步深化合作,将Google Gemini和图像生成模型Imagen 2接入其内置AI助手Aria。这意味着,Opera用户未来不仅可以在浏览器内进行更强的文本对话,还能直接调用最新模型生成图片。相关功能目前已在Opera Developer版本上线,面向愿意抢先体验新特性的公开测试用户开放。
Aria升级:从文本助手走向多模态AI入口
根据Opera披露的信息,此次升级的核心在于两部分:一是Aria的文本聊天能力将由Google Gemini提供支持;二是用户可以通过Aria更便捷地调用Imagen 2完成图像生成任务。与此同时,Opera还引入了Google的文本转音频模型,使AI回答能够以更具对话感的语音方式呈现。
Opera合作负责人Per Wetterdal表示,公司很高兴将双方长达二十年的合作进一步延伸至生成式AI领域,以增强其浏览器AI服务矩阵。Google Cloud北欧区董事总经理Eva Fors也表示,Google希望通过其基础设施、AI产品、平台和基础模型,帮助企业在生成式AI浪潮中建立自身路径,而Opera正是浏览器场景中的重要合作对象。
先上开发版,移动端暂未跟进
值得注意的是,这次更新并非同步覆盖全部平台。当前新功能已经在Opera Developer中可用,该版本通常会先行测试新能力,之后再迁移至Beta版本,最终进入稳定版主线。相比之下,虽然Opera移动浏览器中已存在较早版本的Aria,但这次由Gemini驱动的升级暂未登陆智能手机端。
这意味着,Opera眼下仍采取较为稳妥的推进节奏:先在开发者和尝鲜用户群体中验证体验,再决定是否大规模推送。这种策略在生成式AI产品快速迭代、用户反馈高度重要的背景下,显得较为务实。
从ChatGPT到PaLM 2,再到Gemini
Aria最早于2023年5月推出,最初依赖OpenAI的ChatGPT,随后又整合了经过微调的Google PaLM 2模型。随着Google将AI研发重心转向Gemini,PaLM 2已逐渐退出主舞台,Opera也顺势完成了底层能力的更新。
据介绍,Aria会根据用户请求内容,自动决定调用哪种模型处理任务:文本需求可由Gemini支持,而图像生成则交由Imagen 2完成。这种按任务分配模型的设计,反映出浏览器AI正在从单一聊天机器人,演变为面向多场景的统一入口。
值得一提的是,Opera并未完全放弃原有的OpenAI生态整合。其浏览器中仍保留了ChatGPT入口,目前对应的是由GPT-4和DALL·E 3驱动的能力,用户只需点击Aria按钮下方的另一个图标即可切换使用。换言之,Opera正在同时押注Google与OpenAI两条技术路线,为用户提供更多选择。
AI浏览器竞争进入新阶段
Opera此次动作的更大意义,在于它进一步加剧了浏览器行业的AI竞赛。当前,Google Chrome依然是桌面浏览器市场的绝对领导者,但其默认内置AI能力布局相对谨慎,也给了其他厂商通过“AI差异化”争夺用户的空间。
微软正是最典型的例子。借助Chromium内核转型及大规模嵌入AI功能,Edge在过去一段时间显著回升。根据Statcounter数据,到2023年末,Edge已超越Safari,成为全球第二大桌面浏览器。市场普遍认为,微软在2023年9月26日推出统一Copilot体验,是其浏览器产品重获关注的重要转折点。
在这种背景下,Opera与Google Cloud的合作,为市场提供了一种不同于微软Copilot路线的替代方案。对于用户而言,这意味着在AI浏览器领域,除了微软Edge之外,还可以选择以Google模型为核心的Opera方案,以及以隐私保护为卖点的Brave Leo。
与Edge、Brave相比,Opera的定位更清晰
从产品形态看,Opera正在试图把自己塑造成兼顾文本生成、图像生成和浏览器原生体验的综合型AI入口。报道提到,Brave的Leo同样集成在浏览器中,并可进行问答、摘要与内容生成,但尚不支持图像生成。其优势主要体现在隐私保护上,因为Brave将相关模型托管在自有服务器上,并强调不会保留用户输入或将对话用于模型训练。
而与微软Copilot相比,文章援引测试观点称,Copilot在文本回复方面或许具有一定优势,但Google的Imagen 2在图像真实感与连贯性上表现更强。以简单提示词生成图片时,Aria展现出更高的灵活性,对简短指令的理解也更自然。
这类差异意味着,未来AI浏览器的竞争不再只是“谁先接入大模型”,而是比拼谁能在浏览器这一高频入口中,将模型能力、交互设计、内容生成和用户信任更好地结合起来。
市场影响:AI能力正成为浏览器估值新变量
从行业角度看,Opera此次升级释放出两个清晰信号。其一,浏览器正在成为大模型落地的重要前端场景。相比独立AI应用,浏览器天然具备搜索、阅读、创作与信息组织的高频使用场景,AI功能一旦深度融合,用户黏性和使用时长都有望提升。其二,模型厂商之间的竞争,正通过浏览器等分发渠道进一步外溢。Google、OpenAI、微软、Anthropic、Mistral等玩家,不仅在模型能力上竞争,也在终端入口上展开博弈。
对加密行业用户而言,这一趋势同样值得关注。长期以来,Opera和Brave都在Web3用户群体中具有较高认知度,尤其是在钱包集成、隐私浏览和数字资产生态方面较活跃。随着浏览器AI能力增强,未来浏览器有可能承担更多信息筛选、链上数据摘要、项目研究辅助甚至内容创作任务。虽然此次更新本身并非加密产品发布,但它显示出用户获取信息和使用互联网服务的入口正被AI重塑,而这将间接影响Web3内容分发与用户行为模式。
此外,Opera此前还宣布在冰岛启用由绿色能源驱动、基于NVIDIA DGX技术的AI数据集群,以加快其AI计划扩张。这说明浏览器厂商已不再满足于接入外部模型,而是开始围绕AI基础设施进行更长期布局。
总体来看,Opera引入Gemini与Imagen 2,不只是一次功能更新,更是其在AI浏览器赛道中的战略加码。随着开发版率先开放测试,市场接下来关注的重点将是:这些新能力何时进入稳定版、移动端何时跟进,以及用户是否会因为AI体验而重新选择浏览器平台。在AI成为浏览器核心卖点的当下,Opera显然希望借助Google的模型能力,为自己争取更多增量空间。

