Opera Integrates Google Gemini and Imagen 2 Into Aria, Intensifying the AI Browser Race

Opera Integrates Google Gemini and Imagen 2 Into Aria, Intensifying the AI Browser Race

N
News Editor 01
2026-07-05 14:59:12
Opera has upgraded its browser AI assistant Aria with Google Gemini for text responses and Imagen 2 for image generation, now available in Opera Developer. The move strengthens competition among AI-powered browsers including Edge and Brave.

浏览器厂商Opera宣布,已与Google进一步深化合作,将Google Gemini和图像生成模型Imagen 2接入其内置AI助手Aria。这意味着,Opera用户未来不仅可以在浏览器内进行更强的文本对话,还能直接调用最新模型生成图片。相关功能目前已在Opera Developer版本上线,面向愿意抢先体验新特性的公开测试用户开放。

Aria升级:从文本助手走向多模态AI入口

根据Opera披露的信息,此次升级的核心在于两部分:一是Aria的文本聊天能力将由Google Gemini提供支持;二是用户可以通过Aria更便捷地调用Imagen 2完成图像生成任务。与此同时,Opera还引入了Google的文本转音频模型,使AI回答能够以更具对话感的语音方式呈现。

Opera合作负责人Per Wetterdal表示,公司很高兴将双方长达二十年的合作进一步延伸至生成式AI领域,以增强其浏览器AI服务矩阵。Google Cloud北欧区董事总经理Eva Fors也表示,Google希望通过其基础设施、AI产品、平台和基础模型,帮助企业在生成式AI浪潮中建立自身路径,而Opera正是浏览器场景中的重要合作对象。

先上开发版,移动端暂未跟进

值得注意的是,这次更新并非同步覆盖全部平台。当前新功能已经在Opera Developer中可用,该版本通常会先行测试新能力,之后再迁移至Beta版本,最终进入稳定版主线。相比之下,虽然Opera移动浏览器中已存在较早版本的Aria,但这次由Gemini驱动的升级暂未登陆智能手机端

这意味着,Opera眼下仍采取较为稳妥的推进节奏:先在开发者和尝鲜用户群体中验证体验,再决定是否大规模推送。这种策略在生成式AI产品快速迭代、用户反馈高度重要的背景下,显得较为务实。

从ChatGPT到PaLM 2,再到Gemini

Aria最早于2023年5月推出,最初依赖OpenAI的ChatGPT,随后又整合了经过微调的Google PaLM 2模型。随着Google将AI研发重心转向Gemini,PaLM 2已逐渐退出主舞台,Opera也顺势完成了底层能力的更新。

据介绍,Aria会根据用户请求内容,自动决定调用哪种模型处理任务:文本需求可由Gemini支持,而图像生成则交由Imagen 2完成。这种按任务分配模型的设计,反映出浏览器AI正在从单一聊天机器人,演变为面向多场景的统一入口。

值得一提的是,Opera并未完全放弃原有的OpenAI生态整合。其浏览器中仍保留了ChatGPT入口,目前对应的是由GPT-4DALL·E 3驱动的能力,用户只需点击Aria按钮下方的另一个图标即可切换使用。换言之,Opera正在同时押注Google与OpenAI两条技术路线,为用户提供更多选择。

AI浏览器竞争进入新阶段

Opera此次动作的更大意义,在于它进一步加剧了浏览器行业的AI竞赛。当前,Google Chrome依然是桌面浏览器市场的绝对领导者,但其默认内置AI能力布局相对谨慎,也给了其他厂商通过“AI差异化”争夺用户的空间。

微软正是最典型的例子。借助Chromium内核转型及大规模嵌入AI功能,Edge在过去一段时间显著回升。根据Statcounter数据,到2023年末,Edge已超越Safari,成为全球第二大桌面浏览器。市场普遍认为,微软在2023年9月26日推出统一Copilot体验,是其浏览器产品重获关注的重要转折点。

在这种背景下,Opera与Google Cloud的合作,为市场提供了一种不同于微软Copilot路线的替代方案。对于用户而言,这意味着在AI浏览器领域,除了微软Edge之外,还可以选择以Google模型为核心的Opera方案,以及以隐私保护为卖点的Brave Leo。

与Edge、Brave相比,Opera的定位更清晰

从产品形态看,Opera正在试图把自己塑造成兼顾文本生成、图像生成和浏览器原生体验的综合型AI入口。报道提到,Brave的Leo同样集成在浏览器中,并可进行问答、摘要与内容生成,但尚不支持图像生成。其优势主要体现在隐私保护上,因为Brave将相关模型托管在自有服务器上,并强调不会保留用户输入或将对话用于模型训练。

而与微软Copilot相比,文章援引测试观点称,Copilot在文本回复方面或许具有一定优势,但Google的Imagen 2在图像真实感与连贯性上表现更强。以简单提示词生成图片时,Aria展现出更高的灵活性,对简短指令的理解也更自然。

这类差异意味着,未来AI浏览器的竞争不再只是“谁先接入大模型”,而是比拼谁能在浏览器这一高频入口中,将模型能力、交互设计、内容生成和用户信任更好地结合起来。

市场影响:AI能力正成为浏览器估值新变量

从行业角度看,Opera此次升级释放出两个清晰信号。其一,浏览器正在成为大模型落地的重要前端场景。相比独立AI应用,浏览器天然具备搜索、阅读、创作与信息组织的高频使用场景,AI功能一旦深度融合,用户黏性和使用时长都有望提升。其二,模型厂商之间的竞争,正通过浏览器等分发渠道进一步外溢。Google、OpenAI、微软、Anthropic、Mistral等玩家,不仅在模型能力上竞争,也在终端入口上展开博弈。

对加密行业用户而言,这一趋势同样值得关注。长期以来,Opera和Brave都在Web3用户群体中具有较高认知度,尤其是在钱包集成、隐私浏览和数字资产生态方面较活跃。随着浏览器AI能力增强,未来浏览器有可能承担更多信息筛选、链上数据摘要、项目研究辅助甚至内容创作任务。虽然此次更新本身并非加密产品发布,但它显示出用户获取信息和使用互联网服务的入口正被AI重塑,而这将间接影响Web3内容分发与用户行为模式。

此外,Opera此前还宣布在冰岛启用由绿色能源驱动、基于NVIDIA DGX技术的AI数据集群,以加快其AI计划扩张。这说明浏览器厂商已不再满足于接入外部模型,而是开始围绕AI基础设施进行更长期布局。

总体来看,Opera引入Gemini与Imagen 2,不只是一次功能更新,更是其在AI浏览器赛道中的战略加码。随着开发版率先开放测试,市场接下来关注的重点将是:这些新能力何时进入稳定版、移动端何时跟进,以及用户是否会因为AI体验而重新选择浏览器平台。在AI成为浏览器核心卖点的当下,Opera显然希望借助Google的模型能力,为自己争取更多增量空间。

This article was originally published by Bit.Fan. For more cryptocurrency news and market insights, visit www.bit.fan.
100

Disclaimer:

The market information, project data, and third-party content displayed on this platform are for industry information sharing only and do not constitute any form of investment advice or return commitment.

Cryptocurrency trading carries high risks. Users should fully assess their risk tolerance and make independent decisions. All profits, losses, and legal responsibilities are borne by the users themselves.