谷歌据报开发 Gemini 专用 AI 芯片 Frozen v2

谷歌据报开发 Gemini 专用 AI 芯片 Frozen v2

N
News Editor
2026-07-21 17:24:37
据 The Information 报道,谷歌正在研发代号 Frozen v2 的 AI 芯片,目标是让 Gemini 运行更快、成本更低。该芯片据称会把 Gemini 部分架构直接写入硬件,工程师预计每瓦可生成的 token 数提升 6 至 10 倍。消息传出后,Alphabet 周一盘中一度触及 356 美元,涨幅约 3%,但随后市场焦点转向公司将于 7 月 22 日公布的 2026 年第二季度业绩。
谷歌GeminiAI芯片TPU英伟达Alphabet人工智能科技动态

据 The Information 周一报道,谷歌正在研发一款只为 Gemini 服务的 AI 芯片,代号为 Frozen v2,目标是让 Gemini 跑得更快、运行成本更低。

谷歌据报开发 Gemini 专用 AI 芯片 Frozen v2 2

这项计划,指向谷歌眼下一个单靠砸钱也难以迅速解决的问题:它已经拉动了 AI 需求,但自身的服务能力正在逼近上限。

报道称,今年 3 月,谷歌曾告诉 Meta,自己无法满足后者计划购买的 Gemini 算力规模。Meta 随后不得不要求员工节制 AI 使用。尽管谷歌今年在 AI 基础设施上的支出最高可达 1900 亿美元,但由于服务器数量不足,仍在拒绝部分客户需求。

Frozen v2 与现有 TPU 的区别

在已披露的信息中,Frozen v2 并不像是谷歌 Tensor Processing Units(TPU)的又一次常规升级。TPU 是谷歌自 2015 年开始研发的定制芯片,目前支撑 Gemini 以及面向外部开发者的云服务。

TPU 可以运行被加载到其上的任意 AI 模型。报道提到,Frozen v2 走的是另一条路线:它会把 Gemini 架构中的一部分直接固化进硬件。这里的“架构”,指的是模型路由和处理信息的结构蓝图。

在机器学习语境里,“freezing”通常指把某些内容永久锁定。此次被“冻结”的不是模型权重,也就是 Gemini 通过训练获得并且仍可更新的知识,而是模型架构本身。

如果把这部分蓝图直接写入芯片电路,芯片在处理请求时就可以跳过部分重复计算,也不必在每次查询时反复跨内存搬运数据。按照工程师的预估,这样可以让单位耗电生成的 token 数提升 6 到 10 倍。token 是 AI 每次回复由小块文本组成的基本单位。

按文中的说法,这相当于谷歌用原本服务 1 次查询的电力成本,去服务 10 次查询。

对用户体验影响有限,重点在成本端

如果用户正在使用 Gemini,这款芯片不会直接改变使用时的体感。但它会改变 Gemini 的运行成本。报道认为,更低成本的 Gemini,会让谷歌在与 OpenAI、Anthropic 以及中国 AI 实验室的竞争中更有优势,因为这些中国实验室已经占到美国企业 AI token 使用量的最高 45%,重要原因之一是它们的运行成本低 60% 至 90%。

文中还提到,这未必意味着终端用户会立刻获得更便宜的 AI 服务,但谷歌自身的盈利能力可能因此受益。

谷歌据报开发 Gemini 专用 AI 芯片 Frozen v2 3

股价反应与财报时间

受该消息影响,Alphabet 股价在周一交易时段上涨约 3%,盘中一度触及 356 美元。不过,随着投资者等待谷歌最新业绩,涨幅在当天后续交易中有所回落。

Alphabet 定于北京时间 7 月 22 日公布 2026 年第二季度财报。

大厂继续降低对英伟达硬件依赖

报道把 Frozen v2 视为大型 AI 公司减少对英伟达硬件依赖的又一次尝试。英伟达目前控制着约 85% 的 AI GPU 市场,而主要科技公司都在寻求替代方案。

文中称,英伟达的硬件最初是为电子游戏而非语言模型设计,虽然也能用于这类任务,但会带来专用芯片原本可以避免的额外开销。对谷歌这样的规模来说,6 到 10 倍的效率差距并不抽象,而是可能对应数十亿美元的成本差异。

也正因为如此,Meta、亚马逊、微软和 OpenAI 都在推进各自的定制芯片项目。Decrypt 还提到,今年 3 月,即便 AWS 已承诺在 2027 年前部署 100 万块英伟达 GPU,仍在同步研发自有芯片,以降低长期暴露在单一供应链下的风险。

项目仍处探索阶段,最早 2028 年部署

不过,Frozen v2 目前仍处于探索阶段。报道显示,该项目的一些关键设计决策尚未最终敲定,谷歌也没有确认项目确实存在。

按现有说法,这款芯片也不会提供给外部云客户使用,因为为单一模型硬连线的硬件无法运行其他客户的模型。根据报道,它最早也要到 2028 年才会部署。

在此期间,谷歌还在采用过渡方案。报道提到,谷歌目前每月向 SpaceX 支付 9.2 亿美元,以租用 xAI 数据中心的 11 万块英伟达 GPU。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
400

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。