Odaily 转引 Tae Kim 对 CoreWeave 高管的访谈显示,这家 neocloud 服务商正在从一线客户需求中观察 AI 算力周期的变化。CoreWeave 联合创始人兼首席发展官 Brannin McBee,以及企业发展与投资者关系副总裁 Nick Robbins 表示,AI 需求并未因上一轮 GPU 抢购潮降温,反而在智能体 AI、推理模型和企业级 AI 应用推动下继续升温。Nick 对当前状态的概括很直接:AI 需求“似乎每天都在以新的方式加剧”。

从 GPU 抢购转向完整 AI 工厂建设
CoreWeave 成立于 2017 年,为初创公司和大型企业提供大规模 GPU 算力,被视为 neocloud 领域较早取得市场位置的公司。它也是唯一一家获得 AI 研究机构 SemiAnalysis 最高级别“白金评级”的云服务商。受访高管强调,公司所处位置较为特殊:既服务 OpenAI、Anthropic、Meta、Google、Microsoft、Nvidia 等头部客户,也直接接触研究实验室、企业客户和超大规模云厂商的需求变化,因此看到的不只是 GPU 供需,而是 AI 工作负载本身的结构变化。

Brannin 回忆,智能体 AI 的需求浪潮在去年第四季度已经出现真正开端。当时 CoreWeave 正与客户进行工程层面的沟通,讨论客户预计在今年第一季度推向市场的产品。他表示,公司与客户之间存在深度互联的工程关系,这让 CoreWeave 能提前看到趋势,而不是等变化发生后再响应。从 AI 产品角度看,第一季度是推理和 AI 消费出现巨大拐点的时刻,并且这种加速延续至今。

CPU 与存储需求上升,Vera CPU 将与 Vera Rubin 并行部署
在谈到智能体 AI 浪潮中 CPU 相对 GPU 的需求上升时,Brannin 表示,CoreWeave 从 2023 年开始就在运行 CPU,并一直拥有完整云产品。问题并不在于公司是否刚开始增加 CPU,而在于客户到底需要什么,以及这种需求在相对意义上是否上升。他给出的回答是“非常明确,确实如此”。随着智能体和推理能力在模型中真正兴起,存储需求相较前几代也在上升。
Nick 进一步说明,市场会看到大量 Vera CPU 被部署在大量 Vera Rubin 服务器旁边。CoreWeave 去年已经从根本上重新设计基础数据中心方案,为更多存储和更多 CPU 留出空间,使它们可以部署在 GPU 旁边。CoreWeave 将这种调整归因于自身在生态系统中的位置:公司称自己是唯一一家服务于所有最先进技术用户的独立云服务商,并表示没有其他独立 AI 云服务商可以同时把 Anthropic、OpenAI、Meta、Google、Microsoft、Nvidia 等列为客户。

关于未来是否主要使用 Nvidia Vera CPU,Nick 表示这取决于具体工作负载,CoreWeave 的建设由客户需求驱动。公司已披露会成为 Vera CPU 的早期且重要采用者;与此同时,现有机群主要仍是 AMD,后续配置会依据客户需求调整。Brannin 补充称,CoreWeave 98% 以上收入由合同驱动,公司不是猜测客户想要什么样的基础设施,而是由客户明确提出配置要求,客户定义 CoreWeave 要建设什么。

竞争差异来自执行速度、性能和编排层
面对 SpaceX、Nebius、Oracle 等 neocloud,以及 Azure、AWS、Google 等超大规模云服务商,Brannin 将 CoreWeave 的差异化放在第三方验证和执行记录上。他表示,除中国外,全球排名前十的 AI 实验室中有九家在使用 CoreWeave 平台;SemiAnalysis 一直将 CoreWeave 的性能单独列为最高水平。他还称,公司获得 GPU 分配并不是因为与 Jensen 的私人交情,而是供应商相信 CoreWeave 的执行记录和工程能力,相信其能在全球范围内体现产品能力。
Nick 则把客户类型拆分解释:CoreWeave 能赢得超大规模云服务商客户,是因为公司能以极快速度搭建系统,并让系统良好运行;能赢得研究实验室客户,是因为公司提供性能最强的技术版本,并在每 token 效率上表现最好;能赢得企业客户,是因为基础设施运行良好,并构建了同类最佳的编排层,这也是白金评级等认可的来源。更进一步,CoreWeave 还在推理和开发工具层面构建能力,帮助企业把 AI 真正投入生产,把数据转化为模型,再转化为内部运行的智能体,并在过程中交叉销售 CoreWeave 云服务。

瓶颈集中在 powered shells,VR 大规模爬坡贯穿 2027 年
在瓶颈问题上,Brannin 明确指出核心是 powered shells,即具备供电条件的数据中心壳体,更准确地说是壳体内部的组件。采访中提到的电工也被他确认是复杂领域的一部分。Brannin 强调,CoreWeave 已有 49 个这样的站点上线并运行,不是把希望寄托在一两个站点上,而是已经执行了 49 次,由此积累了供应链知识,知道哪些供应商适合合作、哪些供应商不适合合作。

关于 HBM 内存成本和短缺,Nick 表示 CoreWeave 的商业模式是在签署 GPU 采购订单、确定自身成本的同时,锁定向客户收取的 GPU 价格;更广义地说是服务器价格,而服务器价格包含 HBM 成本。他称当前获取组件并不是最大瓶颈,最大瓶颈仍是 powered shell。对于 Vera Rubin 部署节奏,Nick 表示 CoreWeave 是全球第一家启动并全面验证 VR 机柜的公司,去年在 GB200、GB300 上也是如此。他预计 VR 会在今年晚些时候开始出现,真正大规模且强劲的部署爬坡将贯穿整个 2027 年;GB 在 2025 年开始出现,真正大规模爬坡贯穿 2026 年,未来 12 到 18 个月内 VR 会呈现相似节奏。

