原文标题为《An Interview with CoreWeave Executives: AI Demand Seems to 'Intensify' Every Day》,作者为Tae Kim,BlockBeats由Peggy编译。访谈对象包括CoreWeave联合创始人兼首席发展官Brannin McBee,以及企业发展与投资者关系副总裁Nick Robbins,主题集中在AI需求、neocloud市场和下一代AI基础设施建设。CoreWeave成立于2017年,为初创公司和大型企业提供大规模GPU算力,并被视为neocloud领域的早期市场领导者之一。

需求从去年第四季度延伸至推理与智能体
Brannin McBee表示,智能体AI需求浪潮的真正开端出现在去年第四季度。当时CoreWeave已经在与客户进行工程层面的沟通,讨论客户预计在今年第一季度推向市场的产品。他强调,CoreWeave与客户之间存在深度互联的工程关系,这让公司能够提前看到趋势,而不是在变化发生后再被动响应。从AI产品市场的角度看,他认为第一季度是推理和AI消费出现巨大拐点的时刻,并且这一加速仍在继续。

当被问及当前AI需求与几个月前相比是否放缓时,Nick Robbins给出的回答很直接:需求似乎每天都在以新的方式加剧。访谈的核心也由此展开:AI算力周期并未因为上一轮GPU抢购而降温,智能体AI、推理模型和企业级AI应用继续提高对基础设施的要求。
CPU和存储被重新纳入AI工厂设计
关于CPU相对于GPU的需求上升,Brannin称CoreWeave从2023年起就在运行CPU,公司一直拥有完整的云产品。因此问题并不在于CoreWeave是否刚开始增加CPU,而在于客户到底需要什么,以及这种需求在相对意义上是否正在上升。他给出的答案是明确的:随着智能体和推理能力在模型中兴起,存储需求相较前几代也在上升,并且这一趋势会继续。

Nick补充称,外界会看到大量Vera CPU被部署在大量Vera Rubin服务器旁边。去年CoreWeave从根本上重新设计了基础数据中心方案,为更多存储和更多CPU预留空间,使其能够部署在GPU旁边。他解释说,CoreWeave在生态系统中的位置特殊,是一家服务所有最先进技术用户的独立云服务商,客户包括Anthropic、OpenAI、Meta、Google、Microsoft、Nvidia等。这一客户结构为公司形成正向反馈循环:CoreWeave理解客户正在把技术带向哪里,并据此规划基础设施。

在是否主要使用Nvidia Vera CPU的问题上,Nick表示取决于具体工作负载。CoreWeave的做法由客户需求驱动,公司已经披露预计会成为Vera CPU的早期且重要采用者。目前CoreWeave机群主要仍是AMD,但会随客户需求变化;客户对Vera CPU的兴趣非常浓厚。Brannin也借此说明合同模式:CoreWeave超过98%的收入由合同驱动,公司并不是猜测客户想要什么基础设施,而是由客户非常明确地告诉其所需配置,客户在定义CoreWeave要建设什么。
与neocloud和超大规模云厂商竞争
谈到竞争格局时,Tae Kim提到了SpaceX、Nebius、Oracle等neocloud,以及Azure、AWS、Google等超大规模云服务商。Brannin表示,他更愿意从第三方验证角度看差异化:除中国外,全球排名前十的AI实验室中有九家在使用CoreWeave平台;SemiAnalysis一直将CoreWeave在性能方面单独列为最高水平。他还表示,CoreWeave获得GPU分配并不是因为与Jensen的私人交情,而是供应商对其执行记录和工程能力有很深信心,相信CoreWeave能够在全球范围内最好地体现其产品能力。

Nick则将不同客户群体的原因拆开说明:CoreWeave能够赢得超大规模云服务商客户,是因为公司擅长执行,能够以极快速度搭建系统,而且系统运行良好;能够赢得研究实验室客户,是因为公司提供性能最强的技术版本,并且在每token效率上表现最好;能够赢得企业客户,是因为基础设施运行良好,并且构建了同类最佳的编排层,这也是白金评级等认可的来源。他还表示,CoreWeave已经在AI云服务商中构建出覆盖推理和开发工具的成熟能力层,帮助企业将AI投入生产,把数据转化为模型,再转化为可在内部运行的智能体,并在这一过程中交叉销售CoreWeave云服务。

瓶颈转向供电壳体、组件与部署执行
在瓶颈问题上,Brannin明确指出,当前瓶颈是powered shells,也就是具备供电条件的数据中心壳体;更准确地说,是这些壳体内部的组件。Tae提到电工时,Brannin表示这一点完全正确,并称这是一个复杂领域。他强调CoreWeave已有49个此类站点上线并运行,并不是把希望寄托在一两个站点上,而是已经完成了49次。这形成了深厚的执行记录,也让公司积累了处理供应链问题的知识,知道供应链中哪些供应商适合合作,哪些不适合合作。
关于HBM内存成本和短缺,Nick表示客户需要承担涨价成本。CoreWeave的商业模式是在签署GPU采购订单、确定自身成本的同时,锁定向客户收取的GPU价格;更广义地说,也就是服务器价格,而服务器价格包含HBM成本。他同时表示,目前获取组件并不是最大的瓶颈,最大的瓶颈仍是powered shell。

对于Vera Rubin部署节奏,Nick称CoreWeave显然是全球第一家启动并全面验证VR即Vera Rubin机柜的公司,去年在GB200、GB300上也是如此。他预计VR会在今年晚些时候开始出现,真正大规模且强劲的部署爬坡将贯穿整个2027年。Nick将其与GB节奏作对比:GB在2025年开始出现,但真正大规模爬坡贯穿整个2026年;去年年底已经部署不少,但今年才是真正大规模部署GB的一年。他预计未来12到18个月内,VR会呈现非常相似的节奏。

