CoreWeave被视为neocloud新型云服务领域的早期市场领导者,也是唯一获得AI研究机构SemiAnalysis最高级别“白金评级”的云服务商。公司成立于2017年,主要为初创公司和大型企业提供大规模GPU算力。Key Context近期采访了CoreWeave联合创始人兼首席发展官Brannin McBee,以及企业发展与投资者关系副总裁Nick Robbins,讨论AI需求、智能体AI、推理模型以及neocloud市场的变化。

智能体AI与推理需求从去年四季度启动
在谈到智能体AI需求浪潮何时开始爆发时,Brannin表示,CoreWeave在去年第四季度看到了真正的开端。当时,公司正与客户进行工程层面的沟通,讨论客户计划在今年第一季度推向市场的产品。他强调,CoreWeave与客户之间存在深度互联的工程关系,这种关系让公司能够提前看到趋势,而不是在变化发生后被动响应。从AI市场的产品角度看,他认为第一季度是推理和AI消费出现巨大拐点的时期,而且这种加速延续至今。

对于当前AI需求状态,Nick给出的回答很直接:它似乎每天都在以新的方式加剧。访谈将这一变化与智能体、推理和企业级AI应用联系在一起。CoreWeave所处的位置较特殊,它既服务OpenAI、Anthropic、Meta、Google、Microsoft、Nvidia等头部客户,也直接感知研究实验室、企业客户和超大规模云厂商的需求变化,因此它观察到的不只是GPU是否短缺,而是AI工作负载结构本身正在改变。
CPU和存储被纳入新一代数据中心设计
在GPU之外,CPU和存储的重要性正在上升。Brannin表示,CoreWeave从2023年开始就在运行CPU,公司一直拥有完整的云产品,因此问题并不是是否刚开始增加CPU,而是客户需要什么,以及这种需求在相对意义上是否正在上升。他的回答是“非常明确,确实如此”。随着智能体和推理能力在模型中真正兴起,存储需求相较前几代也在上升,他认为这一趋势会继续。

Nick补充称,未来确实会看到大量Vera CPU部署在大量Vera Rubin服务器旁边。CoreWeave去年已经从根本上重新设计基础数据中心方案,为更多存储和更多CPU留出空间,使其能够部署在GPU旁边。他解释说,公司之所以这样做,是因为它在生态系统中处于独特位置:作为独立AI云服务商,它服务Anthropic、OpenAI、Meta、Google、Microsoft、Nvidia等客户,并据此理解客户正在把技术带向哪里,再进行基础设施规划。

谈及未来是否主要使用Nvidia Vera CPU,Nick表示这取决于具体工作负载,CoreWeave的做事方式由客户需求驱动。公司已经披露,将成为Vera CPU的早期且重要采用者。目前,CoreWeave机群主要仍是AMD,但随着时间推移,这一结构会根据客户需求变化,客户对Vera CPU的兴趣非常浓厚。Brannin也借此说明,公司98%以上收入由合同驱动,CoreWeave并不是猜测客户需要何种基础设施,而是客户明确告诉公司需要什么配置,由客户定义公司要建设什么。
竞争焦点落在执行速度和工程能力
面对SpaceX、Nebius、Oracle等neocloud,以及Azure、AWS、Google等超大规模云服务商,Brannin将差异化放在第三方验证上。他表示,除中国外,全球排名前十的AI实验室中有九家使用CoreWeave平台;SemiAnalysis一直将CoreWeave在性能方面单独列为最高水平。他还表示,公司获得GPU分配并不是因为与Jensen的私人交情,而是供应商对CoreWeave执行记录和工程能力有很深信心,相信其能够在全球范围内体现产品能力。

Nick称,CoreWeave能够赢得超大规模云服务商客户,是因为公司擅长执行,可以以很快速度搭建系统,并让系统良好运行;能够赢得研究实验室客户,是因为公司提供性能最强的技术版本,并在每token效率上表现最好;能够赢得企业客户,则是因为基础设施运行良好,并且构建了优秀的编排层,这也是白金评级等认可的来源。他还表示,在AI云服务商中,CoreWeave已经构建出覆盖推理和开发工具的成熟能力,帮助企业把AI真正投入生产。

供电数据中心壳体成为主要瓶颈
关于当前瓶颈,Brannin明确指向powered shells,即具备供电条件的数据中心壳体,更准确地说,是这些壳体内部的组件。他确认电工也是复杂领域中的关键环节。CoreWeave目前已有49个这样的站点上线并运行,并不是把希望押在一两个站点上。Brannin称,这构成了深厚的执行记录,也让公司积累了处理供应链问题的知识,知道哪些供应商适合合作,哪些供应商不适合合作。
谈到HBM内存成本和短缺,Nick表示,CoreWeave的商业模式是在签署GPU采购订单、确定自身成本的同时,锁定向客户收取的GPU价格;更广义地说,是锁定服务器价格,而服务器价格包含HBM成本。他表示,目前获取组件并不是最大的瓶颈,最大的瓶颈仍是powered shell,但未来某些时候,这个答案会来回变化。

对于Vera Rubin部署节奏,Nick表示,CoreWeave显然是全球第一家启动并全面验证VR即Vera Rubin机柜的公司,去年在GB200、GB300上也是如此。他预计VR会在今年晚些时候开始出现,真正大规模、强劲的部署爬坡会贯穿整个2027年。他将这一节奏与GB类比:GB在2025年开始出现,但真正大规模爬坡贯穿整个2026年;去年年底已经部署不少,而今年才是GB真正大规模部署的一年。Nick预计,未来12到18个月里,VR会呈现非常相似的节奏。

