黄仁勋抛出“Token经济学”:NVIDIA量产Vera Rubin,台湾AI算力需求猛增
黄仁勋在GTC Taipei 2026表示,AI数据中心正从卖硬件转向“算力即营收”。他称Vera Rubin已全面量产,配合Groq解耦推理后,1GW数据中心年营收可达3000亿美元。

黄仁勋在GTC Taipei 2026表示,AI数据中心正从卖硬件转向“算力即营收”。他称Vera Rubin已全面量产,配合Groq解耦推理后,1GW数据中心年营收可达3000亿美元。

Google在Cloud Next 2026发布第八代TPU,首次将训练与推理分拆至TPU 8t和TPU 8i两款专用芯片。TPU 8i每美元推理性能较前代提升80%,直接压低保推理成本。Anthropic、OpenAI已开始采用TPU集群。

AMD 推出面向 AI 工作负载的全堆叠机架方案 Helios,Futurum 基于 BOM 成本估算其单架售价约为 500 万至 550 万美元,高于英伟达第二代 Vera Rubin 机架预估的 350 万至 400 万美元。Helios 集成 GPU、CPU、AI NIC、DPU、互连和 ROCm 软件平台,微软 Azure 已确认首发部署,OpenAI、Meta、Oracle 等也出现在客户名单中。规格上,Helios 在 FP8 算力和 HBM4 容量上占优,Rubin 则在 FP4 算力和内存带宽上更高。

开放式 AI 实验室 Prime Intellect 宣布完成 1.3 亿美元 A 轮融资,累计融资总额超过 1.5 亿美元。本轮由 Radical Ventures 领投,NVIDIA Ventures、Intel Capital、Dell Technologies Capital 参投。公司称,这笔资金将用于建设开放式超级智能技术栈,推进去中心化 AI 架构,并扩展强化学习、递归语言模型与训练部署一体化基础设施。

BitMEX联合创始人Arthur Hayes预测以太坊2030年可能跌出前三,被AI代币取代。同时英国政府与Anthropic谈判部署AI安全模型,Mantle提议向Aave DAO借出3万ETH以缓解跨链桥攻击造成的坏账。

Cursor 3.1发布Canvas功能,AI Agent不仅能输出代码,还能直接生成图表、表格等交互式React界面,提升信息密度与工作效率。该功能支持自定义扩展,已大幅缩短模型部署时的排故时间。

英特尔在Hugging Face推出三款阿里Wan2.2视频模型INT4量化版本(T2V-A14B、I2V-A14B、TI2V-5B),通过AutoRound工具将权重从BF16压缩至INT4,显存占用降至原四分之一,有望降低视频生成部署门槛,但尚需第三方验证性能。

Anthropic已限制Claude Pro和Max订阅通过第三方代理框架调用,Openclaw率先受影响。加密开发者面临从包月转向按量计费,极端情况下单日成本或达数千美元。
