2026年6月1日,在COMPUTEX 2026期间的NVIDIA GTC Taipei大会上,英伟达创始人兼CEO黄仁勋发表主题演讲。距离上一场圣何塞GTC仅三个月,英伟达在当时发布了涵盖Vera CPU、Rubin GPU、Groq 3 LPU等六颗芯片的“芯片全家桶”,旨在训练大型MoE模型。而这一次,黄仁勋将目光从系统级算力基础设施投向了它们服务的核心——智能体(Agent)。他在演讲中宣告:“Agent AI和实用型人工智能时代已经到来。现在token是利润单位,AI是GDP‘生成器’,软件工程师的数量正在增加。人们谈论AI减少了工作岗位,这完全是胡说八道,实际上有更多的软件工程师正在被雇用。”

黄仁勋透露,Vera Rubin平台已正式进入量产,Vera CPU开始向全球交付,DGX Station第一次以Windows形态走进企业桌面,Cosmos 3重构物理AI的感知框架,DSX成为AI工厂的运营操作系统,并联合宇树发布了首款基于Isaac GR00T的人形机器人参考设计H2 Plus。英伟达正在围绕Agent生态,重新组织从芯片、数据中心、模型、软件到机器人平台的完整技术体系。

Vera Rubin:为Agent而生的量产平台
与过去主要面向大模型训练和推理不同,Vera Rubin从设计之初就将Agent作为重点工作负载。一个Agent任务往往不只包含一次模型推理,而是涉及推理、搜索、工具调用、代码执行和结果验证等数千个步骤。未来数据中心需要处理的不再只是单个模型请求,更多的是大量持续运行、相互协作的Agent任务。该平台被定义为巨大的统一计算单元级AI超级计算机,专门处理智能体工作负载。在相同规模的数据中心里,Vera Rubin运行自主AI Agent任务的效率是上一代Grace Blackwell平台的10倍。
网络层面,英伟达在Vera Rubin中引入Spectrum-X Ethernet Photonics网络系统,首次将共封装光学(CPO)技术大规模用于AI数据中心网络,把光学器件集成到交换机内部以降低能耗和信号损失。平台还将机密计算能力扩展至整个系统,通过可信执行环境、硬件级验证和端到端加密机制,保障私有数据与敏感模型的安全。Vera Rubin涉及超过150家合作伙伴、350多座工厂,将于今年秋季开始正式出货。

Vera CPU:为智能体而生的处理器
黄仁勋指出,过去所有CPU都是为人类设计的,而Vera是为Agent打造的CPU。作为Grace的继任者,Vera采用自研“Olympus”核心架构,核心数量从72个增至88个,大幅提升内存和数据处理能力,在Agent相关负载测试中任务执行速度达到同期x86服务器CPU的1.8倍。Vera通过第二代NVLink-C2C与Rubin GPU连接,互联带宽达1.8TB/s,使Agent在CPU与GPU间的数据传递开销进一步降低。黄仁勋还透露,Vera Rubin采用美光、SK海力士和三星的HBM,部署一个大型Blackwell机架需要两小时,而Vera Rubin可压缩到5分钟级别。
DGX Station与RTX Spark SoC:让Agent进入桌面和笔记本
英伟达发布了面向Windows生态的桌面级AI超算DGX Station for Windows,搭载GB300 Grace Blackwell Ultra Desktop Superchip,最高748GB统一内存与20 PFLOPS FP4性能,并配备最高800Gb/s网络。企业可在本地安全环境中运行多个Agent,并通过OpenShell实施隔离沙箱与策略控制,防止Agent越权或泄露凭证。同时,英伟达发布了系统级SoC——RTX Spark SoC,将自研与微软共同打造的N1X CPU(Arm架构,由联发科定制,台积电3纳米工艺)和Blackwell GPU集成于同一芯片,专为轻薄笔记本设计。今秋首发超过30款机型,由微软、戴尔、惠普、华硕、联想和微星等品牌推出。

DSX:AI工厂的设计、仿真与运营蓝图
DSX被定义为一套“AI工厂建设和运营工具箱”,将服务器、网络、电力、冷却和运维等环节统一到一个框架内。其中DSX MaxLPS结合液冷与机架内功耗优化,可在固定电力预算下多运行最多40%的GPU;DSX OS负责AI工厂的生命周期管理、智能调度、健康监测、故障恢复和多租户运营。此外,Reference Design提供参考设计,DSX Sim支持建设前仿真,DSX Flex连接电网进行任务调度,DSX Exchange打通IT与运营数据。CoreWeave、Crusoe、Lambda等合作伙伴正部署这些组件;戴尔、HPE、联想、SuperMicro以及华硕、富士康、技嘉等制造商正构建支持DSX的系统。
Nemotron 3 Ultra与NemoClaw:构建企业的数字同事
英伟达发布了拥有5500亿参数的混合专家模型Nemotron 3 Ultra,为长效智能体提供顶尖的推理能力,推理速度较同级开源模型最高提升5倍,使用成本降低30%。围绕该模型,NemoClaw提供Agent编排、上下文、记忆与工具调用能力,OpenShell负责运行时安全,Agent Toolkit将CUDA-X等英伟达库转化为Agent可直接调用的工具。这套组合让企业在工程设计、医疗健康、软件开发等场景中构建“数字同事”,让Agent在受控环境中协助员工完成复杂任务。

Cosmos 3:首个统一多模态与动作预测的世界模型
Cosmos 3是面向物理AI的世界基础模型,采用全新混合Transformer架构,首次将视觉推理、世界生成和动作预测统一到一个系统中。它能原生理解并生成文本、图像、视频、环境声音和动作,是全球首个完全开放的全能模型,有望将物理AI的训练和评估周期从数月压缩到数天。黄仁勋预测,得益于多模态推理等突破,物理AI的大爆炸即将来临。
H2 Plus人形机器人样板与开源物理AI技能
英伟达与宇树联合发布全球首款基于Isaac GR00T的人形机器人参考设计H2 Plus。宇树负责本体,英伟达提供软件与计算平台,预先整合软硬件,让研究团队跳过底层对接直接进行技能开发。英伟达还开源了一套物理AI Skills工具集,将Cosmos、Omniverse、Isaac、Metropolis等平台的操作标准化为Agent可执行的指令,实现从任务触发、模型调用到结果验证的全流程自动化。

BlueField-4 STX:为Agent数据路径加密
在Vera BlueField-4 STX基础上,英伟达新增安全能力,应对Agent在企业系统中无人监督持续读写、跨系统共享信息带来的数据越权风险。STX平台利用统一的DOCA安全软件与芯片内硬件策略执行,实时检查和管控Agent、数据与上下文记忆之间的互动,实现数据的全程保护。黄仁勋强调:“智能体把企业数据变成了实时、活生生的系统,这个系统必须在数据移动之处、上下文存储之处、智能体行动之处都得到保护。”
台积电:从代工伙伴到双向依存
英伟达与台积电合作近三十年,如今关系正发生微妙变化:台积电正利用英伟达AI和加速计算改善自身晶圆厂的周转时间、能效、良率与运营生产力。黄仁勋表示:“台积电正在将英伟达的AI和加速计算引入晶圆厂内部,通过仿真、优化和AI应对全球最复杂的设计和制造挑战。”两者的关系已从单向的甲乙方演变为双向的相互依存。

回看整场发布会,英伟达围绕Agent勾勒出完整蓝图:Vera CPU调度任务,Vera Rubin提供算力,BlueField-4 STX守护数据安全,Cosmos 3赋予物理感知,Nemotron+NemoClaw+OpenShell实现Agent组织与约束,DGX Station让Agent进入员工桌面,H2 Plus赋予Agent身体,DSX和Skills实现批量生产与部署。黄仁勋试图描绘一个新的计算时代——Agent成为AI基础设施,而英伟达出现在每一层。

