英伟达将开源AI模型发布周期缩短至4-6周
英伟达副总裁 Bryan Catanzaro 透露,Nemotron 系列开源权重 AI 模型的发布周期由 6-8 个月缩短至每 4-6 周,得益于合成数据生成、多教师蒸馏(MOPD)与强化学习环境等工具链进步。最新版 Nemotron 3.5 Lightning 于 8 月 11 日上线,采用 Mamba 与 Transformer 混合架构。模型开放权重且附带训练配方与数据集,旨在推动推理芯片与软件平台需求。

英伟达副总裁 Bryan Catanzaro 透露,Nemotron 系列开源权重 AI 模型的发布周期由 6-8 个月缩短至每 4-6 周,得益于合成数据生成、多教师蒸馏(MOPD)与强化学习环境等工具链进步。最新版 Nemotron 3.5 Lightning 于 8 月 11 日上线,采用 Mamba 与 Transformer 混合架构。模型开放权重且附带训练配方与数据集,旨在推动推理芯片与软件平台需求。

AI 芯片初创公司 Etched 宣布完成 3 亿美元 C 轮融资,投后估值达到 103 亿美元,由红杉资本领投。公司去年 12 月刚以 50 亿美元估值完成 5 亿美元融资,7 个月内估值翻倍。Etched 表示其首款芯片已由台积电制造,首批完整系统正由客户测试,目前已锁定 10 亿美元订单。

英伟达发布开源多模态模型Nemotron 3 Nano Omni,单模型统一处理视频、音频、图像和文本,专为AI代理设计。30B参数混合专家架构,视频推理性能提升9.2倍,权重、数据集和微调配方全公开。

英伟达发布开源旗舰模型 Nemotron 3 Ultra,面向长时间运行的 AI 代理与多代理工作流,主打 5500 亿总参数、最高 5 倍吞吐量提升及最高 30% 成本下降。

英伟达推出Nemotron 3 Super,这是一款1200亿总参数开源混合模型,单次前向仅激活127亿参数,瞄准AI代理场景下的推理吞吐与成本问题。

OpenRouter最新数据显示,中国开源模型占据平台约61%的token消耗,DeepSeek、GLM等模型在价格与性能上逼近美国前沿模型,差距稳定在3-6个月且未扩大。

英伟达推出开源AI模型Nemotron 3 Super,总参数达1200亿,但单次前向仅激活127亿,主打降低智能体工作负载推理成本,并称在特定场景下吞吐量最高较Qwen3.5-122B提升7.5倍。

英伟达发布Nemotron 3 Super,120B参数MoE开源模型,激活仅12.7B参数,实现7.5倍吞吐提升,支持1M上下文,专为AI Agent优化,完全开放许可。
