返回GPT-OSS

GPT-OSS

OpenAI
2026-08-26 04:52:38

OpenAI称Jalapeño实测胜过英伟达GB300,但量产与对比条件仍有限制

OpenAI芯片负责人 Richard Ho 在斯坦福 Hot Chips 大会上表示,与 Broadcom 合作开发的推理芯片 Jalapeño 在实测中于功耗效率和响应速度上超过英伟达 GB300。该芯片今年 6 月发布,128 芯片系统提供 1.7 exaFLOPS 的 4 位算力,并配备 27.5 TB HBM4。彭博指出,这组成绩未与新一代 Vera Rubin 对比,且测试排除了推测解码,Jalapeño 目前也未披露实际功耗,2026 年仅有限量供应。

00
OpenAI称Jalapeño实测胜过英伟达GB300,但量产与对比条件仍有限制
Multiverse Co
2026-08-26 02:19:31

Multiverse Computing 将 GPT-OSS 压缩至 600 亿参数

Multiverse Computing 研究人员开发出一项名为 Quantization-Aware Healing 的新技术,将 GPT-OSS 模型从 1200 亿参数压缩至 600 亿参数。研究团队称,压缩版在九项测试中有七项表现超过完整版,同时还能降低模型运行所需的内存、电力和计算资源。该消息由 Techub 援引 CryptoBriefing 披露。

00
Multiverse Computing 将 GPT-OSS 压缩至 600 亿参数
人工智能
2026-08-25 20:46:03

研究团队将 AI 模型缩至 600 亿参数后性能反超同级版本

一组研究人员公布称,他们把 GPT-OSS 120B 压缩为 600 亿参数、4-bit 量化模型后,得到的版本在多数对比基准中优于同为 600 亿参数的全精度版本。论文将这一方法称为「量化感知修复」,核心做法是让小模型直接对齐未压缩的大模型输出,而不是学习已被压缩过的中间版本。团队已将 Hypernova-60B 以开放权重形式发布到 Hugging Face,但生成该模型的压缩工具仍属专有,测试范围也仅覆盖 GPT-OSS。

30
研究团队将 AI 模型缩至 600 亿参数后性能反超同级版本
OpenAI
2026-08-25 16:14:28

分析称 OpenAI Jalapeño 扩产或受三星 HBM4 供应掣肘

Citrini 分析师 Jukan 表示,OpenAI 自研 AI 芯片「Jalapeño」在扩展规模上可能难以达到英伟达 Rubin 平台的水平。其判断依据是,若 HBM4 高带宽内存完全依赖三星供应,产能爬坡会存在上限。Jukan 还称,OpenAI 若想继续扩大部署规模,可能需要放宽 HBM4 传输速度等规格要求,以便引入其他供应商产品,缓解供应链限制。

10
分析称 OpenAI Jalapeño 扩产或受三星 HBM4 供应掣肘