返回GPT-OSS

GPT-OSS

人工智能
2026-08-25 20:46:03

研究团队将 AI 模型缩至 600 亿参数后性能反超同级版本

一组研究人员公布称,他们把 GPT-OSS 120B 压缩为 600 亿参数、4-bit 量化模型后,得到的版本在多数对比基准中优于同为 600 亿参数的全精度版本。论文将这一方法称为「量化感知修复」,核心做法是让小模型直接对齐未压缩的大模型输出,而不是学习已被压缩过的中间版本。团队已将 Hypernova-60B 以开放权重形式发布到 Hugging Face,但生成该模型的压缩工具仍属专有,测试范围也仅覆盖 GPT-OSS。

20
研究团队将 AI 模型缩至 600 亿参数后性能反超同级版本
OpenAI
2026-08-25 16:14:28

分析称 OpenAI Jalapeño 扩产或受三星 HBM4 供应掣肘

Citrini 分析师 Jukan 表示,OpenAI 自研 AI 芯片「Jalapeño」在扩展规模上可能难以达到英伟达 Rubin 平台的水平。其判断依据是,若 HBM4 高带宽内存完全依赖三星供应,产能爬坡会存在上限。Jukan 还称,OpenAI 若想继续扩大部署规模,可能需要放宽 HBM4 传输速度等规格要求,以便引入其他供应商产品,缓解供应链限制。

00
分析称 OpenAI Jalapeño 扩产或受三星 HBM4 供应掣肘
2026-07-08 02:32:15

DeepSeek R1追平Claude Mythos漏洞检测实力:低成本模型挑战AI安全层级

AI安全公司AISLE测试显示,DeepSeek R1在关键漏洞检测中与Anthropic的Mythos表现持平,甚至更便宜的模型也能发现相同漏洞。测试揭示了FreeBSD和OpenBSD中潜伏17年和27年的严重缺陷。结果表明AI安全性能更依赖工作流整合,而非模型成本,对加密市场有深远影响。

160
DeepSeek R1追平Claude Mythos漏洞检测实力:低成本模型挑战AI安全层级