返回高效推理

高效推理

OpenAI
2026-07-13 06:18:58

OpenAI、Meta 与 SpaceXAI 加码模型效率竞赛

OpenAI、Meta 与 SpaceXAI 正推动更高效的 AI 模型研发,以降低训练和推理成本,并对 Anthropic 等竞争对手形成压力。当前 AI 行业进入效率竞赛阶段,头部实验室正通过架构优化和工程改进,在维持模型性能的同时压缩算力开销。Cointelegraph 称,高效推理技术正成为下一阶段的重要竞争点。

1040
OpenAI、Meta 与 SpaceXAI 加码模型效率竞赛
2026-07-07 01:29:18

英伟达200亿美元收购Groq,AI芯片霸权再度升级

英伟达据称以200亿美元收购AI芯片公司Groq,创下其最大规模并购。交易若成行,将把Groq的LPU技术纳入英伟达版图,进一步强化其在AI硬件市场的主导地位,并可能影响AI与加密产业的算力成本和生态格局。

330
英伟达200亿美元收购Groq,AI芯片霸权再度升级
DeepSeek
2026-07-06 03:29:56

清华特奖博士顾煜贤加入 DeepSeek,研究聚焦大模型效率优化

DeepSeek 在扩大招聘之际,清华大学 2021 级博士生顾煜贤已正式加入公司。公开资料显示,他曾获清华研究生特等奖学金、苹果博士奖学金和蚂蚁 In-Tech 奖学金,研究重点覆盖预训练数据筛选、知识蒸馏和高效模型架构。其代表工作包括 MiniLLM、MiniPLM 和 Jet-Nemotron,论文发表于 NeurIPS、ICLR、ACL 等顶会,部分方法已被谷歌、阿里和英伟达等采用。

240
清华特奖博士顾煜贤加入 DeepSeek,研究聚焦大模型效率优化
Multiverse Co
2026-06-27 16:40:57

Multiverse Computing 推出 Pulsar 16B 开源推理模型:161亿参数仅激活31亿,Blackwell GPU吞吐量达4808 tokens/s

Multiverse Computing 发布了基于 Nvidia Nemotron 架构的 Pulsar 16B 推理模型,拥有 161.5 亿参数但仅激活约 31 亿参数,采用 CompactifAI 压缩技术,在 Blackwell GPU 上每秒可处理 4808 个 token。模型以 Apache 2.0 开源许可发布,支持商业用途。公司成立于 2019 年,去年完成 2.15 亿美元 B 轮融资,曾与加拿大央行合作将量子计算应用于金融模拟。该模型有望推动 AI 推理在加密和金融领域的低成本部署。

310
Multiverse Computing 推出 Pulsar 16B 开源推理模型:161亿参数仅激活31亿,Blackwell GPU吞吐量达4808 tokens/s