OpenAI、Meta 与 SpaceXAI 加码模型效率竞赛
OpenAI、Meta 与 SpaceXAI 正推动更高效的 AI 模型研发,以降低训练和推理成本,并对 Anthropic 等竞争对手形成压力。当前 AI 行业进入效率竞赛阶段,头部实验室正通过架构优化和工程改进,在维持模型性能的同时压缩算力开销。Cointelegraph 称,高效推理技术正成为下一阶段的重要竞争点。

OpenAI、Meta 与 SpaceXAI 正推动更高效的 AI 模型研发,以降低训练和推理成本,并对 Anthropic 等竞争对手形成压力。当前 AI 行业进入效率竞赛阶段,头部实验室正通过架构优化和工程改进,在维持模型性能的同时压缩算力开销。Cointelegraph 称,高效推理技术正成为下一阶段的重要竞争点。

DeepSeek发布基于视觉原语的多模态AI技术,通过边界框和点作为基本推理单元,大幅提升空间推理准确率,降低token消耗。该技术有望赋能加密领域的AI代理、DePIN和自动驾驶等场景。

英伟达据称以200亿美元收购AI芯片公司Groq,创下其最大规模并购。交易若成行,将把Groq的LPU技术纳入英伟达版图,进一步强化其在AI硬件市场的主导地位,并可能影响AI与加密产业的算力成本和生态格局。

Broadcom AI收入同比增106%,预告2027年芯片营收超千亿美元。其定制ASIC芯片与英伟达GPU路线不同,有望降低AI推理成本,间接影响加密矿机竞争与能源效率。

DeepSeek 在扩大招聘之际,清华大学 2021 级博士生顾煜贤已正式加入公司。公开资料显示,他曾获清华研究生特等奖学金、苹果博士奖学金和蚂蚁 In-Tech 奖学金,研究重点覆盖预训练数据筛选、知识蒸馏和高效模型架构。其代表工作包括 MiniLLM、MiniPLM 和 Jet-Nemotron,论文发表于 NeurIPS、ICLR、ACL 等顶会,部分方法已被谷歌、阿里和英伟达等采用。

Multiverse Computing 发布了基于 Nvidia Nemotron 架构的 Pulsar 16B 推理模型,拥有 161.5 亿参数但仅激活约 31 亿参数,采用 CompactifAI 压缩技术,在 Blackwell GPU 上每秒可处理 4808 个 token。模型以 Apache 2.0 开源许可发布,支持商业用途。公司成立于 2019 年,去年完成 2.15 亿美元 B 轮融资,曾与加拿大央行合作将量子计算应用于金融模拟。该模型有望推动 AI 推理在加密和金融领域的低成本部署。
