Kimi研究员质疑NaiveAI:2000 tok/s不足以证明「AI造AI」

Kimi研究员质疑NaiveAI:2000 tok/s不足以证明「AI造AI」

N
News Editor
2026-09-28 08:35:57
NaiveAI发布首款模型N0.5-Flash,并以「AI参与研发AI」作为主要卖点,称模型参与了架构设计、代码编写和推理优化,官方披露单流推理峰值为2122 tok/s。随后,月之暗面研究员杨新宇公开提出质疑,认为2000 tok/s本身并不稀奇,NaiveAI选取的对比基线偏弱;他也不认同其对架构创新的表述,称这更像是在现有底模基础上的工程取舍,尚未证明「AI参与研发」带来了人类团队做不到的突破。

NaiveAI发布首款模型 N0.5-Flash,并将「AI 参与研发 AI」作为宣传重点,称该模型参与了架构设计、代码编写和推理优化。公司公布的单流推理峰值为 2122 tok/s。

随后,月之暗面研究员杨新宇公开质疑这一说法。他表示,2000 tok/s 本身完全可能做到,但 NaiveAI 选取的对比基线较弱。按照他的说法,NaiveAI 拿 SGLang 的 300 多 tok/s 作为参照,而小米此前已让参数更大的 MiMo-V2.5-Pro 跑到 1000 tok/s 以上,因此基线较低时,最终呈现出的提升幅度会更显眼。

杨新宇也不认可 NaiveAI 对架构创新的描述。根据公开信息,N0.5-Flash 是在小米 MiMo-V2.5 Base 基础上改造而来,将原有的全局注意力替换为 DSA,最终采用 DSA + GQA 方案。

他认为,这更接近于基于现有底模做出的工程取舍,而且还会损失 GPU 利用率,难称明显的架构突破。杨新宇的判断是,NaiveAI 证明了模型可以通过继续训练和工程优化提速,但截至目前,还没有证明「AI 参与研发」本身带来了人类团队做不到的突破。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
200

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。