NaiveAI发布首款模型 N0.5-Flash,并将「AI 参与研发 AI」作为宣传重点,称该模型参与了架构设计、代码编写和推理优化。公司公布的单流推理峰值为 2122 tok/s。
随后,月之暗面研究员杨新宇公开质疑这一说法。他表示,2000 tok/s 本身完全可能做到,但 NaiveAI 选取的对比基线较弱。按照他的说法,NaiveAI 拿 SGLang 的 300 多 tok/s 作为参照,而小米此前已让参数更大的 MiMo-V2.5-Pro 跑到 1000 tok/s 以上,因此基线较低时,最终呈现出的提升幅度会更显眼。
杨新宇也不认可 NaiveAI 对架构创新的描述。根据公开信息,N0.5-Flash 是在小米 MiMo-V2.5 Base 基础上改造而来,将原有的全局注意力替换为 DSA,最终采用 DSA + GQA 方案。
他认为,这更接近于基于现有底模做出的工程取舍,而且还会损失 GPU 利用率,难称明显的架构突破。杨新宇的判断是,NaiveAI 证明了模型可以通过继续训练和工程优化提速,但截至目前,还没有证明「AI 参与研发」本身带来了人类团队做不到的突破。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

