Techub News 消息,英伟达宣布,Groq 3 LPX 推理芯片已进入全面生产阶段,并在 Gemma 4 31B 模型上实现每秒 3400 token 的推理速度。
英伟达称,这一速度比 Cerebras 快 4 倍。不过,报道指出,实际性能对比更为复杂:英伟达至少需要 64 个加速器才能达到这一速度,而 Cerebras 仅需 1 至 2 个。
报道还提到,该架构在大型 MoE 模型上的扩展能力仍有待观察。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

