智谱披露,公司目前已经实现 10 万级国产芯片的规模化低成本推理,单位 Token 推理成本较年初下降 80%。
这批国产算力此前已经露面。智谱发布 GLM-5.3-Flash 时曾确认,该模型的全部线上流量由 10 万张国产芯片承载。
在正式发布前,匿名模型 Ox-Alpha 在 OpenRouter、OpenCode 上进行大规模测试时,同样运行在这批国产算力上。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

智谱披露,公司目前已经实现 10 万级国产芯片的规模化低成本推理,单位 Token 推理成本较年初下降 80%。
这批国产算力此前已经露面。智谱发布 GLM-5.3-Flash 时曾确认,该模型的全部线上流量由 10 万张国产芯片承载。
在正式发布前,匿名模型 Ox-Alpha 在 OpenRouter、OpenCode 上进行大规模测试时,同样运行在这批国产算力上。
免责声明:
本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。
加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。