智谱发布 GLM-5.3 Flash,称推理集群调用超 10 万张国产芯片

智谱发布 GLM-5.3 Flash,称推理集群调用超 10 万张国产芯片

N
News Editor
2026-08-27 00:47:05
智谱发布轻量级旗舰模型 GLM-5.3 Flash,称其对标 DeepSeek V4 Flash,并由超过 10 万张国产芯片集群提供推理服务。该模型参数规模约 300B,采用 MoE 架构,实际激活参数约 18B,支持图像与视频输入。智谱表示,其综合评测分数超过上一代旗舰 GLM-5.2,与 Claude Opus 4.8 持平,并高于 DeepSeek V4 Pro 正式版相关分数。

智谱发布轻量级旗舰模型 GLM-5.3 Flash,称其对标 DeepSeek V4 Flash,并调用超过 10 万张国产芯片集群提供推理服务。

参数规模与模型结构

据介绍,GLM-5.3 Flash 的参数规模约为 300B,约为 GLM-5.3 的 40%,与 DeepSeek V4 Flash 基本持平。该模型采用 MoE 架构,实际激活参数约 18B。

支持图像和视频输入

GLM-5.3 Flash 具备原生多模态能力,支持图像与视频输入。这也是智谱聚焦 coding 战略后,首个具备多模态能力的新模型。

评测成绩与定价

智谱称,GLM-5.3 Flash 的综合评测分数超过上一代旗舰 GLM-5.2,与 Claude Opus 4.8 持平,并高于 DeepSeek V4 Pro 正式版相关分数。

定价方面,该模型每百万 token 输入 0.8 元、输出 2.8 元、缓存命中 0.23 元,约为 GLM-5.3 的十分之一。上线前两周,模型提供半价优惠。

国产算力适配与测试代号

智谱表示,GLM-5.3 Flash 已实现全栈适配国产算力,线上流量由国产芯片承接。该公司称,集群硬件效率及单位 token 成本已达到与主流英伟达 GPU 相当的水平。

此外,该模型此前曾以代号 Ox Alpha 在海外平台匿名测试。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
190

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。