智谱发布轻量级旗舰模型 GLM-5.3 Flash,称其对标 DeepSeek V4 Flash,并调用超过 10 万张国产芯片集群提供推理服务。
参数规模与模型结构
据介绍,GLM-5.3 Flash 的参数规模约为 300B,约为 GLM-5.3 的 40%,与 DeepSeek V4 Flash 基本持平。该模型采用 MoE 架构,实际激活参数约 18B。
支持图像和视频输入
GLM-5.3 Flash 具备原生多模态能力,支持图像与视频输入。这也是智谱聚焦 coding 战略后,首个具备多模态能力的新模型。
评测成绩与定价
智谱称,GLM-5.3 Flash 的综合评测分数超过上一代旗舰 GLM-5.2,与 Claude Opus 4.8 持平,并高于 DeepSeek V4 Pro 正式版相关分数。
定价方面,该模型每百万 token 输入 0.8 元、输出 2.8 元、缓存命中 0.23 元,约为 GLM-5.3 的十分之一。上线前两周,模型提供半价优惠。
国产算力适配与测试代号
智谱表示,GLM-5.3 Flash 已实现全栈适配国产算力,线上流量由国产芯片承接。该公司称,集群硬件效率及单位 token 成本已达到与主流英伟达 GPU 相当的水平。
此外,该模型此前曾以代号 Ox Alpha 在海外平台匿名测试。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

