Z.ai 推出 GLM-5.3-Flash,支持百万令牌上下文与多模态输入

Z.ai 推出 GLM-5.3-Flash,支持百万令牌上下文与多模态输入

N
News Editor
2026-08-26 21:43:35
Z.ai 发布 GLM-5.3-Flash,称其为 GLM-5 系列首个原生多模态模型,也是实验室最具性价比的编程模型。该模型采用混合专家架构,总参数量 3200 亿,每个令牌激活 180 亿参数,支持 1,048,576 个令牌上下文、图像和视频输入,并以 MIT 许可证开源,权重已上传至 Hugging Face。

Techub News 消息,Z.ai 发布 GLM-5.3-Flash。该模型是 GLM-5 系列首个原生多模态模型,Z.ai 将其称为实验室推出的最具性价比的编程模型。

从配置看,GLM-5.3-Flash 采用混合专家架构,总参数量为 3200 亿,每个令牌激活 180 亿参数,上下文窗口达到 1,048,576 个令牌,同时支持图像和视频输入。

发布方式上,该模型采用 MIT 许可证,权重已经上传至 Hugging Face。Z.ai 称,GLM-5.3-Flash 在基准测试和实际工作负载中均优于 GLM-5.2,价格约为后者的十分之一;在其内部编程基准测试中,与 Claude Opus 4.8 的差距在半个百分点以内。

Z.ai 还表示,这一模型在首周预览阶段以「Ox Alpha」匿名身份运行于 OpenCode 和 OpenRouter 上,服务完全基于国产中国 AI 芯片提供。

目前,GLM-5.3-Flash 已提供 Hugging Face 权重和托管 API 服务。默认 FP8 检查点权重约为 306 GiB,当前 vLLM 路径仅支持 NVIDIA Hopper 及更新架构。这也意味着,中型和大型组织,以及租用 GPU 容量的 AI 原生初创公司,可以选择自行托管该模型。

上述消息由 MarkTechPost 提及。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
2300

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。