Techub News 消息,Z.ai 发布 GLM-5.3-Flash。该模型是 GLM-5 系列首个原生多模态模型,Z.ai 将其称为实验室推出的最具性价比的编程模型。
从配置看,GLM-5.3-Flash 采用混合专家架构,总参数量为 3200 亿,每个令牌激活 180 亿参数,上下文窗口达到 1,048,576 个令牌,同时支持图像和视频输入。
发布方式上,该模型采用 MIT 许可证,权重已经上传至 Hugging Face。Z.ai 称,GLM-5.3-Flash 在基准测试和实际工作负载中均优于 GLM-5.2,价格约为后者的十分之一;在其内部编程基准测试中,与 Claude Opus 4.8 的差距在半个百分点以内。
Z.ai 还表示,这一模型在首周预览阶段以「Ox Alpha」匿名身份运行于 OpenCode 和 OpenRouter 上,服务完全基于国产中国 AI 芯片提供。
目前,GLM-5.3-Flash 已提供 Hugging Face 权重和托管 API 服务。默认 FP8 检查点权重约为 306 GiB,当前 vLLM 路径仅支持 NVIDIA Hopper 及更新架构。这也意味着,中型和大型组织,以及租用 GPU 容量的 AI 原生初创公司,可以选择自行托管该模型。
上述消息由 MarkTechPost 提及。
本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.

