智谱天猫上架 GLM 套餐,AI 公司开始按 Token 更严控量

智谱天猫上架 GLM 套餐,AI 公司开始按 Token 更严控量

N
News Editor
2026-09-06 00:54:00
智谱 9 月 2 日在天猫开设官方旗舰店,销售基于 GLM-5.3 的 GLM Coding Plan,个人版 Lite、Pro、Max 分别定价 118 元、538 元和 1078 元。公司同时调整老套餐,原「不限周额度」方案停止自动续订。报道指出,随着单位 Token 推理成本下降,AI 公司却更重视用量控制;智谱半年报显示,2026 年上半年 MaaS 开放平台及 API 业务收入达 8.25 亿元,占总营收 86.5%,商业模式正从卖模型转向卖调用、卖订阅与卖任务结果。

智谱把 AI 使用额度摆上了电商货架。9 月 2 日,智谱正式入驻天猫,开设官方旗舰店,并上架 GLM Coding Plan。个人版 Lite 月付 118 元、Pro 月付 538 元、Max 月付 1078 元,对应不同积分额度;产品基于 GLM-5.3,并适配 ZCode、Claude Code、Codex 等 20 余款主流 Agent。

智谱天猫上架 GLM 套餐,AI 公司开始按 Token 更严控量 2

几个月前,AI 编程市场还在比谁的套餐更便宜,现在比较的重点已经变成了另一件事:用户到底能用多少 Token。

老套餐退场,限量成为新方向

据报道,有用户收到智谱公告,此前使用数月的老套餐将下线。原先「不限周额度」的 GLM Coding Plan 将停止自动续订,智谱向老用户补偿两个月新套餐。

在这次产品调整之外,更值得关注的是行业变化本身:Token 越来越便宜,AI 公司却越来越在意用户消耗了多少 Token。

过去几个月,类似动作已经在多家公司出现。Kimi 曾因算力压力暂停 C 端新用户订阅。7 月 19 日,月之暗面公告称,Kimi K3 上线后请求量大幅超出预期,已逼近现有集群承载极限,因此暂停 C 端新用户订阅,把算力优先留给已付费用户。

阿里云也在调整 Coding Plan。其 Lite 套餐自 3 月 20 日起停止新购,4 月 13 日起停止续费和升级。腾讯云则在 3 月调整部分混元模型价格,其中 HY2.0 Instruct 输入价格从每千 Token 0.0008 元提高到 0.004505 元,涨幅超过 460%。

Token 降价,不等于 AI 使用成本下降

过去 20 年,互联网产品常见的一条逻辑是,数字化之后边际成本持续下降。手机流量是典型例子:在基站、光纤和网络基础设施建成后,多传 1GB 数据的边际成本很低,随着基础设施规模扩大,流量价格一路下行。

智谱天猫上架 GLM 套餐,AI 公司开始按 Token 更严控量 3

很多人因此把同样的判断套到 AI 上:芯片越来越强,模型越来越高效,单位 Token 的推理成本越来越低,AI 也理应越来越便宜。

报道认为,这个判断前半部分没有问题。智谱披露,随着模型架构和推理基础设施持续优化,其单位 Token 推理成本较年初下降 80%,目前已实现 10 万级国产芯片规模化低成本推理。

但问题在于,Token 虽然更便宜了,消耗速度却增长得更快。Token 不是普通数据流量。一枚 Token 背后对应的是模型推理所消耗的计算资源,包括 GPU 或 AI 加速芯片、高带宽内存、网络、存储,以及数据中心里的电力和散热。换句话说,Token 更像是 AI 算力被计量、被交易的单位。

当模型只是陪用户聊天时,一次调用可能只需要几百、几千 Token;可一旦 AI 被用于完成复杂任务,消耗结构就完全不同。

智谱半年报显示收入重心转向 MaaS 与 API

智谱最新半年报把这种变化直接体现在财务数据中。2026 年上半年,智谱实现营收 9.54 亿元,同比增长 399.7%。其中,MaaS 开放平台及 API 业务收入达到 8.25 亿元,同比增长 2735.7%,占总收入的 86.5%。

而在去年同期,这一比例仅为 15.2%。与此同时,本地化部署收入占比从 84.8% 降至 13.5%。一年时间里,智谱的商业模式几乎完成了一次切换。

过去,客户买的是模型本身,模型部署在企业自己的服务器中,再进行定制、集成和交付,一个项目对应一次收入。现在,越来越多客户直接调用云端模型,调用一次、计费一次,用量越大、付费越多,这就是典型的 MaaS 生意。

智谱天猫上架 GLM 套餐,AI 公司开始按 Token 更严控量 4

报道提到,智谱这次变化并不只是简单的低价换规模,而是出现了一组同时发生的数据:Token 调用量较年初增长超过 40 倍;API 平均售价提升约 101%;单位 Token 推理成本下降 80%;MaaS 业务毛利率提升至 24.6%。

这组数字反映出,成本在下降,收入在增长,用户调用量在放大,API 平均售价也在提高。AI 商业化正在脱离最初那种单纯依赖价格战的阶段。

从卖模型到卖调用,再到卖任务结果

在早期,模型能力还不够强,平台往往需要通过低价甚至免费把用户吸引进来。但当模型开始能完成代码生成、工具调用、持续执行等复杂任务,用户购买的就不再只是「一个模型」,而是模型替自己完成工作的能力。

智谱管理层将这一商业路径概括为:「卖模型→卖调用→卖订阅→卖端到端任务结果」。这四步对应的,是 AI 商业化的不同阶段。

如果放到具体使用方式中看,这种变化更清楚。过去是 Chatbot 模式,用户问一句,模型答一句,一次可能只消耗几百或几千 Token。现在则越来越多地进入 Agent 模式。比如用户提出「帮我做一个网站」,模型可能需要理解需求、搜索资料、写代码、调工具、跑测试、找 Bug、修改,再继续测试,一个任务就可能消耗几十万、几百万甚至更多 Token。

再往后,如果进入 Multi-Agent 阶段,一个 Agent 负责规划,一个负责搜索,一个负责写代码,一个负责测试,一个负责审查,Token 需求还会继续放大。

调用量飙升下,定价逻辑也在变化

报道援引数据称,2026 年第一季度,全球每周 Token 使用量暴增 250% 至 22.7 万亿。OpenAI 平台 Token 调用量从 2025 年 10 月的每分钟约 60 亿次,升至 2026 年 3 月底的 150 亿次,不足半年增长 150%。摩根士丹利报告则提到,顶尖大语言模型正经历「非线性的能力跃升」,AI 的爆发式增长正在碰到系统性的供应瓶颈。

智谱天猫上架 GLM 套餐,AI 公司开始按 Token 更严控量 5

在这种背景下,真正发生的事情不是 Token 本身变贵,而是每个人、每家公司都开始需要更多 Token。报道将这种现象类比为「杰文斯悖论」:当一种资源的使用效率提高、单位成本下降后,总使用量未必减少,反而可能因为更便宜而增加。

AI 的情况正在接近这一逻辑。Token 越便宜,用户越敢让 AI 承担更多工作;模型越强,用户又越愿意把更复杂的事情交给它,于是 Token 消耗形成新的增长循环。

从智谱半年报看,公司真正推进的并不只是销售 AI 额度,而是把模型能力转成可持续计费的云服务。2025 年,智谱的主要收入仍来自本地化部署;到 2026 年上半年,MaaS/API 已占收入 86.5%。

智谱董事会秘书肖磊在财报电话会上表示:「相较收入增速,收入构成的切换更值得关注。」智谱董事长刘德兵则在电话会上说:「单点榜单领先很快会被追平,真正重要的是谁能持续用更低成本交付更高智能。」

报道据此认为,未来的趋势可能是:基础 Token 越来越便宜,但高级智能越来越贵。单 Token 价格下降,并不等于 AI 使用成本下降。随着模型能力提升,用户交给 AI 的任务会从回答问题,扩展到完成任务,再到管理整套工作流,Token 消耗也会持续放大。

智谱半年报中写道:「模型每完成一次能力跃迁,客户购买的东西就向结果靠近一步,本公司的收入结构随之改写一次。」从这个角度看,市场后续更值得关注的,或许不再是「1 元能买多少 Token」,而是个人和企业每月到底会消耗多少 AI 智能。智谱把 Token 放上天猫,可能只是这套「AI 计量经济」走向大众市场的第一步。

本文最初由 Bit.Fan 发布。 欲了解更多加密货币新闻与市场洞察,请访问 www.bit.fan.
400

免责声明:

本平台展示的市场信息、项目资料与第三方内容仅用于行业信息分享,不构成任何形式的投资建议或收益承诺。

加密资产交易具有较高风险,用户应充分评估自身风险承受能力并独立作出决策,相关盈亏及法律责任由用户自行承担。