SemiAnalysis 对 Anthropic 与 OpenAI 的订阅方案用量表逐项测量后发现,两家旗舰模型的订阅价值接近,但主打日常使用的中阶模型差距明显。按其 10 月 5 日(美国时间)公布的实测结果,同样月付 200 美元,Claude Max 20x 在整月都运行 Claude Opus 5.5 时,按官方 API 牌价换算的额度约为 11,726 美元;ChatGPT Pro 200 运行 GPT-6.1 Sol 时约为 2,084 美元,差距约 5.6 倍。
测试如何计算订阅方案的 API 等值
SemiAnalysis 将订阅方案视为一笔点数配额,再根据不同模型与不同 token 类型的消耗速度,换算出整月额度按官方 API 定价计价后的金额。该机构将这一数字称为 API 等值,也就是「这个方案的额度,如果改用 API 付费要多少钱」。文中同时强调,这不是用户实际支付的金额,也不是公司的真实成本。
测试方法是一次只隔离一种 token 类型,包括全新输入、缓存写入、缓存读取和输出。研究人员使用专门设计的提示词反复调用模型,记录官方用量表每变动一格时累计消耗的 token 数量,直到误差控制在 ±5% 以内才记录结果。
代理式工作负载下,中阶模型差距最明显
本次工作情境采用代理式工作负载,也就是让 AI 连续执行多步骤任务。在这种情境下,大部分 token 来自缓存输入,即对话中已经处理过、可以重复利用的内容,也是单价最低的一类。SemiAnalysis 采用其 9 月自家用量结构,缓存输入占比为 96.6%。
在旗舰模型层级,两家结果相近,OpenAI 还略高一些。GPT-6 Astra 在 ChatGPT Pro 200 中的 API 等值为 2,897 美元,Claude Fable 5.1 在 Max 20x 中为 2,485 美元。不过,Fable 最多只能用掉整个方案额度的一半,用完这 2,485 美元后,Claude 方案仍保留一半额度可供其他模型使用;ChatGPT 方案则会全部用尽。
真正拉开差距的是两家公司主打的中阶模型。200 美元方案下,Opus 5.5 对 GPT-6.1 Sol 的结果分别为 11,726 美元和 2,084 美元。其他档位也呈现类似格局:Max 5x 为 5,725 美元,ChatGPT Pro 100 为 1,055 美元;Claude Pro 为 1,178 美元,ChatGPT Plus 为 211 美元。
由于 Sol 的官方牌价本来就低于 Opus,SemiAnalysis 还改用 token 数量做比较。结果显示,两者分别约为每月 286 亿个和 102 亿个,差距约 2.8 倍,差异仍然明显。
这组 5 倍结论有三个前提
SemiAnalysis 也提醒,若模型官方牌价本身偏高或偏低,API 等值就会出现失真;而同一项工作究竟需要消耗多少 token,行业内目前也缺少可靠数据。因此,文中的「5 倍」建立在三个前提上:比较对象是中阶模型、衡量口径是 API 等值、使用场景是代理式工作负载。
OpenAI 200 美元方案额度已在 9 月 29 日被砍半
SemiAnalysis 指出,OpenAI 过去常被独立开发者视为额度较大方的平台,但这一说法现在已不成立。9 月 29 日,OpenAI 将 200 美元方案的额度砍半。负责 Codex 的 Thibault Sottiaux 也在 X 上公开说明,SemiAnalysis 的追踪测试得到的幅度一致。
Astra 的 API 等值从 5,734 美元降至 2,897 美元,降幅 49%;每月 token 从 38 亿个降到 19 亿个。Sol 档位下降更深,从 5,904 美元降到 2,084 美元,降幅 65%。对应的 token 额度减少 48%,而 GPT-6.1 Sol 的缓存输入价格又继续下调,额度并未补回。
新推出的 500 美元方案,月费比旧 200 美元方案高出 150%,但 Astra 用量仅比旧 200 美元方案多出 21%。SemiAnalysis 还提到,ChatGPT Pro 200 过去每 1 美元换到的价值约为 Pro 100 的 2 倍,额度调整后,Pro 100、200、500 三档每 1 美元换到的 token 数量已经相同。
对 OpenAI 有利的一点是,Pro 方案没有 5 小时用量上限,更容易把月额度用满。不过 SemiAnalysis 认为,这仍不足以抵消 Opus 5.5 约 4 倍的 API 等值优势。
订阅补贴消耗的算力与毛利压力
SemiAnalysis 估算,Anthropic 的订阅业务约占营收 10%,却消耗了 41.7% 的推理算力。若以每 MW 营收衡量,也就是每单位电力与算力可换回多少收入,订阅约为 1,600 万美元,API 约为 1.029 亿美元,订阅业务把整体每 MW 营收拉低约 3,600 万美元。
毛利情况在该模型下更低。以 API 毛利率 92% 为假设,若 Max 20x 的 Opus 5.5 额度被完全用满,毛利率为负 369%;若用满 Fable 5.1,毛利率为 1%。若平均使用率为 20%,两者则分别为 6% 与 80%。SemiAnalysis 说明,这些都只是推算结果,并非 Anthropic 对外披露的财务数据。
Anthropic 与 OpenAI 收紧补贴的方式不同
在 SemiAnalysis 看来,两家公司都在调整订阅补贴,但方式不同。Anthropic 的做法更隐性:模型越贵,API 等值越低。以 Max 20x 为例,Fable 5.1 的 API 等值约为月费的 12.4 倍,Opus 5.5 则达到 58.6 倍。OpenAI 的做法则是一次性把额度压到接近 Fable 的水平。
文章最后指出,现在看到的 5 倍差距,只是某个时间点的快照,并不构成长期承诺。SemiAnalysis 判断,Fable 之上的新模型层级,未来订阅额度可能会更低,甚至未必纳入订阅方案。至于中国厂商的方案,报告称其仍存在补贴,每 1 美元对应的 API 等值平均略低于 OpenAI 的约 12 倍。

