Anthropic 旗下 Claude 在 8 月 24 日连续发生 3 次服务故障。当天,Anthropic 状态页三次显示异常,随后又三次宣布服务已全面恢复,但在 X 与 Reddit 等平台上,仍有大量用户表示自己一侧依然无法正常使用。

按文中说法,这是 Anthropic 在 8 月留下事故记录的第 13 天,而当月当时仅过去 24 天。其间,一名 Reddit 用户提到,自己一个自动化流程已经运行 9 个小时,却在这次大范围宕机中中断,前面的工作全部作废。
故障期间出现 529 Overloaded
大范围异常发生时,许多用户屏幕上出现的是「529 Overloaded」错误。文中将其与 API 用户更熟悉的 429 进行对比:429 代表限流,而 529 则意味着整个系统已经超载。
根据状态页记录,这次故障从北京时间 8 月 24 日 12:50 持续到 15:36,前后接近 3 个小时。警报发出 21 分钟后,Anthropic 表示已经定位根因,但并未进一步披露具体技术原因,也没有给出完全恢复时间。

受影响范围覆盖多个模型与产品。文中列出的模型包括 Mythos 5、Fable 5、Opus 5 和 Opus 4.8;受影响服务包括 claude.ai、API、Claude Code 和 Cowork。只有 Console 与 Claude for Government 未被列入故障范围。
状态页转绿后,用户故障反馈仍未停止
8 月 24 日的异常并未在官方第一次宣布恢复后结束。文中称,模型报错持续接近 3 个小时后虽然恢复,但到了 25 日刚过零点,登录系统再次中断,影响到 claude.ai 与 Claude Code 订阅,持续 6 分钟。几小时后,凌晨 4 点又发生一次新的登录故障,持续 8 分钟。
一个专门监测 Claude 登录状态的机器人 isclaudedownbot 在 4:11 发文,只写了一个词:「Yes。」文中将这条简短播报视为对当时状态的直接概括。

Anthropic 官方公告称,Claude.ai、Claude Code 与 Claude API 服务已经全面恢复,公司了解用户对 Claude 的依赖,并感谢用户在排查期间保持耐心。
不过,状态页恢复正常并不意味着所有账户立即恢复可用。文中提到,用户 elstar 当天在 X 上发文求助;同时,虽然官方状态显示一切正常,部分用户仍遇到认证残留问题与前端异常,settings、usage 和 skills 页面会直接出现白屏。直到深夜,网上仍有人继续发布「Claude down again」之类的反馈。
8 月故障记录密集
文中援引第三方监测服务 StatusGator 的数据称,从 2026 年 1 月至今,Claude 已累计 184 次故障记录,而当时日历只到 8 月。

按文章梳理,8 月的故障记录尤为密集:
- 8 月 20 日出现 2 起事故;
- 8 月 19 日至 16 日每天各有 1 起;
- 8 月 15 日,Fable 5 宕机约 4 个小时;
- 8 月 14 日一天内出现 3 起事故;
- 8 月 13 日和 12 日各有 1 起。
其中,8 月 5 日的一次故障持续 7.5 个小时。用户当时看到的报错是「Due to unexpected capacity constraints」,即意外的容量约束。
关于算力与模型能力的用户讨论
文中提到,capacity constraints 这个说法在当月报错中不止一次出现;在 X 上,用户反复提到的则是「ran out of compute」,也就是算力耗尽。

一名开发者称,Opus 4.6 过去曾表现得非常强,但后来「他们好像就是彻底耗尽了算力,然后把所有东西都给削弱了」。用户 Eason 也表示,Claude 出现了前所未有的严重能力退化,Opus 5 已经难以使用,自己甚至退回到 Opus 4.8。
文章同时指出,这些判断更多属于用户体感,没有给出直接证据。随后,文中提到有人对两家模型做了同任务对比:同一个复杂任务下,Opus 5 的 xHigh 档耗时 1 个小时,而另一家同档模型用了 15 分钟,时间差达到 4 倍。
6852 个 Claude Code 会话被拿来做观察样本
文中还提到,AMD 的 AI 总监 Stella Laurenzo 翻查了其团队共计 6852 个 Claude Code 会话,得到一条明显下滑的曲线。

按文中描述,1 月底时,模型思考深度大约还有 2200 个字符;到 3 月上旬,这一数字降至 560 个,降幅约 75%。
同一时期,Claude Code 的思考内容开始逐步对用户隐藏。文章称,仅一周时间内,隐藏比例就从 1.5% 提升到 100%。按这一说法,在用户看来模型能力下降的同时,模型内部的思考过程也变得不可见。
状态页记录的中断时间,未必等于真实损失
Anthropic 官网列出的 90 天可用率数据显示,claude.ai 为 99.33%,API 为 99.43%,Claude Code 为 99.35%。文中认为,这些数字表面上看并不低,但企业级服务通常会以 99.9% 作为参考线。

文章还提到,在传统互联网场景下,服务中断往往意味着网页暂时无法打开,刷新后即可继续;但对 Agent 类任务来说,长时间任务一旦被打断,损失不仅是中断期间的几分钟,还包括此前已经消耗的时间、上下文和算力,而这些并不能被状态页的可用率指标完整反映。
截至文中所述时间,Anthropic 仍未说明 8 月 24 日那 3 个小时内究竟发生了什么。而在这个已经出现 13 天事故记录的 8 月,距离月底还剩 7 天。

