Anthropic 的服务于 7月29日 晚间在全球范围内发生故障。所有模型的错误率升高从 19:49 UTC 开始,同时影响了 claude.aiClaude APIClaude Code。在近三小时后,即 22:36 UTC,故障才全面解决。

用户看到的情况

请求返回 529 Overloaded——这是服务在无法承载负载时返回的状态码,而不是在系统出现故障时返回的代码。这一区别对解读很重要,不过 Anthropic 并未证实容量问题就是原因。

时间线

Anthropic 于 19:49 开始调查,并称其在 20:33 已识别出问题,但在事件期间没有公布原因或恢复时间预估。发言人事后确认,“Claude.ai、Claude Code 和 Claude API 的服务已全面恢复。” 此后尚未发布事后说明。

为何 API 这半边更重要

聊天机器人宕机只是带来不便。API 宕机会使生产系统停摆,而 Claude Code 出现故障则会让工程团队在任务进行到一半时离线,而不仅仅是对话中断。随着前沿模型从助手变成已部署软件中的依赖,单一提供商停机不再只是消费者新闻。

沉默

目前尚未发布根因分析。对于一家向企业销售服务、且企业越来越多地通过单一 API 路由生产负载的公司来说,没有事后复盘本身就是最值得注意的地方——正在就正常运行时间条款谈判的买家无从阅读。