2026年9月

2026年9月 AI工具故障汇总与运行报告

我们持续监控包括 ChatGPT、Claude、Gemini 在内的18项主流AI工具。本文回顾2026年9月各厂商官方状态页记录的故障。

故障次数
33
受影响的提供方
7
总停机时长
169 小时 25 分
平均可用率
98.19%

最长的故障: Anthropic(99 小时 21 分)

按提供方汇总

提供方故障次数停机时长最严重状态可用率
Cursor1026 小时 54 分大规模故障96.26%
Anthropic8108 小时 30 分部分故障84.93%
OpenAI58 小时 27 分大规模故障98.83%
GitHub414 小时 37 分大规模故障97.97%
ElevenLabs33 小时 50 分部分故障99.47%
Perplexity22 小时 59 分大规模故障99.59%
Stability AI14 小时 8 分部分故障99.43%

故障次数与停机时长仅统计官方状态页中“达到一部分故障及以上且已恢复”的故障(轻微延迟与持续中项目除外)。可用率为据此得出的本站独立推算,并非厂商官方数据。按日本时间(JST)的自然月统计。

本月要点

2026年9月共记录31起重大故障,累计10,036分钟,涉及7家提供方。其中 Cursor 最多(9起),其次是 Anthropic(8起)、OpenAI(5起)和 GitHub(4起)。

合计时长的近60%(5,961分钟)来自 Anthropic 的一起故障:「Windows 版 Claude Cowork 功能降级」。该故障从9月11日00:54持续到15日04:14(日本时间),约4天,但影响仅限于 Windows 上的 Cowork,claude.ai 和 API 不受影响。扣除这一起,本月合计为4,075分钟,与8月(4,153分钟)基本持平。

最严重的是9月26日07:58至08:54(日本时间)的 OpenAI「Codex 故障」。Codex Web、CLI、VS Code 扩展和 Codex API 全部完全停止(最高级别),持续约56分钟。Anthropic 也自9月29日23:21起约2小时,在 claude.ai、Claude Code、Cowork 和 API 全面出现错误率上升。

Cursor 的9起故障中有6起与新功能「Grok Bot」有关(包括9月16日23:27起约6.5小时,以及18日晚至19日早的两起等,合计约19小时)。新功能集中出故障的情况在 OpenAI 的「ChatGPT Work」上同样可见:除3起重大故障(包括9月1日00:04起约5小时24分)外,还记录了至少5起轻微劣化。

开发基础设施方面,GitHub 自9月16日16:20起记录了约10.5小时的「Gemini 3.8 Flash 劣化」。这发生在 Copilot 调用 Google 模型的部分,是上游模型提供方的问题直接表现为 GitHub(Copilot)故障的例子。9月13日还发生了一起横跨多个 GitHub 服务的故障(约1.5小时),Copilot 代码审查也两度停止。

图像生成方面,Stability AI 自9月15日01:33起约4小时,其生成API持续返回500错误。

趋势与观察

本月再次清晰看到上游向下游的连锁传导。9月3日22:26(日本时间),Anthropic 公告「多个模型错误率上升」;15分钟后 Cursor 以最高级别公告故障,51分钟后又另行公告「Anthropic 模型错误率上升」。同一晚 OpenAI 也记录了 ChatGPT 与 Codex 的错误率上升(轻微)。

推高各家故障次数的,都是刚上线的新功能。Cursor 的 Grok Bot 和 OpenAI 的 ChatGPT Work 都反复出现短时故障。如果要把新功能纳入工作流程,最初几周准备好替代方案会更稳妥。

轻微劣化(延迟级别)共72起,按数量依次为 OpenAI 24起、Cursor 22起、GitHub 10起。OpenAI 重大故障仅5起,但细致地公告了许多范围有限的问题,例如欧洲和 APAC 等地区性错误,以及按套餐区分的错误率上升。

可用率方面 Anthropic 最低(84.93%),但这几乎完全可以由上述 Windows 版 Cowork 的长期劣化解释。扣除这一起后,Anthropic 的可用率约为98.7%。即使影响范围很窄,只要官方长期将其挂为「部分故障」,在数字上也会影响很大,比较时需要打折看待。

如何阅读本报告

故障次数与停机时长仅统计各厂商官方状态页中「部分故障及以上(实质不可用)且已恢复」的条目(按日本时间的自然月)。延迟等轻微劣化,以及尚未宣告解决的进行中条目,均不计入合计,以免数字被放大。

截至月末,OpenAI 有2项仍未解决(支持聊天停止,以及自9月30日起 ChatGPT、Codex、API 的错误率上升),但两者均为轻微及以下级别,不影响统计。

本月合计的约60%来自 Anthropic 的 Windows 版 Cowork 劣化这一起。解读全月趋势时,扣除这部分更接近实情。

可用率是基于上述重大故障时间的本站独立推算,并非各厂商官方SLA数值。

各服务的「历史故障」页面可查看每起故障的标题、规模、持续时间与官方链接。