2026년 9월

2026년 9월 AI 도구 장애 정리·가동 리포트

ChatGPT·Claude·Gemini를 비롯한 주요 AI 도구 18개 서비스를 상시 모니터링하고 있습니다. 2026년 9월 각사 공식 상태 페이지에 기록된 장애를 되돌아봅니다.

장애 건수
33
영향받은 제공처
7
총 다운타임
169시간 25분
평균 가동률
98.19%

가장 긴 장애: Anthropic(99시간 21분)

제공처별 집계

제공처장애 건수다운타임최악 상태가동률
Cursor1026시간 54분대규모 장애96.26%
Anthropic8108시간 30분부분 장애84.93%
OpenAI58시간 27분대규모 장애98.83%
GitHub414시간 37분대규모 장애97.97%
ElevenLabs33시간 50분부분 장애99.47%
Perplexity22시간 59분대규모 장애99.59%
Stability AI14시간 8분부분 장애99.43%

장애 건수·다운타임은 공식 상태 페이지에 기록된 "일부 장애 이상이며 복구된" 장애만 집계합니다(경미한 지연과 진행 중 항목은 제외). 가동률은 이를 바탕으로 한 자체 추정이며 각 사의 공식 수치가 아닙니다. 일본 시간(JST) 기준 역월로 집계합니다.

이달의 하이라이트

2026년 9월의 중대 장애는 31건, 합계 10,036분이었습니다. 영향을 받은 제공사는 7곳으로, 건수가 가장 많았던 곳은 Cursor(9건), 이어서 Anthropic(8건), OpenAI(5건), GitHub(4건)입니다.

합계 시간의 60% 가까이(5,961분)는 Anthropic의 「Windows용 Claude Cowork 기능 저하」 1건에서 나왔습니다. 9월 11일 00:54부터 15일 04:14(일본 시간)까지 약 4일간 이어졌지만, 영향은 Windows의 Cowork에 한정되었고 claude.ai와 API는 대상이 아니었습니다. 이 1건을 제외하면 이달 합계는 4,075분으로, 8월(4,153분)과 거의 같은 수준입니다.

가장 심각했던 것은 9월 26일 07:58~08:54(일본 시간)의 OpenAI 「Codex 장애」입니다. Codex Web·CLI·VS Code 확장·Codex API가 모두 완전 중단(최상위 규모)되어 약 56분간 이어졌습니다. Anthropic에서도 9월 29일 23:21부터 약 2시간 동안 claude.ai·Claude Code·Cowork·API 전반에서 오류가 증가했습니다.

Cursor는 9건 중 6건이 신기능 「Grok Bot」 관련 문제였습니다(9월 16일 23:27부터 약 6.5시간, 18일 밤부터 19일 아침에 걸친 2건 등, 합계 약 19시간). 새로 나온 기능에 장애가 집중되는 것은 OpenAI의 「ChatGPT Work」도 마찬가지로, 중대 장애 3건(9월 1일 00:04부터 약 5시간 24분 등)에 더해 경미한 저하도 최소 5건 기록되었습니다.

개발 인프라에서는 GitHub가 9월 16일 16:20부터 약 10.5시간 동안 「Gemini 3.8 Flash 저하」를 기록했습니다. Copilot에서 Google 모델을 사용하는 부분으로, 상류 모델 제공사의 문제가 그대로 GitHub(Copilot) 장애로 나타난 사례입니다. 9월 13일에는 여러 GitHub 서비스에 걸친 장애(약 1.5시간)가 있었고, Copilot 코드 리뷰도 두 차례 중단되었습니다.

이미지 생성에서는 Stability AI가 9월 15일 01:33부터 약 4시간 동안 생성 API에서 500 오류를 반환했습니다.

경향과 소감

이달에도 상류에서 하류로의 연쇄가 뚜렷하게 보였습니다. 9월 3일 22:26(일본 시간)에 Anthropic이 「여러 모델의 오류 증가」를 공지하고 15분 뒤 Cursor가 최상위 규모로 장애를 공지했으며, 51분 뒤에는 「Anthropic 모델 오류 증가」를 별도로 공지했습니다. 같은 날 밤 OpenAI에서도 ChatGPT와 Codex의 오류 증가(경미)가 기록되었습니다.

건수를 끌어올린 것은 각사 모두 갓 출시된 기능이었습니다. Cursor의 Grok Bot, OpenAI의 ChatGPT Work 모두 짧은 장애를 반복했습니다. 새 기능을 업무에 도입한다면 처음 몇 주는 대체 수단을 준비해 두는 것이 무난합니다.

경미한 저하(지연 수준)는 72건으로, 많은 순서대로 OpenAI 24건·Cursor 22건·GitHub 10건이었습니다. OpenAI는 중대 장애가 5건으로 적은 반면, 유럽이나 APAC 등 지역 한정 오류와 요금제별 오류 증가를 세세하게 공지했습니다.

가동률에서는 Anthropic이 84.93%로 가장 낮게 나오지만, 이는 위의 Windows용 Cowork 장기 저하 1건으로 거의 설명됩니다. 이 1건을 제외한 Anthropic의 가동률은 약 98.7%입니다. 영향 범위가 좁은 장애라도 공식적으로 「부분 장애」로 오래 게시되어 있으면 수치상 크게 반영된다는 점은 감안해서 볼 필요가 있습니다.

이 리포트를 보는 법

건수와 다운타임은 각 제공사의 공식 상태 페이지에 기록된 인시던트 중 「부분 장애 이상(실질적으로 사용 불가)이며 복구 완료」인 것만 집계합니다(일본 시간 기준 역월). 지연 등 경미한 저하와, 해결이 공지되지 않은 진행 중 항목은 수치가 실제보다 커 보이는 것을 피하기 위해 합계에서 제외합니다.

월말 시점에 OpenAI의 2건(지원 채팅 중단, 그리고 9월 30일부터의 ChatGPT·Codex·API 오류 증가)이 미해결이었지만, 모두 경미 이하 규모이므로 집계에는 영향이 없습니다.

이달 합계의 약 60%는 Anthropic의 Windows용 Cowork 저하 1건입니다. 한 달 전체의 경향을 볼 때는 이를 빼고 생각하면 실태에 가깝습니다.

가동률은 위 중대 장애 시간에 근거한 본 사이트의 독자 추정이며, 각사의 공식 SLA 값이 아닙니다.

개별 인시던트의 제목·규모·지속 시간과 공식 링크는 각 서비스의 「과거 장애 이력」 페이지에서 확인할 수 있습니다.