아티클 목록으로
업계 동향

ChatGPT·Claude·Grok·Gemini, 이례적으로 같은 시간대 장애

약 3분 소요

들어가며

목요일 오전, 주요 클라우드 AI 서비스에서 문제가 잇따라 발생했다. Anthropic의 Claude, OpenAI의 ChatGPT와 Codex, xAI의 Grok, 그리고 이용자 제보상 Google Gemini가 수시간 안에 겹치는 형태로 불안정해졌다. 개별 모델의 일시적 장애는 드물지 않지만, 여러 대표 모델이 비슷한 시간대에 영향을 받은 것은 이례적이다.

핵심 내용

  • Anthropic은 미 동부시간 오전 9시 23분 Claude Mythos 5.1, Fable 5.1, Opus 5 요청에서 오류가 증가했다고 밝혔다. 약 15분 뒤 원인을 확인했다고 알렸고, 낮 12시 16분 문제 해결을 발표했다. 정오 직후에는 Claude Sonnet 5에서도 짧은 시간 오류 증가가 발생했다.
  • OpenAI는 오전 10시 43분 ChatGPT와 Codex 전반에서 오류가 증가해 성능이 저하됐다고 설명했다. 완화 조치를 적용한 뒤 낮 12시 55분 해결된 것으로 표시했다.
  • Grok은 “문제가 발생하고 있다”는 이용자용 오류 메시지를 띄웠다. DownDetector 제보는 오전 9시 직전 10건 미만에서 9시 45분경 1,365건으로 늘어난 뒤 감소했다.
  • Google은 Gemini 장애를 공식적으로 인정하지 않았다. 다만 DownDetector 제보는 약 23건에서 412건으로 증가했고, StatusGator는 오전 10시 45분부터 11시 15분까지 Gemini API를 “장애 가능성이 높은 상태”로 분류했다.

의미와 영향

현재 공개된 자료만으로는 네 회사의 장애가 같은 근본 원인에서 비롯됐다고 볼 수 없다. AWS, Microsoft Azure, Cloudflare도 당시 중대한 장애를 보고하지 않았다. 세 사업자 모두에서 이용자 제보가 다소 늘기는 했지만, 특정 클라우드나 네트워크 사업자를 원인으로 지목할 근거는 부족하다.

더 중요한 문제는 서비스 의존도의 집중이다. 기업과 개인은 글쓰기, 코딩, 고객 지원, 자동화 업무를 소수의 호스팅 모델에 맡기고 있다. 여러 제공업체가 거의 동시에 불안정해지면 다른 모델로 전환하는 방식만으로는 업무를 이어가기 어렵다. 따라서 상태 페이지의 투명성, 복수 제공업체 구성, 캐시, 성능 저하 시 대체 경로, 핵심 업무의 수동 절차가 필요하다.

최근 90일 가동률은 Claude 99.4%, ChatGPT 99.63%, ChatGPT Codex 100%로 보고됐다. 전반적인 안정성이 높다는 뜻이지만, 장애가 한 시기에 집중됐을 때의 사업 영향까지 보여주지는 않는다. AI 제품의 신뢰성을 평가할 때는 단일 API의 uptime뿐 아니라 모델 간 전환과 장애 격리도 시험해야 한다.

출처: Ars Technica AI

댓글

로그인 상태 확인 중…

댓글 불러오는 중…

관련 게시물

CCTest · Blog
구글 딥마인드, 정부·기업용 선제적 사이버 방어 프로그램 Fairwind 출시
업계 동향
cctest.ai
업계 동향

구글 딥마인드, 정부·기업용 선제적 사이버 방어 프로그램 Fairwind 출시

구글 딥마인드가 정부 기관과 기업, 신뢰할 수 있는 보안 파트너를 위한 제한적 접근 프로그램 Fairwind를 발표했습니다. Gemini 3.8 Flash Cyber와 CodeMender를 결합해 취약점의 탐지, 검증, 수정까지 지원하는 것이 핵심입니다.

더 보기
CCTest · Blog
구글이 할리우드보다 AI 협력을 더 필요로 하는 이유
업계 동향
cctest.ai
업계 동향

구글이 할리우드보다 AI 협력을 더 필요로 하는 이유

구글이 영화와 TV 콘텐츠를 AI 학습과 캐릭터 생성에 활용하기 위해 할리우드 대형 스튜디오들과 라이선스 계약을 추진하고 있다는 보도가 나왔습니다. 스튜디오에는 큰 수익이 될 수 있지만, 구글이 얻는 가장 큰 이익은 생성형 AI에 대한 대중의 신뢰와 정당성일 수 있습니다.

더 보기