챗GPT, 클로드, 그록 같은 날 장애 발생, 클라우드 인프라 안정성 우려 제기
현지 시간 목요일 아침 오픈AI, 앤스로픽 클로드, xAI 그록, 커서 등 주요 AI 플랫폼에서 동시다발적 서비스 장애가 발생했다. 각 기업은 오류 원인을 조사 및 복구 중이며, 오픈AI는 12,000건 이상의 신고를 접수했다. 근본 원인은 공식 확인되지 않았으나, 마이크로소프트 애저의 장애 보고 증가가 잠재적 우려 요인으로 부각됐다. 이번 사태는 클라우드 인프라 안정성이 AI 산업의 핵심 변수임을 보여주며, 기업 사용자에게는 멀티 모델 접근성과 백업 자원 확보 등 리스크 대응 전략이 요구될 수 있다.

TradingKey - 현지 시간 목요일 아침 미국의 여러 주요 AI 플랫폼에서 서비스 장애가 발생했다. 네트워크 상태 모니터링 웹사이트 다운디텍터(Downdetector)에 따르면 오픈AI(OpenAI), 앤스로픽(Anthropic)의 클로드(Claude), 일론 머스크의 xAI 그록(Grok), AI 코딩 도구 커서(Cursor) 모두에 대량의 사용자 장애 신고가 접수됐다.
이 중 그록과 클로드의 서비스 문제는 미 동부 시간 기준 오전 9시경 처음 나타났으며, 오픈AI의 장애 신고는 오전 10시 30분경 급증했다. 짧은 시간 내에 여러 AI 플랫폼에서 동시에 발생한 이번 장애는 클라우드 컴퓨팅 인프라의 안정성에 대한 시장의 우려를 불러일으켰다.
챗GPT, 클로드, 그록은 어떤 문제에 직면해 있는가?
오픈AI는 챗GPT 챗봇과 코덱스 AI 코딩 도구에 영향을 미치는 오류 발생률 증가 원인을 조사 중이라고 밝혔다. 다운디텍터 데이터에 따르면 오픈AI 서비스 장애에 대한 사용자 신고 건수는 12,000건을 넘어섰다.
앤스로픽은 클로드 서비스 오류를 조사하고 있으며 복구 작업을 진행 중이라고 밝혔다. 일부 모델의 서비스는 복구되었으나 오퍼스 4.8과 오퍼스 5는 여전히 장애를 겪고 있다. 일부 사용자에게는 "예상치 못한 용량 제약으로 인해 클로드가 메시지에 응답할 수 없습니다. 나중에 다시 시도해 주세요."라는 메시지가 표시됐다.
그록 역시 접속 장애를 겪었다. 오류 메시지에는 "현재 그록에 문제가 발생했으며, 가능한 한 빨리 서비스를 복구하기 위해 노력하고 있습니다" 및 "이 모델은 일시적으로 사용할 수 없으니 다른 모델을 이용해 주세요" 등이 포함됐다. 다운디텍터 데이터에 따르면 클로드와 그록은 각각 약 1,200건과 1,000건의 장애 신고를 받았다.
클로드 및 그록 장애로 영향받은 커서
이번 AI 서비스 중단은 AI 프로그래밍 도구인 커서(Cursor)에도 영향을 미쳤다. 커서는 코드 생성 및 개발 보조 기능의 일부를 외부 대형 모델에 의존하고 있어 클로드(Claude)와 그록(Grok)의 서비스 장애 역시 그 기능에 영향을 주었다.
AI 모델은 소프트웨어 개발, 텍스트 생성, 기업 자동화, 고객 서비스 등의 워크플로에서 점차 기반 기능이 되고 있다. 여러 모델 제공업체에서 동시에 발생한 서비스 중단은 그 영향이 단일 챗봇에 그치지 않고 개발 도구와 기업용 애플리케이션으로까지 파급될 수 있음을 의미한다.
애저가 AI 서비스 장애의 잠재적 원인인가?
현재 서비스 장애의 근본적인 원인은 관련 기업들로부터 공식 확인되지 않았다. 다만 같은 기간 마이크로소프트 애저(Microsoft Azure) 장애 보고가 눈에 띄게 증가한 점이 잠재적인 우려 요인으로 부각되고 있다.
오픈AI, 앤트로픽, xAI는 모두 연산 능력 지원을 위해 애저와 같은 클라우드 서비스에 의존하고 있지만, 이들의 인프라는 일반적으로 다른 클라우드 제공업체의 자원도 함께 활용한다. 만약 애저가 지역 또는 핵심 서비스 중단을 겪을 경우, 해당 클라우드의 연산, 네트워킹, 스토리지 기능에 의존하는 AI 플랫폼 전반에 파급 효과를 일으킬 수 있다.
구글 제미나이(Google Gemini)는 현재 이번 장애의 영향을 받지 않은 것으로 보인다. 같은 기간 사용자 신고가 증가하긴 했으나, 구글은 제미나이에 대한 서비스 장애를 공식 확인하지 않았다.
동시다발적 AI 서비스 장애, 컴퓨팅 인프라 리스크 부각
개별 AI 플랫폼의 서비스 장애가 드문 일은 아니지만, 챗GPT와 클로드, 그록이 동일한 시간대에 일제히 서비스 중단을 겪는 것은 비교적 이례적이다. 이번 사태는 생성형 AI가 기업 및 개발자의 워크플로에 깊이 자리 잡음에 따라, 모델 서비스의 가용성과 클라우드 컴퓨팅 인프라의 안정성이 산업 경쟁의 핵심 변수로 부상하고 있음을 다시 한번 보여준다.
기업 사용자의 경우, 멀티 모델 접근성 확보, 서비스 성능 저하 대응 전략 수립, AI 애플리케이션을 위한 백업 클라우드 자원 프로비저닝 등이 대규모 서비스 중단 위험을 완화하는 핵심 요인이 될 수 있다.
이 콘텐츠는 AI를 활용하여 번역되었으며, 명확성을 확보할 수 있도록 검토 과정을 거쳤습니다. 정보 제공 용도로만 제공됩니다.
추천 기사













코멘트 (0)
$ 버튼을 클릭하고, 종목 코드를 입력한 후 주식, ETF 또는 기타 티커를 연결합니다.