AI 뉴스

draft-31485-claude-uptime-june

노동1호 2026. 7. 16. 19:01

GeekNews에 공유된 AIWatch 6월 리포트를 보면, AI 서비스의 신뢰도를 우리가 흔히 쓰는 단일 지표로 판단하기엔 무리가 있다는 점이 명확해집니다. 41개 서비스를 동시에 모니터링해 보고서를 내는 인프라 자체가 이제 독립적인 카테고리로 자리잡았기 때문입니다.

ai service uptime monitoring dashboard graph line server

흥미로운 점은 Claude가 99.55%라는 높은 업타임을 공식 발표했지만 동시에 45건의 인시던트가 있었다는 사실입니다. 단순히 가동 시간 비율 하나만 신뢰 지표로 본다면, 운영자가 실제로 마주친 실패 빈도는 보이지 않습니다. AIWatch가 강조하는 건 결국 "어떤 창(window)으로, 어떤 공식으로 계산했는가"가 신뢰의 본질이라는 점입니다.

AIWatch는 Claude·OpenAI·Gemini 등 41개 AI 서비스(LLM API·코딩 에이전트·음성·인프라·AI 앱)의 업타임·인시던트·지연을 실시간으로 모니터링합니다. 6월 리포트(6/1–30)를 공개했습니다.

  • 리포트: https://ai-watch.dev/reports/2026-06/
  • 실시간 대시보드: https://ai-watch.dev

##### 핵심 3가지

1. 41개 중 35개가 최소 1건 장애, 총 다운타임 712시간 26분. 6월은 양극화가 뚜렷했습니다. Windsurf·Modal·Groq Cloud는 높은 안정성을 유지한 반면, Deepgram은 가장 고전했습니다(장애 6건, 다운타임 45시간 33분, 최장 27시간).

2. 업타임 숫자만으론 신뢰도를 못 봅니다. Claude는 공식 업타임 99.55%인데 인시던트가 45건 발생해 AIWatch 점수는 Fair 67. 반대로 Windsurf는 장애 0건으로 100점. AIWatch는 provider가 발표한 업타임 %를 그대로 베끼지 않고, 각 provider의 공식 인시던트 기록에서 동일한 창(30일)·동일한 공식으로 직접 계산합니다. 그래서 우리 수치가 provider 상태페이지의 %와 다를 수 있습니다(의도된 것).

3. 공식 상태페이지가 안 알리는 지연을 직접 측정으로 잡았습니다. 프로브 가능한 32개 엔드포인트를 정해진 스케줄로 RTT 측정한 결과, 6월 지연 악화 102건 중 99건이 공식 상태페이지에 없었습니다(Mistral 41, Replicate 25). 완전 다운이 아니라 서서히 느려지는 유형이라 가동/중단만 표시하는 상태페이지엔 잘 안 뜹니다.

##### 6월 AIWatch Score 랭킹

| 순위 | 서비스 | 점수 | 등급 |

|---|---|---|---|

| 1 | Windsurf | 100 | Excellent |

| 2 | Modal | 94 | Excellent |

| 3 | Junie | 93 | Excellent |

| 4 | Groq Cloud | 91 | Excellent |

ai service uptime monitoring dashboard graph line server

| 5 | Cohere API | 89 | Good |

| … | OpenAI API | 87 | Good |

| … | Claude (Anthropic 계열) | 66–69 | Fair |

| 최하위 | Deepgram | 45 | — |

41개 중 30개 랭킹. Bedrock·Azure OpenAI·Character.AI는 공식 업타임·프로브가 없어 점수를 유보. 8개는 월 중간 추가라 다음 달 합류.

AIWatch Score(0–100) = 업타임 40% + 인시던트 영향일 25% + 복구 속도 15% + 응답성(직접 프로브 RTT) 20%. "프로덕션에서 뭘 믿고 쓸 수 있나"를 한 숫자로 답하는 지표입니다.

##### 용도별 추천

  • 무중단이 중요하면 → Windsurf / Modal
  • 응답 속도가 중요하면 → Groq Cloud (205ms)
  • 코딩 도구는 → GitHub Copilot (이달 최대 개선 69→86)
  • 음성·STT는 → AssemblyAI (76)
  • 두루 쓰기엔 → OpenAI API (87)

##### 한 가지 정직하게

Codex는 이달 다운타임 91시간으로 보이지만, 그중 72시간은 "사용량 한도" 공지가 상태페이지에 다운타임으로 집계된 것 — 실제 가용성 저하가 아닙니다.

한국 시장에서의 시사점

국내에서도 SK·KT·네이버 같은 CSP가 자사 LLM API와 멀티모달 서비스의 상태페이지를 공개하고 있지만, 인시던트 분류·지연 측정 기준은 사마다 다릅니다. 같은 99.9%라는 숫자라도 30일 창을 어떻게 자르느냐, 어떤 RTT 임계값을 쓰느냐에 따라 운영자가 체감하는 안정성은 크게 달라집니다.

특히 금융·의료·공공 SI 같은 영역은 단일 provider 장애 시 SLA가 깨지는 즉시 고객 손해로 직결됩니다. 6월 리포트처럼 provider가 공개하지 않은 지연 악화 99건이 Mistral과 Replicate에서 동시에 잡힌 사례는, 한국 시장에서도 멀티 provider 전략을 권장하는 근거가 됩니다. AIWatch 같은 외부 모니터링을 정기적으로 대조하면, 상태페이지가 놓치는 회색 지대를 미리 짚을 수 있습니다.

원문: GeekNews #31485 — Show GN: Claude 공식 업타임 99.55%인데 6월 인시던트 45건


📰 원본 출처 · https://news.hada.io/topic?id=31485 (#N=31485)

이 글은 GeekNews(긱뉴스)에 게제된 글을 기반으로 작성되었습니다. 원본의 라이선스와 저작권은 원작자에게 있습니다.