AI 뉴스

Claude Sonnet 5 공개 — Opus급 에이전트를 Sonnet 가격에 가져오다

노동1호 2026. 7. 2. 01:01

2026년 6월 30일, Anthropic이 Claude Sonnet 5를 공개했습니다. 이번 Sonnet 5는 단순한 점진적 업그레이드가 아닙니다. Opus급 모델에 가까운 에이전트 실행 능력을 Sonnet 가격대에서 제공하겠다는 명확한 메시지를 담고 있습니다. Sonnet 3.5·3.6·3.7이 "개발자용 코딩 보조 모델"로 자리 잡은 이후 에이전트 능력의 가장 큰 진보는 Opus에서만 일어나왔는데, 그 격차를 Sonnet급에서 메우기 시작한 것입니다.

claude ai agent coding
  • --

Sonnet 5의 핵심 변화 — Sonnet급에서 에이전트가 실행된다

Sonnet 5는 지금까지의 Sonnet 라인업 중 가장 에이전트형(agentic)으로 설계되었습니다. 계획 수립, 브라우저·터미널 도구 사용, 자율 실행까지 Sonnet 가격대에서 처리하는 것이 목표입니다.

주요 변화는 다음과 같습니다.

  • 에이전트 성능 강화: Sonnet 4.6 대비 추론, 도구 사용, 코딩, 지식 작업이 모두 개선됐습니다.
  • effort(노력 수준) 조절: 작업별로 비용과 성능의 균형을 더 세밀하게 선택할 수 있습니다.
  • 가격 정책: 2026년 8월 31일까지 입력 $2 / 출력 $10 (per 1M tokens), 이후 표준가 $3 / $15로 전환됩니다.
  • 새 토크나이저: 콘텐츠 유형에 따라 동일 입력이 약 1.0~1.35배 토큰으로 매핑될 수 있어 도입기에는 비용 중립적으로 설계됐습니다.

API 모델명은 claude-sonnet-5이며, Free/Pro는 물론 Max, Team, Enterprise, Claude Code, Claude Platform 전 플랜에서 기본 모델로 제공됩니다.

  • --

성능 평가 — Sonnet 4.6 대비 일관된 개선

Sonnet 5는 BrowseComp 에이전트 검색 평가와 OSWorld-Verified 컴퓨터 사용 평가에서 Sonnet 4.6보다 일관되게 나은 결과를 보입니다. 단순 벤치마크 점수가 아니라 "주어진 시간 안에 작업을 끝까지 완수하는가"를 본 평가들입니다.

특히 흥미로운 부분은 effort 수준 비교입니다.

| effort 수준 | Sonnet 5 | Opus 4.8 |

|---|---|---|

| 중간 | 비용 효율 대폭 향상 | 상대적 불리 |

| 높음 | 일부 작업에서 Opus 4.8과 동등 | 기준 성능 |

이는 사용자가 Sonnet 5와 Opus 4.8 사이에서 effort를 조정해 "Opus에 가까운 성능을 Sonnet 가격으로" 뽑아낼 수 있다는 의미입니다.

  • --

초기 사용자 사례 — "중간에 멈추지 않는다"

초기 접근 파트너들의 피드백이 흥미롭습니다. 이전 Sonnet 모델이 중간에 멈추던 복잡한 작업을 Sonnet 5는 끝까지 수행했고, 명시적으로 요청하지 않아도 자체 결과를 검증하는 사례가 관찰됐습니다.

확인된 작업 흐름은 다음과 같습니다.

  • 다단계 소프트웨어 엔지니어링 작업에서 지속 코딩, 도구 사용, 디버깅을 멈추지 않고 처리
  • Salesforce 계정 등급 업데이트 + 출시 공지 발송처럼 2개 시스템에 걸친 작업을 자율 완료
  • 실제 pull request 수십 개에 대해 테스트와 검증까지 자체 수행
  • 버그 조사에서 재현 테스트 작성 → 수정 구현 → 변경분 stash → 재발 확인까지 한 번에 진행
  • brownfield 코드에서 race condition, hidden test, 실패의 진짜 근본 원인 추적에 강점

비코딩 영역에서도 법률 리서치, ClickHouse 라이브 데이터 탐색, Pace의 보험 워크플로우 등에서 속도와 완성도 개선 사례가 보고됐습니다. Sonnet 5는 "코딩 모델"이라는 카테고리를 넘어 범용 에이전트로 자리 잡기 시작한 셈입니다.

  • --

안전성과 사이버 제약 — 보호 장치 기본 활성화

Sonnet 5는 배포 전 안전성 평가에서 Sonnet 4.6보다 개선된 수치를 보였습니다.

  • 환각·아첨 비율 감소
  • 악성 요청 거부 강화
  • 프롬프트 인젝션 하이재킹 저항 강화
  • 자동 행동 감사(오용 협력·기만 등 부정렬 검사)에서 더 낮은 점수

다만 Opus 4.8과 Claude Mythos Preview 대비 일부 부정렬 행동 비율은 여전히 높은 편이었습니다. 더 능력 있는 모델일수록 행동 감사가 까다로워지는 역설이 있습니다.

  • 사이버 보안 측면*에서 의도적인 학습은 이뤄지지 않았습니다.
  • 일상적이고 무해한 사이버 작업은 수행 가능
  • Firefox 브라우저 취약점 익스플로잇 개발 평가에서 완전 작동 익스플로잇은 만들지 못함 (단, Sonnet 4.6보다 부분 성공률은 약간 높음)
  • 이로 인해 Opus 4.7·4.8에 적용된 것과 동일한 사이버 보호 장치가 기본 활성화된 상태로 출시
  • 다만 전체 위험 수준이 낮다고 판단되어 더 넓은 범위를 차단하는 Fable 5 보호 장치보다는 덜 엄격
claude ai agent coding

전체 안전성 평가는 Claude Sonnet 5 System Card에서 확인할 수 있습니다.

  • --

제공 범위와 가격 — 모든 플랜에서 사용 가능

Sonnet 5는 출시 즉시 모든 플랜에서 사용할 수 있습니다.

  • Free / Pro: 기본 모델
  • Max / Team / Enterprise: 사용 가능
  • Claude Code / Claude Platform: 사용 가능 (API 모델명 claude-sonnet-5)

높은 effort 사용으로 토큰 사용량이 늘어나는 점을 반영해 Chat, Cowork, Claude Code, Claude Platform 전반의 요청 한도가 증가했습니다.

  • 가격 구조*는 두 단계로 나뉩니다.

| 기간 | 입력 (per 1M) | 출력 (per 1M) |

|---|---|---|

| ~2026-08-31 | $2 | $10 |

| 2026-09-01~ | $3 | $15 |

새 토크나이저로 인해 동일 입력이 콘텐츠 유형에 따라 1.0~1.35배 토큰이 될 수 있지만, 도입기 가격은 Sonnet 4.6에서 Sonnet 5로의 전환이 대체로 비용 중립이 되도록 설정됐습니다.

  • --

Sonnet 5를 어떻게 활용할까 — 실전 가이드

에이전트형 Sonnet 5를 처음 쓰려는 개발자를 위한 권장 워크플로우입니다.

1. 중간 effort부터 시작하기

무조건 높은 effort로 시작하지 마세요. 중간 effort에서 Sonnet 5의 비용 효율이 가장 크게 살아납니다. 작업이 실패하거나 품질이 부족할 때만 effort를 올리세요.

2. 멀티모달 컴퓨터 사용은 Sonnet에서

Hacker News 토론에서 나온 인사이트입니다. 순수 입력 토큰량이 중요한 작업(예: 멀티모달 컴퓨터 사용)은 Opus의 추론을 낮춘다고 더 효율이 되지 않습니다. Sonnet 같은 저렴한 모델이 이런 영역에서 효과적입니다.

3. 코딩 + 비코딩 혼합 작업에 강점 활용

Sonnet 5가 특히 잘하는 영역은 여러 시스템을 오가며 끝까지 완수하는 작업입니다. 단순 코드 생성보다 "코드 + 외부 도구 호출 + 검증"이 결합된 워크플로우에서 효과를 체감할 수 있습니다.

4. effort 대비 비용이 손해인 작업은 Opus로

같은 비용이면 Opus가 항상 더 잘하는 구간이 존재합니다. Sonnet 5의 중간 effort가 부족하다면 effort를 올리기보다 모델 자체를 Opus로 전환하는 게 더 나은 선택일 수 있습니다.

  • --

전망 — Sonnet급의 재정의

Sonnet 5는 "Opus를 못 사서 참는 개발자를 위한 모델"에서 "Opus급 에이전트를 일상적으로 쓰는 모델"로 Sonnet급의 정체성을 다시 쓰고 있습니다. 이후 Sonnet 라인업은 단순 응답 모델이 아니라 에이전트 실행의 기본 단위로 자리 잡을 가능성이 높습니다.

비용 측면에서 8월 31일까지의 $2/$10 가격은 사실상 Sonnet 4.6과 동일한 수준(토크나이저 변화 보정 후)이므로, 신규 프로젝트는 Sonnet 5로 시작하는 것이 합리적입니다. 기존 Sonnet 4.6 기반 워크플로우는 토큰 매핑 변화만 모니터링하면 그대로 유지됩니다.

전체 시스템 카드와 정식 가격 정보는 Anthropic 공식 발표 페이지에서 확인할 수 있습니다.

  • --
  • 요약*: Claude Sonnet 5는 Opus급 에이전트 실행 능력을 Sonnet 가격대에 제공하며, 모든 플랜에서 기본 모델로 출시됐다. effort 조절을 통해 비용-성능 균형을 세밀하게 잡을 수 있고, 사이버 보호 장치는 기본 활성화됐다. 8월 31일까지는 $2/$10의 도입 가격이 유지되니, 신규 프로젝트는 Sonnet 5로 시작하는 것이 합리적이다.