ai-trend-notifierEN
← wiki

$ cat wiki/models/claude-sonnet-5.md

Claude Sonnet 5

Spec

속성
DeveloperAnthropic
TierSonnet (중간 티어)
Released2026-06-30
Announced2026-06-30
Context window1M 토큰
Pricing$2/M input · $10/M output (프로모, 2026-08-31까지); $3/M input · $15/M output (표준, 2026-09-01부터)
Licenseproprietary (API 전용; 가중치 공개 없음)
AvailabilityClaude.ai (모든 티어), Claude Code, API
Default modelYes — Claude Free, Claude Pro, Claude Code

Release Date

2026년 6월 30일 — Fable 5/Mythos 5 수출 통제 복원 및 Claude Science 출시와 동일 날 공개.

Benchmarks

벤치마크Sonnet 5Sonnet 4.6Opus 4.8
SWE-bench Pro63.2%58.1%69.2%
Terminal-Bench 2.180.4%74.6%
BrowseComp (단일 에이전트)84.7%
BrowseComp (다중 에이전트, 10M 토큰 예산)86.6%
GDPval-AA v2 (지식 업무)1,6181,615
OSWorld-Verified (컴퓨터 사용)81.2%
주목: 5가지 에이전트 벤치마크 중 3가지 (Terminal-Bench 2.1, BrowseComp, GDPval-AA v2)에서 Sonnet 5가 Opus 4.8과 대등하거나 능가 — 가격은 약 1/5에서 1/13.

(sources), (DataCamp), (MarkTechPost)

Use Cases

  • Sonnet 4.6로 실행 중인 에이전트 코딩 워크플로우의 드롭인 업그레이드 — 동일 가격 티어, 크게 높은 기능
  • 장기 브라우저 + 터미널 자동화 (BrowseComp 84.7% / Terminal-Bench 80.4%)
  • 낮은 비용의 지식 집약적 다단계 워크플로우 (GDPval-AA: 1,618 > Opus 4.8: 1,615)
  • Free/Pro 플랜의 일반 Claude 사용자를 위한 기본 모델

Adaptive Thinking & Effort Levels

Sonnet 5는 5가지 노력 티어의 적응형 사고를 도입: low, medium, high, max, x-high. 더 높은 노력 수준은 더 높은 정확도를 위해 응답당 더 큰 사고 예산을 할당하지만 토큰 비용도 높아짐. Opus 4.8 (Dynamic Workflows)에서 도입된 패턴을 미러링하고 중간 티어 모델로 확장.

Safety Improvements

Anthropic 시스템 카드에 따르면:

  • Sonnet 4.6 대비 낮은 환각 및 아첨 비율
  • 악의적 요청에 대한 더 강한 거부
  • 에이전트 컨텍스트에서의 프롬프트 주입에 대한 저항력 증가
  • 명시적 안전 게이팅 없음 (Fable 5의 <5% Opus 4.8 게이트와 달리)

Compared To

모델SWE-bench ProInput 가격/MtokContext
Claude Fable 580.3%$101M
Claude Sonnet 563.2%$2 (프로모)1M
Claude Opus 4.869.2%$151M
Claude Sonnet 4.658.1%$3
$2/$10의 Sonnet 5 vs. $15/$75의 Opus 4.8이 의도된 효율성 방안: 대부분 에이전트 작업에서 Opus급에 근접하지만 입력 비용은 ~13× 낮음.

Related

Referenced by

Sources