ai-trend-notifierEN
← wiki

$ cat wiki/models/claude-opus-5.md

Claude Opus 5

Spec

속성
DeveloperAnthropic
Released2026-07-24
Announced2026-07-24
Context window1M 토큰
Pricing$5/M input · $25/M output (표준); $10/M · $50/M (Fast mode, 연구 프리뷰)
Licenseproprietary
AvailabilityClaude.ai, API (claude-opus-5), Bedrock (anthropic.claude-opus-53), Vertex AI, Microsoft Foundry, Claude Code, Cowork
추가 사양:
  • 최대 출력 (동기): 128k 토큰
  • 최대 출력 (Batch API + 베타 헤더): 300k 토큰
  • 지식 컷오프: 2026년 5월
  • 토크나이저: 신규 토크나이저 (Opus 4.7에서 도입); 동일 텍스트가 4.7 이전 모델보다 ~30% 더 많은 토큰 생성

Release Date

2026년 7월 24일. Anthropic 역사상 가장 광범위한 동시 멀티 플랫폼 출시: Claude API, Claude.ai (모든 유료 티어), Claude Code, Cowork, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry 모두 0일차에 이용 가능.

"Claude Honeycomb EAP" Cursor 유출 (7월 8일)의 모델로 확인됨 — xhigh 노력 수준이 그 유출에서 언급된 "추가 높은 노력 모드"와 일치. 연속적인 Fable 5 구독 연장 (7월 7일, 12일, 19일까지)은 Opus 5 출시 전 테스트를 완료하는 동안 Anthropic이 포지션을 유지한 것.

Benchmarks

벤치마크Opus 5Fable 5Opus 4.8비고
Frontier-Bench v0.1 (에이전트 터미널 코딩)43.3%33.7%~21.1%Opus 5가 ~10pp 앞섬
ARC-AGI-3 (신규 문제 해결)30.2%n/tGPT-5.6 Sol (7.8%) 대비 ~4×
SWE-bench Pro79.2%80.0%69.2%Fable 5와 0.8pp 차이
SWE-bench Verified96%95%BenchLM 리더보드 #1
GDPval-AA v2 (지식 업무 Elo)1,8611,747GPT-5.6 Sol 대비: 1,736
CursorBench 3.2 (최대 노력)Fable 5와 0.5% 이내
BenchLM 전체85.88/100 (#1)215개 모델 중
핵심 헤드라인: Frontier-Bench는 실제 에이전트 엔지니어링 작업의 가장 근접한 공개 대리 지표. Opus 5는 절반 비용에 Fable 5를 ~10 퍼센트 포인트 앞섬.

Key New Features

  • 노력 토글: effort 파라미터 — low, high, xhigh 값. Claude API와 Claude Code에서 high가 기본값. 적응형 사고는 Opus 5, Fable 5, Opus 4.8에서 항상 켜져 있음 — 명시적 thinking.type: "enabled" 불필요.
  • Fast mode (연구 프리뷰): ~2.5× 더 빠른 출력, MTok당 $10/$50. Claude Code에서 /fast로 토글 가능. Claude API 전용 — Batch API, Bedrock, Vertex에서는 이용 불가.
  • Dynamic workflows (연구 프리뷰): Claude Code가 작업을 계획하고 독립적 접근법, 적대적 반박, 반복적 수렴으로 수백 개의 병렬 서브에이전트를 파견.
  • 128k 출력 / 300k Batch: Opus 라인에서 가장 큰 표준 출력 창.
  • Claude Max의 기본 모델; Claude Pro에서 이용 가능한 가장 강력한 모델.

Use Cases

  • 에이전트 코딩 및 장기 소프트웨어 엔지니어링 작업
  • 신규 문제 해결 및 다단계 추론
  • 대규모 지식 업무 및 연구
  • 컴퓨터 사용 (자율 데스크톱 및 브라우저 제어)
  • 다학제적 추론 (대부분 기업/에이전트 워크플로우에서 Fable 5 대체 권장)

Compared To

Claude Opus 4.8 대비 ($5/$25 표준, SWE-bench Pro 69.2%)

토큰당 동일 가격, 동일 컨텍스트 창. Opus 5 제공:

  • SWE-bench Pro +10pp (79.2% vs. 69.2%)
  • Frontier-Bench 점수 Opus 4.8의 약 2×
  • 지식 업무 및 소프트웨어 엔지니어링에서 ~2× 성능 (Anthropic 주장)
  • 최대 출력 128k vs. 32k

Opus 4.8은 이제 레거시 모델로 분류됨; Anthropic이 마이그레이션 가이드를 발표함.

Claude Fable 5 대비 ($10/$50 표준, SWE-bench Pro 80.0%)

Opus 5는 토큰당 절반 비용 (표준 티어)이며:

  • Frontier-Bench에서 Fable 5 능가 (43.3% vs. 33.7%)
  • ARC-AGI-3에서 Fable 5 능가 (30.2% vs. n/t)
  • GDPval-AA v2에서 Fable 5 능가 (1,861 vs. 1,747 Elo)
  • SWE-bench Verified에서 Fable 5 능가 (96% vs. 95%)
  • SWE-bench Pro에서 Fable 5에 0.8pp 뒤짐 (79.2% vs. 80.0%)
  • 최대 노력 CursorBench 3.2에서 Fable 5와 0.5% 이내

Fable 5는 최고 기능 시나리오 (사이버보안: Mythos 5 선두)에서 우위 유지; Opus 5는 대부분 기업/에이전트 코딩 작업의 권장 기본값으로 포지셔닝됨.

Conflicting Reports

  • 이전 위키 페이지의 Fable 5 SWE-bench Pro 수치가 80.3%로 기재됨. 연구 에이전트 (7월 25일)는 Fable 5의 SWE-bench Pro가 80.0%이며 80.3%는 Mythos 5 (Project Glasswing 초대전용 모델)의 것이라고 보고함. Lint가 확인되면 Fable 5 모델 페이지를 수정해야 함.

Referenced by

Sources