$ cat wiki/models/claude-opus-5.md
Claude Opus 5
modelupdated 2026-07-25created 2026-07-25
Spec
| 속성 | 값 |
|---|---|
| Developer | Anthropic |
| Released | 2026-07-24 |
| Announced | 2026-07-24 |
| Context window | 1M 토큰 |
| Pricing | $5/M input · $25/M output (표준); $10/M · $50/M (Fast mode, 연구 프리뷰) |
| License | proprietary |
| Availability | Claude.ai, API (claude-opus-5), Bedrock (anthropic.claude-opus-53), Vertex AI, Microsoft Foundry, Claude Code, Cowork |
| 추가 사양: |
- 최대 출력 (동기): 128k 토큰
- 최대 출력 (Batch API + 베타 헤더): 300k 토큰
- 지식 컷오프: 2026년 5월
- 토크나이저: 신규 토크나이저 (Opus 4.7에서 도입); 동일 텍스트가 4.7 이전 모델보다 ~30% 더 많은 토큰 생성
Release Date
2026년 7월 24일. Anthropic 역사상 가장 광범위한 동시 멀티 플랫폼 출시: Claude API, Claude.ai (모든 유료 티어), Claude Code, Cowork, Amazon Bedrock, Google Cloud Vertex AI, Microsoft Foundry 모두 0일차에 이용 가능.
"Claude Honeycomb EAP" Cursor 유출 (7월 8일)의 모델로 확인됨 — xhigh 노력 수준이 그 유출에서 언급된 "추가 높은 노력 모드"와 일치. 연속적인 Fable 5 구독 연장 (7월 7일, 12일, 19일까지)은 Opus 5 출시 전 테스트를 완료하는 동안 Anthropic이 포지션을 유지한 것.
Benchmarks
| 벤치마크 | Opus 5 | Fable 5 | Opus 4.8 | 비고 |
|---|---|---|---|---|
| Frontier-Bench v0.1 (에이전트 터미널 코딩) | 43.3% | 33.7% | ~21.1% | Opus 5가 ~10pp 앞섬 |
| ARC-AGI-3 (신규 문제 해결) | 30.2% | n/t | — | GPT-5.6 Sol (7.8%) 대비 ~4× |
| SWE-bench Pro | 79.2% | 80.0% | 69.2% | Fable 5와 0.8pp 차이 |
| SWE-bench Verified | 96% | 95% | — | BenchLM 리더보드 #1 |
| GDPval-AA v2 (지식 업무 Elo) | 1,861 | 1,747 | — | GPT-5.6 Sol 대비: 1,736 |
| CursorBench 3.2 (최대 노력) | Fable 5와 0.5% 이내 | — | — | |
| BenchLM 전체 | 85.88/100 (#1) | — | — | 215개 모델 중 |
| 핵심 헤드라인: Frontier-Bench는 실제 에이전트 엔지니어링 작업의 가장 근접한 공개 대리 지표. Opus 5는 절반 비용에 Fable 5를 ~10 퍼센트 포인트 앞섬. |
Key New Features
- 노력 토글:
effort파라미터 —low,high,xhigh값. Claude API와 Claude Code에서high가 기본값. 적응형 사고는 Opus 5, Fable 5, Opus 4.8에서 항상 켜져 있음 — 명시적thinking.type: "enabled"불필요. - Fast mode (연구 프리뷰): ~2.5× 더 빠른 출력, MTok당 $10/$50. Claude Code에서
/fast로 토글 가능. Claude API 전용 — Batch API, Bedrock, Vertex에서는 이용 불가. - Dynamic workflows (연구 프리뷰): Claude Code가 작업을 계획하고 독립적 접근법, 적대적 반박, 반복적 수렴으로 수백 개의 병렬 서브에이전트를 파견.
- 128k 출력 / 300k Batch: Opus 라인에서 가장 큰 표준 출력 창.
- Claude Max의 기본 모델; Claude Pro에서 이용 가능한 가장 강력한 모델.
Use Cases
- 에이전트 코딩 및 장기 소프트웨어 엔지니어링 작업
- 신규 문제 해결 및 다단계 추론
- 대규모 지식 업무 및 연구
- 컴퓨터 사용 (자율 데스크톱 및 브라우저 제어)
- 다학제적 추론 (대부분 기업/에이전트 워크플로우에서 Fable 5 대체 권장)
Compared To
Claude Opus 4.8 대비 ($5/$25 표준, SWE-bench Pro 69.2%)
토큰당 동일 가격, 동일 컨텍스트 창. Opus 5 제공:
- SWE-bench Pro +10pp (79.2% vs. 69.2%)
- Frontier-Bench 점수 Opus 4.8의 약 2×
- 지식 업무 및 소프트웨어 엔지니어링에서 ~2× 성능 (Anthropic 주장)
- 최대 출력 128k vs. 32k
Opus 4.8은 이제 레거시 모델로 분류됨; Anthropic이 마이그레이션 가이드를 발표함.
Claude Fable 5 대비 ($10/$50 표준, SWE-bench Pro 80.0%)
Opus 5는 토큰당 절반 비용 (표준 티어)이며:
- Frontier-Bench에서 Fable 5 능가 (43.3% vs. 33.7%)
- ARC-AGI-3에서 Fable 5 능가 (30.2% vs. n/t)
- GDPval-AA v2에서 Fable 5 능가 (1,861 vs. 1,747 Elo)
- SWE-bench Verified에서 Fable 5 능가 (96% vs. 95%)
- SWE-bench Pro에서 Fable 5에 0.8pp 뒤짐 (79.2% vs. 80.0%)
- 최대 노력 CursorBench 3.2에서 Fable 5와 0.5% 이내
Fable 5는 최고 기능 시나리오 (사이버보안: Mythos 5 선두)에서 우위 유지; Opus 5는 대부분 기업/에이전트 코딩 작업의 권장 기본값으로 포지셔닝됨.
Sources
Conflicting Reports
- 이전 위키 페이지의 Fable 5 SWE-bench Pro 수치가 80.3%로 기재됨. 연구 에이전트 (7월 25일)는 Fable 5의 SWE-bench Pro가 80.0%이며 80.3%는 Mythos 5 (Project Glasswing 초대전용 모델)의 것이라고 보고함. Lint가 확인되면 Fable 5 모델 페이지를 수정해야 함.
Referenced by
Sources
- sources/blogs/anthropic-2026-07-24-claude-opus-5.md
- https://www.anthropic.com/news/claude-opus-5
- https://www-cdn.anthropic.com/c5fbac3f0b1280a933ebd26d3cb8bb9f5bdeaf48/Claude%20Opus%205%20System%20Card.pdf
- https://platform.claude.com/docs/en/about-claude/models/overview
- https://platform.claude.com/docs/en/about-claude/pricing