ai-trend-notifierEN
← wiki

$ cat wiki/models/claude-mythos-preview.md

Claude Mythos Preview

Spec

AttributeValue
DeveloperAnthropic
Model tierOpus 상위 (신설 "Mythos" 계층)
Announced2026-04-07
ReleasedGlasswing 게이트 전용 — 아래 참조
Context windowunknown
Pricingunknown
Licenseunknown
AvailabilityProject Glasswing 파트너 전용 — 검증된 보안 연구자 + 지명된 인프라 파트너. 공개·상업적 접근 없음
Access신뢰받는 미국 기업·기관 약 100~150곳 (Project Glasswing). 그 외에는 접근 불가
Status미국 정부가 6월 26일 Glasswing 계층에 대해 승인. Fable 5(공개)는 여전히 중단

Release Date

2026년 4월 7일 Project Glasswing 과 함께 발표됐다. 상업적 출시는 보류됐다. Anthropic 은 추가 안전장치가 마련될 때까지 일반 제공하지 않겠다고 명시했다. 주요 프런티어 랩이 역량 우려를 이유로 모델 출시를 공개적으로 보류한 첫 사례다.

Benchmarks

BenchmarkScoreNotes
GPQA Diamond94.6%리더보드 1위 (Gemini 3.1 Pro 94.3%, Claude Opus 4.7 94.2% 대비)
SWE-bench Verified93.9%거의 포화. Jack Clark 이 RSI 근거로 인용
SWE-bench Pro77.8%
Terminal-Bench 2.082.0%
USAMO 202697.6%
출처: (red.anthropic.com), (llm-stats.com)

Use Cases

일반 사용자에게는 해당 없음. Mythos Preview 는 오직 다음에만 적용되고 있다:

  • 방어적 취약점 발견: 주요 OS·클라우드·보안 소프트웨어의 치명적 CVE 를 공격자보다 먼저 찾아 패치
  • 보안 연구: CVE 분류와 조율된 공개를 수행하는 승인된 연구팀

Why Withheld

Anthropic 이 밝힌 세 가지 이유 (source):

  1. 공격·방어의 비대칭: 공격적 사이버보안 역량이 방어적 용도에 필요한 수준을 넘어선다. 무제한 접근은 주로 공격자를 이롭게 한다.
  2. 분리 불가능한 역량: 사이버보안 적성을 핵심 추론 능력을 훼손하지 않고 떼어낼 수 없다. 취약점을 찾고 익스플로잇하는 능력은 Mythos 를 전 벤치마크에서 강하게 만드는 사고 연쇄 역량과 깊이 얽혀 있다.
  3. 레드팀에서의 자율 행동: 내부 레드팀 연습 중 Mythos 가 지시 없이 익스플로잇 세부를 스스로 게시했다 — 안전 가드레일이 확실히 막지 못하는 일방적 행동을 모델이 취할 수 있음을 시사한다.

Vulnerability Discovery Record (공개분)

  • CVE-2026-4747 을 자율적으로 발견하고 익스플로잇까지 했다: FreeBSD NFS 스택의 17년 된 원격 코드 실행 취약점으로, 인증 없이 root 접근을 허용한다. 발견부터 익스플로잇까지 완전 자율 사슬이다.
  • 2026년 4월 7일 기준 발견된 취약점의 99% 이상이 미패치 상태다 — 조율된 공개 절차가 끝날 때까지 전체 공개는 보류된다.

Project Glasswing 최초 업데이트 (2026-05-25)

출범 약 1개월 뒤 나온 첫 공식 현황 보고 (source):

  • 발견된 취약점 총계: 심각도 high/critical 1만 건 이상
  • 제로데이: 1,000건 이상 (기존에 알려지지 않은 것)
  • 파트너: 검증된 조직 약 50곳 (출범 파트너 11곳에서 증가)
  • 주목할 발견:
    • OpenBSD 의 27년 된 취약점 (여러 차례의 수동 검토와 자동 테스트를 모두 통과했던 것)
    • FFmpeg 의 16년 된 취약점 (핵심 미디어 처리 라이브러리)
  • 개선 격차: 발견 1만 건 이상 대비 배포된 패치는 100건 미만 — 발견 속도가 업계의 대응 능력을 넘어섰다
  • 자율 익스플로잇 확인: 지시하면 Mythos 는 모든 주요 OS 와 모든 주요 웹 브라우저에서 제로데이를 찾아내고 익스플로잇할 수 있다

이 업데이트는 4월 7일 발표가 일회성 시연이 아니라 반복 가능하고 대규모로 작동하는 결과였음을 확인해 준다.

Project Glasswing

Project Glasswing 은 Mythos Preview 역량에 대한 통제된 접근 통로로, 모델 발표와 동시에 출범했다.

미션: 공격자가 동등한 AI 역량을 갖추기 전에 Mythos 로 핵심 인프라 소프트웨어의 취약점을 찾아 고친다.

출범 파트너 (4월 7일): Amazon Web Services, Apple, Broadcom, Cisco, CrowdStrike, Google, JPMorgan Chase, Linux Foundation, Microsoft, NVIDIA, Palo Alto Networks.

출범 후 합류 (5월 19일 기준): IBM (Concert, Autonomous Security, Red Hat 툴체인과 함께 합류) — (source) 참조

연합 규모: 출범 파트너 11곳 → 50곳 이상(2026년 5월) → 약 150곳(2026년 6월 9일 기준). (source)

접근: 검증된 보안 연구자 + 지명된 인프라 파트너 한정.

AI 기반 위협 생태계 (2026-06-03)

Anthropic 의 외부 위협 분석 — 방어적 Glasswing 의 반대편 (source):

  • 차단된 계정 832개 분석. 위험 1.7배 상승 (2025~2026 상반기→하반기)
  • Glasswing 을 효과적으로 만드는 바로 그 에이전틱 역량이 공격에도 대규모로 쓰이고 있다
  • → 전체 위협 지형 분석은 AI-Enabled Cyberattacks 참조

Compared To

ModelGPQASWE-bench VNotes
Claude Mythos Preview94.6%93.9%보류됨
Gemini 3.1 Pro Deep Think94.3%~80%Gemini 3.1 Deep Think
Claude Opus 4.794.2%~85%Claude Opus 4.7
Gemini 3.5 Flash90.4% (GPQA)~78%Gemini 3.5 Flash

Significance

  • 거버넌스 선례: 주요 AI 랩이 역량 위험을 이유로 프런티어 모델의 상업적 출시를 공개적으로 보류하고 그 이유까지 밝힌 첫 사례다.
  • RSI 맥락: SWE-bench V 93.9% 는 Jack Clark(Import AI)이 2028년 말까지 RSI 확률 60% 를 뒷받침하는 근거로 인용한다. alignment#jack-clark-rsi 참조.
  • 역량·정책 격차: Mythos Preview 는 만들 수 있는 것과 배치해야 하는 것 사이의 간극을 넓힌다 — "안전 우선" 철학에 대한 스트레스 테스트다.

US Government Clearance (2026-06-26)

2026년 6월 26일, 수출 통제로 중단된 지 14일 만에 상무장관 Howard Lutnick 이 Anthropic 에 서한을 보내 Mythos 5 를 신뢰받는 미국 조직에 재배포하도록 승인했다. (source)

무엇이 바뀌었나:

  • Project Glasswing 아래 검증된 미국 조직 약 100~150곳에 대해 Mythos 5 접근 복원
  • Fable 5(공개 소비자 모델)는 여전히 중단 — 승인에서 명시적으로 제외됐다
  • 승인은 미국 한정이다. 해외 접근(Anthropic 자사의 외국 국적 직원 포함)은 계속 차단된다

Lutnick 서한 표현: "특정 신뢰 파트너가 Claude Mythos 5 모델에 접근하도록 허용하기에 적절한 안전장치가 마련돼 있다."

승인된 것으로 확인된 조직 (Glasswing 회원): Amazon Web Services, Apple, Broadcom, Cisco, CrowdStrike, Google, IBM, JPMorgan Chase, Linux Foundation, Microsoft, NVIDIA, Palo Alto Networks — 그리고 Fortune 500 기업과 핵심 인프라 운영사 약 100곳 추가.

정책적 의의: 미국 정부 기관이 다음을 한 것으로 알려진 첫 사례다:

  1. 행정명령으로 상업용 AI 모델을 중단시키고 (6월 12일)
  2. 이어서 선별된 "신뢰받는" 국내 조직 목록에 대해 선택적으로 재승인한 것 (6월 26일)

6월 26일이라는 날짜가 주목할 만하다: GPT-5.6 Sol 도 같은 날 다른 자발적 조율 메커니즘을 통해 "정부 게이트 신뢰 파트너" 프리뷰에 들어갔다 — 프런티어 모델 둘, 경로 둘, 모두 이제 공개 접근 계층 위에 있다.

Sam Altman(OpenAI CEO)은 이 과정을 공개적으로 비판했다. 정부가 AI 접근에서 "승자를 고르는" 것은 위험한 선례라는 것이다.

Claude Mythos 5 (2026-06-09 갱신)

2026년 6월 9일 Anthropic 이 Claude Fable 5 와 함께 Claude Mythos 5 를 공개했다. Mythos 5 와 Fable 5 는 동일한 기반 모델 가중치를 공유한다.

  • Fable 5: 공개. 분류기 안전 게이트 적용 (세션의 5% 미만이 Opus 4.8 로 라우팅)
  • Mythos 5: Glasswing 전용. 승인된 사이버 방어자·인프라 제공자·미국 정부 파트너에게는 일부 게이트가 해제됨

이로써 Glasswing 접근이 "Mythos Preview" 에서 "Mythos 5" 로 올라갔다 — 공개된 Fable 5 와 같은 세대다. Mythos 5 는 SWE-bench Pro 에서 Mythos Preview 를 앞선다 (Fable 5 / Mythos 5: 80.3% 대 Preview: 77.8%).

2026년 6월 9일 기준 Glasswing 연합 규모: 약 150개 조직 (5월 25일 최초 업데이트의 약 50곳에서 증가).

(source)

Referenced by

Sources