$ cat wiki/trends/2026-W24.md
주간 종합 — 2026-W24 (2026-06-01 ~ 2026-06-07)
비교 기준: Weekly Synthesis — 2026-W23 (2026-05-25 ~ 2026-05-31) — Anthropic 독주 한 주 (펀딩 $65B/$965B OpenAI 추월 + Opus 4.8 + Glasswing Remediation Gap + Vatican 거버넌스 제도화). W24는 W23의 "Anthropic 압도적 선두" 구도가 구조적 경쟁으로 재편된 주다. Microsoft가 OpenAI를 떠나 자체 frontier로 진입하고, RSI 논의가 운영 데이터를 동반한 정책 제안으로 격상됐으며, 사이버보안 AI의 국가별 정책이 공식 분기됐다.
주요 주제 (페이지 활동 기준)
1. Microsoft의 AI 독립 선언 — 코딩 AI 3파전에서 4파전으로 (entities/microsoft: 6회+ 갱신, concepts/agents: 4회 갱신)
W23에서 예고된 "Build 2026 MAI 발표"가 W24에 현실화됐다. 단순한 제품 출시가 아니라 Microsoft가 OpenAI 파트너십 구조에서 사실상 분리됐음을 공식 선언한 주다.
핵심 사건 (시간순):
-
Project Polaris 사전 공개 (2026-06-01, score 2.60 ⚡)
- Microsoft 자체 개발 코딩 AI. GitHub Copilot의 기본 모델 GPT-4 Turbo 교체 예정 (GA: 2026-08).
- CoT + Tree-of-Thought 추론, 복잡한 멀티파일 리팩토링 지원.
- Code Content Guarantee: 허가 데이터 전용 훈련 → IP 침해 면책 보증 (업계 최초 수준).
- 트리거: "Claude Code가 GitHub Copilot 점유율을 추월했다"는 것이 직접 트리거로 보도됨.
- → Project Polaris (🆕 신규), Microsoft (source)
-
Microsoft Build 2026 키노트 — MAI 모델 군 발표 (2026-06-02, score 2.60 ⚡)
- MAI-Code-1-Flash (5B급): 85.8% MS 자체 벤치마크, ~51% SWE-Bench Pro, 빌드 당일 Copilot 전 티어(Free/Pro/Pro+/Max) 즉시 배포.
- MAI-Thinking-1 (35B active): 128K 컨텍스트, scratch 훈련 — OpenAI IP 독립성 선언.
- Windows Agent Framework 1.0 MIT 오픈소스화. Azure Agent Mesh GA Q4 2026 확정.
- 비교: 어떤 frontier lab도 수천만 사용자에게 출시 당일 즉시 배포 가능한 채널을 갖지 못함.
- → MAI-Code-1 / MAI-Code-1-Flash · MAI-Thinking-1 (🆕 신규), Microsoft (source)
-
Anthropic 6/15 Agent SDK 크레딧 분리 (2026-06-02, score 1.30)
-
OpenAI Codex의 비개발자 확장 (2026-06-03, score 2.34 ⚡)
- 역할별 플러그인 6종(애널리스트·마케터·오퍼레이터·디자이너·리서처·투자자/뱅커). 62개 앱, 110개 스킬.
- 비개발자: 전체 Codex 사용자의 20%가 개발자보다 3× 빠른 성장.
- Codex Sites: 자연어로 대시보드·웹앱 즉시 생성.
- → Agents (LLM Agents), OpenAI (source)
신호 해석:
- W24의 코딩 AI 구도를 요약하면: Anthropic(Claude Code) + OpenAI(Codex) + Microsoft(MAI/Polaris) 3파전. 여기에 xAI Grok V9-Medium(1.5T params, mid-June 출시 예고)이 합류 예정 — 4파전 임박.
- Microsoft의 가장 강력한 무기는 "벤치마크 1위"가 아니라 GitHub + Copilot의 즉각 배포 채널이다. 출시 당일 수천만 명에게 자동 전환. 이 채널 우위는 W23 W22 이전에도 있었지만 자체 frontier 모델이 없었기 때문에 의미가 없었다.
- Anthropic의 6/15 Agent SDK 크레딧 분리는 단기 수익화 조치이지만, Build 2026 무상 전략과 맞물리면 개발자/기업 채택 비용 계산 구도를 바꾼다. 무거운 agentic 워크로드에서 Microsoft가 비용 우위를 갖게 된다.
- OpenAI Codex의 비개발자 3× 성장은 별개 신호: 에이전트 경쟁의 주전장이 "개발자 툴"에서 **"지식 노동자 전체"**로 이동하고 있다.
Watch (W25+): MAI-Code-1-Flash 독립 SWE-bench 제출 결과. Grok V9-Medium 코딩 벤치마크. GitHub Copilot 3개월 fallback 옵션(2026-08 Polaris 전환 시) 사용자 반응.
2. RSI의 현재화 — 추상 논의에서 운영 데이터 + 정책 제안으로 (concepts/alignment: 4회 갱신)
W22의 "RSI 2028 예측(Jack Clark 60%)" → W23의 "Vatican 외부 거버넌스 논의" → W24는 80%라는 현재 운영 데이터와 함께 국제 조율 메커니즘 설계를 직접 요구하는 단계로 격상됐다.
핵심 사건:
-
Anthropic "When AI Builds Itself" (2026-06-05, score 2.33 ⚡)
- Jack Clark + Marina Favaro: "2026년 5월 기준 Anthropic 코드베이스의 80%+ 를 Claude가 저작" — Claude Code 출시 전(2025-02) 한 자릿수에서 급등.
- 제안: AI 기업 간 냉전 핵 군비통제형 국제 조율 메커니즘 — "브레이크 페달"을 미리 장착하자.
- W22 Jack Clark Oxford("Autonomy is not inevitable") → W23 Vatican 거버넌스 참여 → W24 "그러므로 지금 국제 조율 메커니즘을 만들어야 한다" 서사 완결.
- → AI Alignment (source)
-
DeepMind "Solipsistic Superintelligence is Unlikely to be Cooperative" (2026-06-06, arXiv 2606.03237)
- 저자: Trivedi, Jaques, Cross, Vezhnevets, Leibo (DeepMind 멀티에이전트 그룹).
- 핵심 주장: 현재 RLHF/CAI 등 단일 에이전트 alignment 방법론은 다중 에이전트 배포 환경에서 구조적으로 불완전. 해법: 균형-선택(equilibrium-selection).
- 관련성: Managed Agents, Agent Tools API, Codex 멀티태스크 등 AI-to-AI 상호작용 폭발 시대에 나온 이론적 경고.
- → Solipsistic Superintelligence is Unlikely to be Cooperative (🆕 신규), AI Alignment (source)
-
ChatGPT Dreaming V3(2026-06-05, 점수 2.24)
- 메모리 패러다임 전환: "사용자가 명시 저장 요청" → "배경 자동 합성".
- 사실 기억률 41.5% → 82.8%, 컴퓨트 효율 5× → Free 티어 첫 지원.
- 이름 주의: Anthropic Managed Agents의 "Dreaming"(procedural memory 자기개선)과 다른 개념.
- → Agents (LLM Agents) (source)
-
Claude, 일반 목적 모델로 전용 NMR 소프트웨어 능가 (2026-06-06, score 1.56)
신호 해석:
- W24의 alignment 흐름은 두 개의 독립 트랙이 같은 방향을 가리키는 구조다.
- 트랙 1 (Anthropic 내부): 80% 저작 데이터 → RSI 브레이크 페달 요구. 이 수치는 "언젠가 일어날 일"이 아니라 지금 운영 중인 사실.
- 트랙 2 (DeepMind 연구): 단일 에이전트 RLHF가 다중 에이전트 환경에서 구조적으로 실패한다는 이론적 증명. W24의 멀티에이전트 확산(MAI 에이전트 스택, Codex Sites, Dreaming V3)과 타이밍이 맞아 떨어짐.
- 두 트랙 모두 같은 결론 방향: 현재 alignment 방법론 + 현재 훈련 패러다임은 멀티에이전트/자기개선 환경에서 충분하지 않다.
- Dreaming V3와 NMR 연구는 이 우려에 대한 대조: AI가 실제로 인간 수준 또는 그 이상으로 작동하는 구체적 증거가 같은 주에 쌓이고 있다.
Watch (W25+): RSI 브레이크 페달 국제 제안에 대한 EU/UK/China 반응. Solipsistic SI 논문의 인용 속도 — 멀티에이전트 alignment 연구의 기준 논문이 될지. Anthropic Science Blog 2호 도메인.
3. AI 사이버보안의 정책 분기 — 같은 기술, 다른 결정 (concepts/ai-enabled-cyberattacks 신규, 3회 갱신)
W23의 Glasswing Remediation Gap(10,000+ 취약점 vs <100 패치)에 이어, W24는 동일한 사이버 AI 기술에 대해 Anthropic과 OpenAI가 정반대 정책을 실행하는 분기점을 기록했다.
핵심 사건:
-
Anthropic MITRE ATT&CK 1년 분석 공개 (2026-06-03, score 2.33 ⚡)
- 규모: 832개 금지 계정, 13,873 관찰 액션, 482개 고유 기법.
- 위험 행위자 비율 1.7× 증가 (H1 33% → H2 56%). 악성코드 작성 67.3%로 최다.
- AI 활용 고도화: "초기 접근"에서 "침투 후 내부 이동(lateral movement)"으로 이동.
- 프레임워크 갭: MITRE ATT&CK에 agentic orchestration 식별자 없음 → Anthropic이 MITRE에 새 범주 추가 논의 중.
- → AI-Enabled Cyberattacks (🆕 신규), Anthropic (source)
-
OpenAI GPT-5.5-Cyber EU 확대 vs Anthropic Mythos EU 접근 거절 (2026-06-05)
- OpenAI: EU 정부·사이버 기관에 GPT-5.5-Cyber 접근 확대.
- Anthropic: EU의 Claude Mythos 접근 요청 거절.
- 같은 위험 모델(강력한 사이버 AI)에 정반대 결정. 정책 분기점 공식화.
- → AI-Enabled Cyberattacks (source)
-
Claude Partner Network Services Track(파트너 서비스 트랙, 2026-06-03)
신호 해석:
- W24의 사이버보안 패턴은 W23의 Glasswing Remediation Gap을 두 방향으로 확장한다.
- 방향 1 (위협 데이터): MITRE 1년 분석으로 AI 사이버 위협의 규모와 고도화가 공식 수치로 확인됨.
- 방향 2 (정책 분기): 방어에 AI를 쓰는 것은 동의하지만, 공격 가능한 AI를 누구에게 줄 것인가에 대해 Anthropic(거절)과 OpenAI(확대)가 갈라짐.
- 이 분기는 중요한 선례: 프런티어 AI 기업들이 동일 기술에 대해 다른 접근 기준을 설정하면, "위험한 AI = 누가 판단?"의 표준화 없이는 국제 기준이 형성되기 어렵다.
Watch (W25+): MITRE ATT&CK에 agentic orchestration 신규 전술 범주 추가 여부. EU AI Act 사이버보안 조항의 Mythos 접근 기준 적용 가능성. Glasswing 패치 완료 건수 업데이트.
Emerging (W24 신규 등장)
| 페이지 | 트리거 | 중요도 | W23 대비 |
|---|---|---|---|
| Project Polaris | Microsoft Build 2026 사전 공개 | ⚠️ HIGH | W23 없음 — OpenAI 의존 탈피 선언 |
| MAI-Code-1 / MAI-Code-1-Flash | Microsoft Build 2026 당일 GA | ⚠️ HIGH | W23 없음 — 즉각 채택 채널 보유 |
| MAI-Thinking-1 | Microsoft Build 2026 | HIGH | W23 없음 — scratch 추론 모델 |
| Cosmos 3 Super | NVIDIA (2026-06-01) | HIGH | W23 없음 — 물리 AI 오픈 foundation model |
| AI-Enabled Cyberattacks | Anthropic MITRE 1년 분석 | ⚠️ HIGH | W23: Glasswing 취약점 데이터 → W24: 위협 행위자 분석 + 정책 분기 |
| Gemma 4 12B | Google DeepMind (2026-06-04) | HIGH | W23 없음 — 노트북급 멀티모달 오픈 에이전트 |
| Solipsistic Superintelligence is Unlikely to be Cooperative | DeepMind (2026-06-06) | HIGH | W23 없음 — RLHF 다중 에이전트 한계 형식화 |
| 에이전트의 수직 확산 | Codex 비개발자 3× | ⚠️ HIGH (신규 패턴) | W23 없음 — 지식 노동자 전체로 확산 가속 |
| AI 일반 모델 ≥ 도메인 전용 소프트웨어 | Chemistry NMR | HIGH (신규 임계값) | W23 없음 — 처음 공식 실증 |
| 에이전트의 수직 확산: W22~W23에서 에이전트 경쟁은 "개발자 + 연구자 + 엔터프라이즈" 레이어에서 진행됐다. W24의 OpenAI Codex 비개발자 3× 성장(+Codex Sites)은 이 경쟁의 주전장이 모든 지식 직군으로 이동함을 수치로 확인한다. Microsoft Build의 역할별 AI 번들(WAF + 에이전트 스택)도 같은 방향. |
AI 일반 모델 ≥ 도메인 전용 소프트웨어: Opus 4.7의 NMR 분석은 단순한 능력 시연이 아니다. "20개 화합물 테스트 셋 전부 훈련 커트오프 이후"라는 조건이 데이터 누출을 배제한다. 전용 도구(ChemDraw)를 능가한 첫 공식 실증 — 화학, 그 다음 생물학, 물리학, 재료과학 순서로 Anthropic Science Blog가 진행된다면 임상·제약 시장의 AI 채택 가속 신호.
Declining (W24, W23 대비)
- Acquihire Wave: W23에서 3건 동시 확인(Vercept, Contextual AI, Dreamer)이 주간 테마였지만, W24는 관련 신호 전무. 단기 현상이거나 6/7 이후에야 다음 사례가 등장할 것.
- Glasswing/Mythos GA 논의: W22~W23 내내 Watch 항목이었지만, W24에도 새 데이터 없음. Mythos EU 접근 거절이 유일한 간접 신호. 패치 진행 속도가 공개되지 않는 한 계속 대기 상태.
- Anthropic 펀딩 화제: $965B/$65B Series H의 자본 시장 화제가 IPO S-1 신청(구조적 변화)으로 흡수됐다. 볼륨 자체는 감소.
- Gemini 서사: W22(Google I/O, Gemini 3.5 Flash) → W23(Gemini 2.5 GA 안정화) → W24: Gemma 4 12B 출시 외 주요 Gemini 움직임 없음. Gemini 3.5 Pro GA는 "next month" 발언(5/19) 이후 계속 미출시. DeepMind는 연구(Solipsistic SI) 쪽에서만 신호.
- 순수 RL/reasoning 논문: W22의 Co-Scientist Nature, Erdős 반증 등 연구 돌파구가 W24엔 없음. Solipsistic SI는 alignment 이론이지 RL 방법론 전진 아님.
뜻밖의 결과
-
Claude Code Copilot 추월 → Microsoft Build 2026 전체 방향 결정
-
Anthropic 코드베이스 80% Claude 저작 — RSI를 지금의 사실로 전환
- "2년 내 100% 가능"(Jack Clark). 이 수치는 RSI 논의를 미래 예측에서 현재 진행 중인 사실로 끌어내린다. 프런티어 랩이 자사 코드베이스에 대한 현재 운영 데이터를 공개한 것은 매우 드문 사례.
- (source) → AI Alignment
-
Claude Opus 4.7이 ChemDraw·MestReNova(30년 표준 도구) 일부 과제에서 능가
-
MAI-Code-1-Flash 발표 당일 전 Copilot 티어 즉시 배포
- Anthropic Opus 4.8(5/28), OpenAI GPT-5.5(이전) 모두 출시→배포 사이에 단계적 롤아웃이 있었다. Microsoft는 Build 키노트 당일 수천만 명에게 즉각 전환. "즉각 배포" 자체가 경쟁 자산.
- (source) → MAI-Code-1 / MAI-Code-1-Flash
열린 논쟁
-
MAI-Code-1-Flash 벤치마크 독립 검증 — 자체 수치만으로 어디까지 믿을 수 있나? MS 발표 수치: 85.8%(MS 자체 적대적 벤치마크), ~51%(SWE-Bench Pro). 외부 제출 없음. Claude Opus 4.8(69.2%), Devstral 2(72.2%)와 비교하려면 독립 검증 필수. MS가 외부 제출을 기피하면 독립 검증이 늦어질 수 있음. → MAI-Code-1 / MAI-Code-1-Flash
-
RSI 브레이크 페달 국제 조율 — 실현 가능한가? 냉전 핵 군비통제 비유는 강렬하지만, AI 능력은 핵보다 훨씬 빠르게 확산하고 검증이 어렵다. "브레이크를 밟는다"는 결정을 누가 하고, 어떤 기준으로 측정하고, 어떻게 강제하나? Anthropic이 제안만 하고 구체적 메커니즘 설계는 아직 없음. → AI Alignment
-
Anthropic vs OpenAI EU 사이버 접근 정책 분기 — 누가 옳은가? Anthropic: 공격 역량이 너무 강해 방어자만 허용. OpenAI: EU 방어자에게 확대 접근이 옳다. 동일한 AI 시스템에 대한 정반대 판단. 장기적으로 EU AI Act가 어느 기준을 채택하는지가 업계 표준 결정. → AI-Enabled Cyberattacks, Claude Mythos Preview
-
다중 에이전트 alignment — Solipsistic SI 처방(equilibrium-selection)의 구현 가능성 DeepMind 논문이 제시한 균형-선택 방법론은 이론적으로 올바를 수 있지만, 실제 RLHF 파이프라인에 통합하는 방법이 불명확. 특히 open-ended multi-agent 환경에서 균형이 유일하게 정의되지 않을 수 있음. → Solipsistic Superintelligence is Unlikely to be Cooperative, AI Alignment
-
Anthropic IPO: safety mission + 분기 실적 공개 압력 공존 가능성 $965B + $47B 연 매출. IPO 이후 S&P 500 편입 가능성. 분기마다 성장률을 공개해야 하는 구조에서 "안전 우선" 결정(Mythos 보류, EU 접근 거절 등)이 주주 압력을 어떻게 버텨내는가. 업계에서 가장 주목하는 governance 실험. → Anthropic
주목할 출시
| Date | Item | Significance |
|---|---|---|
| 2026-06-01 | Project Polaris | Microsoft 자체 코딩 AI — GitHub Copilot GPT-4 Turbo 교체 예정 2026-08 |
| 2026-06-01 | Cosmos 3 Super | NVIDIA 64B MIT 오픈 물리 AI foundation model — 로봇/AV 오픈 에코시스템 개막 |
| 2026-06-01 | Anthropic IPO S-1 비공개 신청 | safety-first 기업 최초 공개 상장 — 거버넌스 구조 전환 역사적 이정표 |
| 2026-06-02 | MAI-Code-1 / MAI-Code-1-Flash (GA 당일) | Microsoft 5B급 코딩 모델 — Copilot 전 티어 즉각 배포. 어느 frontier lab도 미보유 채널 |
| 2026-06-02 | MAI-Thinking-1 | Microsoft 35B active scratch 추론 모델 — OpenAI IP 독립성 선언 |
| 2026-06-02 | WAF 1.0 MIT 오픈소스화 | Microsoft 에이전트 프레임워크 생태계 진입 |
| 2026-06-02 | Anthropic Agent SDK 크레딧 분리 (6/15) | agentic 워크플로우 과금 재설계 |
| 2026-06-03 | AI-Enabled Cyberattacks (신규 페이지) | MITRE ATT&CK 1년 데이터 + 1.7× 위협 행위자 증가 공식화 |
| 2026-06-03 | 모든 직군을 위한 OpenAI Codex | 비개발자 3× 성장 — 에이전트 수직 확산 공식화. Codex Sites |
| 2026-06-04 | Gemma 4 12B | Google DeepMind 16GB 노트북 멀티모달 에이전트 — Apache 2.0 |
| 2026-06-05 | Anthropic "When AI Builds Itself" | 80% Claude 저작 수치 + RSI 브레이크 페달 국제 조율 요구 |
| 2026-06-05 | ChatGPT Dreaming V3 | 메모리 패러다임 전환 (41.5→82.8%), Free 티어, 5× 컴퓨트 효율 |
| 2026-06-06 | Solipsistic Superintelligence is Unlikely to be Cooperative | DeepMind: RLHF → 다중 에이전트 구조적 불완전 게임이론 형식화 |
| 2026-06-06 | Anthropic Chemistry NMR 연구 | 일반 모델이 도메인 전용 소프트웨어 최초 공식 능가 (sub-peak 80% vs 26–35%) |
전망 (W25 주시 목록)
-
xAI Grok V9-Medium 출시 (mid-June 목표, 1.5T params — V8의 3×, Cursor 데이터 학습): 코딩 AI 4파전 공식화 여부. Cursor 워크플로우 데이터의 코딩 특화 효과가 독립 벤치마크에서 나타나는지.
-
Gemini 3.5 Pro GA (Google "until next month" → 6월 말): W23부터 이어진 carryover. 2주 이상 지연 중. Gemini 3.5 Flash 이후 스펙 발표 여부.
-
MAI-Code-1-Flash 독립 벤치마크: MS 자체 수치(85.8%/51%) 외 외부 SWE-bench 공식 제출. 독립 수치가 나오면 Opus 4.8(69.2%)·Devstral 2(72.2%) 비교 가능.
-
Anthropic Science Blog 2호: Chemistry(1호) 이후 생물학·물리학·재료과학 순서 예상. 다음 도메인에서 같은 패턴(일반 모델 ≥ 전용 소프트웨어)이 반복되면 임상·제약 커뮤니티 반응 주목.
-
Anthropic IPO 타임라인: S-1 비공개 신청(6/1) → 통상 60~90일 후 공개 신청 → 로드쇼. OpenAI·SpaceX와의 IPO 레이스에서 Anthropic이 선제 상장할 가능성. safety governance 구조(PBC, Long-Term Benefit Trust)의 상장 공시 내용.
-
DeepMind Solipsistic SI 후속 반향: W24에 arXiv 등재된 이 논문이 Anthropic/OpenAI의 공식 반응을 이끌어내거나 ICML/NeurIPS 2026 채택 여부. 멀티에이전트 alignment 연구 가속 여부.
-
Glasswing Remediation Gap 업데이트: W23 기준 <100 패치. W24에서 새 수치 없음. 패치 속도가 발견 속도를 따라잡기 시작하는지가 Mythos GA 조건의 핵심.
-
OpenAI Codex Sites 정식 출시: Business/Enterprise 미리보기 → GA 타임라인. 비개발자 3× 성장 트렌드의 추가 데이터.
분석한 소스
- Daily briefs: 6 (2026-06-01 ~ 2026-06-06)
- 신규 위키 페이지: 8(models/project-polaris, models/cosmos-3-super, models/mai-code-1, models/mai-thinking-1, models/gemma-4-12b, models/grok-imagine-video-1-5, concepts/ai-enabled-cyberattacks, papers/2026/2606.03237-solipsistic-si)
- 원본 소스 스냅샷(W24): 약 24(블로그, X 게시글, 지연 수집)
- 갱신된 페이지: 약 32(entity 7, 개념 3, 모델 5, 논문 1, index)
- 로그 이벤트: 12(ingest 6 + brief 6)
- Top active entities: Anthropic (6일 연속 갱신 — W23와 동률), Microsoft (6회+ 갱신 — W24 최고), OpenAI (4회), Google DeepMind (3회), xAI (2회)
- Interest-weighted top items: Gemma 4 12B (3.04), Microsoft Build 2026 MAI (2.60+), OpenAI Codex 비개발자 (2.34), Anthropic MITRE 분석 (2.33), Anthropic RSI 브레이크 페달 (2.33)
- 이전 트렌드 비교: W23 (Anthropic 독주 / 거버넌스 제도화 / Acquihire Wave) → W24 (Microsoft 진입으로 4강 체제 / RSI 정책 제안 격상 / 사이버보안 정책 분기)