$ cat wiki/trends/2026-W29.md
주간 종합 — 2026-W29 (2026-07-13 ~ 2026-07-19)
2026-07-19 합성 소급 작업의 일부로 작성. 이번 주에 해당한다.
기간
2026-07-13(월) ~ 2026-07-19(일), 일일 브리프 6건(2026-07-13 ~ 2026-07-17 및 2026-07-19). 직전 주(2026-W28)가 출시의 파도였다면 — Grok 4.5 GA, GPT-5.6 Sol 제품군, SpaceXAI 리브랜딩, Mistral Large 3 — W29 는 청구서가 돌아온 주였다: 에이전트 도구의 실시간 신뢰 실패, 글로벌 AI 거버넌스의 공식 분열, 프런티어 수준으로 드러난 중국 공개 가중치 모델 둘, 그리고 오늘 밤 끝나는 Anthropic 의 Fable 5 무료 시대.
주목할 출시
| Date | Item | 의의 |
|---|---|---|
| 06-01* | MiniMax M3 | 428B MoE 공개 가중치(활성 23B), 100만 컨텍스트. BrowseComp 83.5 로 Claude Opus 4.7(79.3)을 앞선다. WAIC 2026 보도로 드러남 |
| 06-16* | GLM-5.2 | Z.ai 744B MoE, MIT 라이선스, Code Arena 2위 — Claude Opus 4.8 에 1pp 뒤지고 API 비용은 GPT-5.5 의 약 6분의 1 |
| 06-30* | Nano Banana 2 Lite (Gemini 3.1 Flash Lite Image) | Google 3B 온디바이스 멀티모달, 160개 언어, INT4 3GB 이하 — 신흥시장 승부수 |
| 07-01* | Meta Business Agent Platform GA | WhatsApp·Messenger 에서 100만 개 이상 기업 가동 — 현재까지 최대 규모 기업 에이전트 배치 |
| 07-06* | Anthropic "A global workspace in language models" | J-space/J-lens — 추론 시점의 기만·숨은 목표 탐지 → Mechanistic Interpretability |
| 07-09* | Muse Spark (1.0 / 1.1) 1.1 + Meta Model API | Meta 의 첫 유료 API — Mtok 당 $1.25/$4.25 로 네 번째 상용 프런티어 참가자. 에이전트 과제에서 Fable 5 의 약 10분의 1 |
| 07-13 | Claude Fable 5 세 번째 연장 | 07-19 까지 무료 접근, 마감 90분 전 발표. 요청 한도 +50% |
| 07-14 | Claude for Teachers | 검증된 미국 K-12 교사에게 프리미엄 1년 무료(약 370만 명 도달), FERPA 준수 — Anthropic 의 교육 유입 경로 |
| 07-15 | Ode with Anthropic | 운용자산 $15억의 기업 구축 전문사 — 서비스 인력 없이 서비스 네트워크를 갖추는 방식 |
| 07-17 | WAICO 창설 | WAIC 2026 에서 출범한 29개국 중국 지원 정부 간 AI 기구. 시진핑의 첫 WAIC 기조연설 |
| 07-17 | Gemini 3.5 Pro GA 미달 | 세 번 연속 마감 미달 — Surprising Results 참조 |
| 07-18 | ChatGPT 통합 데스크톱 | Chat + Work + Codex 를 하나의 스위처 아래로 — Cowork 에 맞선 OpenAI 의 AI-OS 통합 수순 |
| * 더 일찍 공개됐으나 이번 주 브리프에서 처음 드러났다. |
논문 선정: Agent Data Injection Attacks are Realistic Threats to AI Agents (프로덕션 에이전트 대상 인젝션 성공률 69~96%), Long-Horizon-Terminal-Bench (LHTB) (장기 과제 SOTA 가 15.2% 에 불과), Weak-to-Strong Generalization via Direct On-Policy Distillation, The Mirage of Optimizing Training Policies: Monotonic Inference Policies as the Real Objective for LLM Reinforcement Learning, SEED: Self-Evolving On-Policy Distillation for Agentic Reinforcement Learning, Ring-Zero: Scaling Zero RL to a Trillion Parameters for Emergent Reasoning (최초의 1조 파라미터 RLVR 실행).
부상하는 주제
1. 중국 공개 가중치의 동등성 — 이제 제도적 층까지. GLM-5.2 (Z.ai) and MiniMax M3 (MiniMax) 둘 다 이번 주에 코딩·에이전트 벤치마크에서 미국 플래그십 폐쇄형 모델과 같거나 그 이상으로, 제한 없는 공개 라이선스로 드러났다. 같은 주에 WAIC 2026 이 시진핑의 첫 기조연설과 함께 상하이에서 열렸고 29개국이 오픈소스·개발도상국 친화를 명시한 프레이밍으로 WAICO 를 창설했다 → AI Governance. 역량과 제도가 함께 움직이고 있으며, 공개 가중치는 중국의 지정학적 지렛대다. 이번 주 논문 선정 6건 중 4건도 중국 기관에서 나왔다(칭화 2건, 저장대, Ant Group).
2. 에이전트 신뢰 인프라가 실사용 부하에서 갈라지고 있다. The Grok Build CLI 가 Git 저장소 전체를 조용히 업로드했다 — .env 비밀정보 포함, 필요량의 27,800배, 프라이버시 토글은 무력 → xAI. ADI 문서 인젝션 공격이 RAG·도구 맥락의 프로덕션 에이전트에서 69~96% 성공률을 기록했다 → AI-Enabled Cyberattacks. LHTB 는 장기 터미널 자율성의 SOTA 를 15.2% 로 매겼다. 건설적인 반대편: Anthropic 의 J-space 는 기만과 숨은 목표 추구를 추론 시점에 모델 내부에서 탐지 가능하게 만든다 — 신뢰에 직접 적용되는 첫 해석가능성 결과다 → Mechanistic Interpretability, AI Alignment.
3. 프런티어 비즈니스 모델이 갈라졌다. 한 주 안에: Meta 가 Fable 5 가격의 약 10분의 1로 유료 API 시장에 진입했고, OpenAI 는 Chat/Work/Codex 를 OS 계층 데스크톱 표면으로 통합했으며, Anthropic 은 교육 유입 경로(Teachers)와 서비스 계층(Ode), IPO 투자자 미팅(10월 목표, $9,650억 맥락)을 열었다 — 그리고 오늘 밤 Fable 5 무료를 끝낸다. 이번 주의 주된 경쟁 축은 벤치마크 순위가 아니라 수익화 구조였다 → Meta AI, OpenAI, Anthropic.
4. 비용 지렛대로서의 RL distillation. Direct-OPD(RL 이 만든 정책 변화분만 큰 모델로 옮긴다)와 SEED(에이전트 자신의 궤적을 재사용 가능한 사후 스킬로 증류한다)는 같은 문제를 양쪽에서 공략한다 — 프런티어 규모의 롤아웃 없이 프런티어 규모의 RL 이득을 얻는 것이다 → Agentic Reinforcement Learning.
잦아드는 주제
- Fable 5 연장 사이클 — 19일간 세 번의 연장이 오늘 밤 끝난다. 이야기가 마감 드라마에서 실제 사용 경제학으로 옮겨간다.
- "임박한" Gemini 3.5 Pro — 세 번의 날짜 미달이 출시 감시 서사를 끝냈다. 기대가 8월로 재조정됐고 임시 대응용 "Gemini 3.6 Flash" 이름이 등록됐다.
- xAI 제품 모멘텀 — W28 의 Grok 4.5 GA·SpaceXAI 리브랜딩 에너지가 Grok Build 사고와 FLI Safety Index 의 F 등급에 소진됐다.
- 서구 리더보드 경마 — 한 주 내내 미국·EU 신규 프런티어 모델이 나오지 않았다. 관심이 신뢰·비용·거버넌스로 옮겨갔다.
뜻밖의 결과
- Google 이 사흘 전에 재확인한 출시일을 놓쳤다. 7월 14일: "7월 17일 확정, 재구축 완료." 7월 17일: 모델 없음 — 코딩이 GPT-5.6 Sol (and Terra, Luna) 기준에 못 미치고 환각률은 내부 기준을 넘었으며, 배경에는 시니어 4명의 이탈이 있었다(Shazeer → OpenAI, Jumper·Adler·Pritzel → Anthropic) → Gemini 3.5 Pro, Google DeepMind.
- 와이어 레벨 감사가 xAI 의 "전송되는 것 없음" 마케팅을 정면으로 반박했다. 192 KiB 가 필요한 곳에 5.1 GiB 가 업로드됐고 자격증명이 포함됐으며 삭제 약속은 검증되지 않았다 — 에이전틱 코딩 CLI 에서 나온 가장 날카로운 신뢰 실패다 → Grok Build.
- Tier-1 이 아닌 중국 스타트업의 공개 가중치가 브라우저 에이전트 벤치마크에서 미국 플래그십을 이겼다 — MiniMax M3 의 BrowseComp 83.5 대 Claude Opus 4.7 의 79.3, HuggingFace 에서 내려받을 수 있다 → MiniMax M3.
- RLVR 을 1조 파라미터로 확장하자 새로운 실패 양상이 드러났다. Ring-Zero 는 "context anxiety" 를 기록한다 — 큰 모델이 모호함 앞에서 오히려 덜 단호해진다. 강건성은 단조적으로 확장되지 않는다 → Ring-Zero: Scaling Zero RL to a Trillion Parameters for Emergent Reasoning.
- 업계 최고 안전 등급이 C+ 다. FLI 지수(랩 9곳, 지표 37개)는 Anthropic·OpenAI·Google DeepMind·Meta 모두 경쟁사 조건부로 안전 서약을 약화했음을 함께 밝혔다. 실존적 안전에서 C- 를 넘는 랩은 없다 → AI Governance.
열린 논쟁
- 두 거버넌스 블록, 다리 없음. WAICO(29개국, 상하이 본부, 오픈소스 프레이밍) 대 같은 주 Demis Hassabis 의 미국 주도 국제 AI 감시기구 요구 — 구조적으로 양립 불가능한 설계다. 개발도상국이 어느 블록에 합류하느냐가 2030년대까지의 표준과 공급망을 좌우한다 → AI Governance.
- 공개 가중치의 동등성은 구조적인가, 벤치마크 선별적인가? GLM-5.2 와 M3 는 코딩·에이전트 리더보드에서 프런티어급으로 보이지만, 호스팅 API 의 데이터 경로 단서(중국 소재 인프라)가 시장을 가른다 — 자체 호스팅하는 쪽은 프런티어에 가까운 무료 계층을 얻고, 규제 산업 기업은 영영 손대지 못할 수 있다 → GLM-5.2.
- Meta 의 10배 싼 API 는 지속 가능한 경제인가, 보조금을 쏟는 영토 확보인가? 가격이 유지된다면 오늘 밤 크레딧 전용으로 재조정되는 Anthropic 의 에이전트 워크로드 매출이 직접적 표적이다 → Muse Spark (1.0 / 1.1), Claude Fable 5.
- 이 공격 표면을 안고 현재 속도로 에이전트를 배치할 수 있는가? ADI 는 시험한 방어 넷을 모두 우회했고, 신뢰를 내세운 CLI 가 저장소 유출 버그를 내보냈으며, 장기 신뢰성은 15% 에 머문다. J-space 모니터링이 하나의 답이지만 에이전트 신뢰 계층을 소유한 곳은 아직 없다 → Agents (LLM Agents).
Outlook (W30 관찰 목록)
- Fable 5 크레딧 전용이 오늘 밤 시작된다 (07-19, PT 밤 11:59). 이동 경로를 볼 것: 비용에 민감한 에이전트는 Claude Sonnet 5, Muse Spark 의 $1.25/$4.25 쐐기, 자체 호스팅 GLM-5.2. 네 번째 연장이 나온다면 그 자체가 용량 신호다(Colossus 1 임대 시점).
- WAIC 2026 은 07-20 까지 — 중국 릴리스가 더 나올 가능성(Qwen, ByteDance Seed, Baidu, Z.ai 후속)과 초기 WAICO 회원 역학.
- Gemini 3.5 Pro 의 실제 창 — 미달 전 예측 시장은 7월 31일(81%)을 말했다. 8월로의 재조정을 예상한다. 임시 대응 Gemini 3.6 Flash 출시는 그 자체로 하나의 이야기가 된다 → Gemini 3.5 Pro.
- Honeycomb — Cursor 에서 포착된 미발표 Anthropic 모델(500K 컨텍스트, 2027년 3월 훈련 커트오프). 크레딧 전용 전환 즈음의 발표는 패턴에 들어맞는다 → Anthropic.
- Meta 의 첫 매출 신호 — Meta Model API 프리뷰 채택, 그리고 08-01 부터 100만 개 이상 기업에서 시작되는 Business Agent Platform 과금 → Meta AI.
- 에이전트 보안의 후속 — Grok Voice 의 30~40% 저가 공세에 대한 ElevenLabs 의 대응, ADI 식 인젝션에 표준 방어가 생기는지, Grok Build 자격증명 교체의 기업 파장 → AI-Enabled Cyberattacks.
Referenced by
Sources
- briefs/daily/2026-07-13.md
- briefs/daily/2026-07-14.md
- briefs/daily/2026-07-15.md
- briefs/daily/2026-07-16.md
- briefs/daily/2026-07-17.md
- briefs/daily/2026-07-19.md