$ cat briefs/daily/2026-07-16.md
2026-07-16
2026년 7월 16일 (목)
소식 2 · 논문 선정 1 · 주시 2 · 신규 페이지 1
+1new page
[01]
주요 소식
1. FLI 2026 AI 안전성 지수: Anthropic 이 C+ 로 선두, xAI 는 낙제, 모든 랩이 안전 서약을 약화 [⚡ 지연 수집 +9일]
- Future of Life Institute 가 6개 영역 37개 지표로 9개 랩을 평가했다(2026년 7월 7일)
- 점수: Anthropic C+(최고, 6개 영역 중 5개 선두) → OpenAI·DeepMind C → Meta D+(개선) → xAI F(4위에서 7위로 하락) → Z.ai, DeepSeek, Alibaba Cloud, Mistral: 낙제
- 핵심 발견: Anthropic, OpenAI, Google DeepMind, Meta 모두 경쟁사 동향을 조건으로 단 안전 서약을 약화하거나 무효화했다 — FLI 는 이를 "골대 옮기기" 행태라고 부른다
- 모든 랩에서 가장 취약한 영역: 실존적 안전 — C- 를 넘긴 회사가 없다
- 의의: 가장 성적이 좋은 "안전한" 랩이 받은 점수가 C+ 다. 안전 서약은 구조적으로 집단행동 문제가 돼 버렸다 — 모두가 멈추지 않는 한 어떤 랩도 멈추지 않는다. 역량 진전과 거버넌스 준비 사이의 격차는 가장 중요한 지점, 곧 실존적 위험에서 가장 크게 벌어져 있다.
- → AI Governance (source) (FLI)
2. Meta Business Agent Platform GA 도달 — WhatsApp 에 100만+ 기업, 역대 최대 규모의 기업 에이전트 배치 [⚡ 지연 수집 +15일]
- Meta 의 기업용 에이전틱 플랫폼이 2026년 7월 1일 파트너 대상으로 가동에 들어갔다(6월 3일 Conversations 2026 London 에서 발표)
- 플랫폼: 기업이 400개 이상 시스템(Shopify, Zendesk, Shopee)에 연결된 에이전트를 만들 수 있게 한다. WhatsApp·Messenger 대화 안에서 고객 응대, 상품 추천, 예약, 판매를 처리한다
- GA 시점 규모: 파일럿에서 이미 100만+ 기업이 활동 중. 7월 31일까지 무료이며 8월 1일부터 과금이 시작된다
- 의의: 출시 당일 100만 개 이상 기업이 가동 중이라는 점에서 어느 랩보다 큰 규모의 기업 에이전트 배치이며, 그것도 세계에서 가장 지배적인 소비자 메시징 채널 위에서 돌아간다. 8월까지 무료라는 Meta 의 가격 정책은 대안이 자리를 굳히기 전에 전환 비용을 최대로 키운다. Microsoft Copilot for Enterprise 와 OpenAI 의 ChatGPT Work 에 대한 직접적인 도전이다.
- → Meta AI → Agents (LLM Agents) (source) (about.fb.com)
[02]
논문 선정
Weak-to-Strong Generalization via Direct On-Policy Distillation — arXiv:2607.05394
- TL;DR: 값싼 작은 모델에 RLVR 을 돌리고, RL 이 만든 정책 변화분(
Δ = log π_T − log π_{T,ref})만 뽑아내 큰 모델 자신의 on-policy 롤아웃으로 큰 모델에 증류한다. 표준 KD 는 정책 전체를 옮기지만 Direct-OPD 는 RL 이 바꾼 것만 옮긴다. - 저자: Tsinghua AIR + ByteDance Seed. HF Daily papers, July 15.
- 읽을 이유: 큰 모델에서 값비싼 롤아웃을 돌리지 않고도 RL 방식의 추론 향상을 프런티어 모델까지 확장하는 실용적 비용 지렛대다. Opus 급 규모에서 RL 을 돌리는 Anthropic 의 AAR 작업과 인접해 있다.
- → Weak-to-Strong Generalization via Direct On-Policy Distillation → Agentic Reinforcement Learning
[03]
주시
- Gemini 3.5 Pro 내일(7월 17일) 출시 — 2M 컨텍스트, Deep Think 추론, 자율 워크플로. 7월 17일이라는 보도는 널리 퍼졌지만 오늘 기준 Google 의 확인은 없다. Gemini API 문서에 모델 카드도, API 문서도, 가격 페이지도 올라오지 않았다. → Gemini 3.5 Pro
- Anthropic IPO 투자자 미팅 시작 — Bloomberg·CNBC(7월 15일): Goldman Sachs, Morgan Stanley, JPMorgan 이 투자자 미팅을 잡고 있다. 2026년 10월 상장 목표이며 $965B 기업가치가 배경이다. 비공개 S-1 은 2026년 6월에 이미 제출했다. → Anthropic
[04]
위키 신규
- Weak-to-Strong Generalization via Direct On-Policy Distillation (신규 — Direct-OPD 논문 페이지; Tsinghua AIR·ByteDance; RLVR 비용 절감)
[05]
갱신
- AI Governance: FLI 2026 AI 안전성 지수 섹션 추가(9개 랩, 37개 지표, 서약 약화 발견, 실존적 안전 공백)
- Meta AI: Meta Business Agent Platform GA 추가(7월 1일, 100만+ 기업, WhatsApp·Messenger)
- Agentic Reinforcement Learning: Direct-OPD / Weak-to-Strong 논문 상호참조 추가, SotA 날짜 갱신
- Anthropic: IPO 투자자 미팅 추가(7월 15일, 10월 일정)