AI Trend Notifier
EN
← 아카이브

$ cat briefs/daily/2026-05-25.md

2026-05-25

2026년 5월 25일 (월)

소스 3 · 신규 모델 페이지 2 · 논문 0 · 알림 1

+2new pages
[01]

주요 소식

1. Project Glasswing 초기 업데이트 — 1개월, 10,000+ 취약점, 패치는 100개 미만

  • Anthropic이 Project Glasswing 첫 공식 상태 보고를 2026-05-25 발표 (source)
  • Claude Mythos Preview가 ~50개 파트너와 함께 10,000+ 고위험/치명적 취약점 발견 (1,000+ 제로데이 포함)
  • 주목할 발견: OpenBSD 27년된 취약점, FFmpeg 16년된 취약점 — 기존 자동화 도구와 수동 리뷰 모두 놓침
  • Remediation Gap: 10,000+ 취약점 발견 vs. 배포된 패치 100개 미만 — AI 탐지 속도가 업계 대응 능력을 훨씬 초과
  • 왜 중요한가: AI가 공격 속도를 방어 속도보다 빠르게 끌어올리는 구조적 위기. "패치 안 된 취약점" 데이터베이스가 증가하는 상황은 Mythos 수준 능력이 악의적 행위자에게 노출될 경우를 선제적으로 조명.
  • Claude Mythos Preview, Anthropic

2. Google Deep Research Max 출시 (지연 수집) — Gemini 3.1 Pro 기반, MCP+민간 데이터 통합

  • 2026-04-22 발표 (이번 인제스트에서 처음 캡처) (source)
  • Gemini 3.1 Pro 기반 자율 연구 에이전트 2계층: Deep Research (속도·대화형) vs Deep Research Max (확장 추론·비동기 백그라운드)
  • MCP 지원 + 민간 데이터: 내부 문서, 금융 DB 등 커스텀 데이터 소스와 공개 웹을 단일 실행에서 통합 검색
  • 성능: DeepSearchQA 93.3% (Dec 2025 66.1%에서 향상), HLE 54.6% (46.4%에서 향상)
  • 동시 발표: Gemini Enterprise Agent Platform (Vertex AI 진화형) — 조직 단위 에이전트 거버넌스
  • 왜 중요한가: MCP 에코시스템이 단순 도구 연결을 넘어 민간 기업 데이터와 통합되는 방향으로 확장. Anthropic(Stainless 인수)·OpenAI(Deep Research 기존)·Google(Deep Research Max) 의 연구 에이전트 경쟁이 "민간 데이터 접근" 레이어로 이동.
  • Deep Research Max, Google DeepMind

3. Gemini Robotics ER 1.6 (지연 수집) — 계기판 읽기 23%→93%, 산업 자율화 임계값 교차

  • 2026-04-15 발표 (이번 인제스트에서 처음 캡처) (source)
  • 물리적 AI의 Enhanced Embodied Reasoning — 특히 계기판(아날로그 게이지) 읽기 정확도 93% (ER 1.5 23% 대비 4× 향상)
  • Boston Dynamics Spot 로봇과 공동 개발 — 실제 산업 현장(에너지, 화학 플랜트) 시나리오 시연
  • Agentic vision 파이프라인: 관찰→추론→검증 루프
  • Gemini API 및 Google AI Studio에서 개발자 공개
  • 왜 중요한가: 계기판·압력계 판독은 에너지·제조·수처리 시설의 핵심 점검 작업. 90%+ 정확도는 감독 자동화 실용 배포의 통상적 임계값. Jim Fan(NVIDIA)이 CaP-X에서 제시한 "skill library 기반 물리적 에이전트" 방향과 DeepMind가 수렴 중.
  • Gemini Robotics ER 1.6, Embodied Agents
[02]

논문 선정

오늘 Tier-1 기관 신규 논문 없음 (HuggingFace 403 + WebSearch fallback 비Tier-1 결과). 어제 캡처된 항목에서 주목할 것:

[OpenAI 추론 모델 Erdős 단위 거리 추측 반증] — 이미 briefs/daily/2026-05-24.md에 포함됨. 후속 반응: Noam Brown(@polynoamial) 코멘트 — "범용 LLM이었다. 수학에 특화되거나 scaffold 기반이 아니다. 모델의 한계를 밀어붙이지도 않은 상태에서 나온 결과" → 의미: 범용 reasoning 모델의 추론 상한선이 예상보다 높음.

[03]

주시

  • Anthropic 능력 게이팅 선례 강화: Project Glasswing 업데이트가 "발견 속도 > 패치 속도" 현실을 확인. 차세대 Mythos급 모델 출시 결정에 이 수치가 직접적 근거가 될 것. Mythos GA 타이밍 계속 주시.
  • Deep Research Max + MCP 에코시스템 확장: Anthropic Stainless(MCP 서버 자동생성), Google Deep Research Max(MCP 기반 민간 데이터), xAI Agent Tools API — 세 진영 모두 "에이전트가 민간 데이터에 안전하게 접근하는 방법" 레이어에서 경쟁. 표준·인터옵이 다음 2분기 핵심 전장.
[04]

위키 신규

오늘 새로 생긴 모델 페이지. 검토 후 보강 필요:

[05]

갱신

기존 페이지 주요 변경:

  • Claude Mythos Preview: Project Glasswing Initial Update 섹션 추가 (10,000+ vulns, 1,000+ zero-days, remediation gap)
  • Anthropic: Glasswing 초기 업데이트 Recent Activity 추가
  • Google DeepMind: Deep Research Max + Gemini Robotics ER 1.6 추가 (2개 모델 페이지)
  • Embodied Agents: Gemini Robotics ER 1.6 State of the Art 추가