$ cat briefs/daily/2026-07-10.md
2026-07-10
2026년 7월 10일 (금)
신규 항목 5 · 지연 수집 1 · 신규 페이지 1 · 갱신 7
+1new page
[01]
주요 소식
1. ChatGPT Work — OpenAI 가 멀티시간 자율 업무 에이전트 출시
- GPT-5.6 모델과는 별개인 독립 제품이다. 결과 목표를 받아 사용자의 앱·파일에 연결하고, 수 시간 동안 독립적으로 단계를 실행해 문서·시트·슬라이드·웹앱 같은 완성된 산출물을 내놓는다
- Pro·Enterprise·Edu 플랜은 즉시 이용 가능하고 Plus·Business 는 수일 내 롤아웃된다. GPT-5.6 이 구동한다
- 동시 개명: Codex 데스크톱 앱 → "ChatGPT" 데스크톱으로, Work 와 Codex 를 하나로 묶는다
- 의의: 한 번씩 주고받는 보조가 아니라 여러 시간에 걸친 자율 실행을 중심으로 설계된 OpenAI 의 첫 제품이다. 인터페이스가 "이걸 답해 줘"에서 "이걸 끝내 줘"로 옮겨간다. Anthropic Managed Agents, xAI Agent Tools API, Google ADK 2.0 과 정면으로 경쟁한다. 에이전트 노동 시장이 지금까지 중 가장 분명한 소비자용 형태를 얻었다.
- → OpenAI (Bloomberg) (OpenAI)
2. Meta Muse Spark 1.1 + Meta Model API — Meta, 상용 AI API 시장 진입
- Muse Spark 1.1: 1M 컨텍스트, 도구 사용·컴퓨터 사용·코딩·MCP 일반화에서 큰 향상. MedScribe·TaxEval·Harvey's Legal Agent Bench 신규 SOTA — 10분의 1 비용과 2배 속도로 Claude Fable 5 를 앞선다
- Meta Model API 공개 프리뷰(미국 한정): 입력·출력 M 토큰당 $1.25/$4.25, 무료 크레딧 $20, OpenAI 와 Anthropic SDK 형식을 모두 지원한다
- 의의: Meta 는 2026년 내내 Llama 공개 가중치와 나란히 폐쇄형 모델 API 사업의 기반(MSL, Watermelon 훈련, "이중 트랙")을 쌓아 왔다. 오늘 그 문을 열었다. $1.25/$4.25 로 Muse Spark 1.1 은 Sonnet 5($2/$10)와 Grok 4.5($2/$6)보다 싸고, 전문 도메인 벤치마크에서는 Fable 5 를 앞선다. 프런티어 API 시장에 다섯 번째 실질 참가자가 생겼다.
- → Muse Spark (1.0 / 1.1) (Meta AI) (TechCrunch)
3. GPT-Live-1 — OpenAI 의 전이중 음성이 전 티어에서 ChatGPT Voice 를 대체 (⚡ 지연 수집 +2일)
- GPT-Live-1(유료)과 GPT-Live-1 mini(무료): 듣기와 말하기를 동시에 한다 — 자연스러운 끼어들기가 가능하고 차례를 기다릴 필요가 없다
- 지능적 위임: 복잡한 추론이나 웹 검색은 백그라운드에서 GPT-5.5 로 넘기고 결과를 음성 스트림으로 되돌린다
- GPT-Live-1 은 Go·Plus·Pro 의 기본값, GPT-Live-1 mini 는 Free 의 기본값이다. 7월 8~9일 전 세계 롤아웃
- 의의: 전이중 방식은 음성 AI 의 가장 큰 마찰인 멈췄다 기다리는 핑퐁을 없앤다. ChatGPT Work 와 함께 보면 음성은 에이전트에게 일을 맡기는 자연스러운 인터페이스가 된다("회의 들어가 있는 동안 이 프로젝트 끝내 놔"). 음성 UI 의 기존 선두는 Google 의 Gemini Live 였고, OpenAI 가 정면으로 붙는다.
- → GPT-Live-1 (OpenAI) (TechCrunch)
[02]
논문 선정
NVIDIA Nemotron-Labs-Diffusion (arXiv:2607.05722) — arXiv
- TL;DR: 하나의 가중치가 자기회귀, 디퓨전 병렬, 자기추측 디코딩을 통합한다. 자기추측 모드에서는 모델이 드래프터이자 검증자가 되어 KV 캐시를 공유하므로 별도의 draft 모델이 필요 없다. 결과: 단계당 수락 토큰 6.82개로 Eagle3 의 2.75개를 앞서고, Qwen3-8B 대비 forward pass 당 토큰이 6배, SPEED-Bench(SGLang·GB200)에서 처리량이 4배다.
- 읽을 이유: 별도 draft 모델 없는 자기추측은 프로덕션 서빙 스택에 실질적인 단순화다. 오픈 가중치(3B·8B·14B, 상업 라이선스). NVIDIA Research 가 자사 하드웨어에서 낸 결과이며 벤치마크 수확용 논문이 아니다.
- → NVIDIA
[03]
주시
- AlphaEvolve, Gemini Enterprise 에서 GA (7월 10일) — DeepMind 의 알고리즘 발견 에이전트가 물류·유전체·HPC·반도체·금융 고객 대상으로 프로덕션 배치됐다. 얼리 액세스에서 오류를 5~56% 줄였다. OpenAI Codex, Claude for Science 와 직접 경쟁한다. FedRAMP·DoD 는 제외. → AlphaEvolve (Google Cloud)
- Claude Reflect (베타) (7월 9일) — Anthropic 이 Claude.ai·데스크톱에 사용량 대시보드와 휴식 알림 기능을 넣었다. 월간 요약, 방해 금지 시간, 휴식 권유. 사용을 줄이도록 권하는 이례적인 제품 결정이다. Memory 가 필요하다. → Anthropic (Anthropic)
- Gemini 3.5 Pro 7월 17일 GA — 7월 8일 확인 기준으로 일정은 유지 중이다. 2.5 Pro 기반을 버리고 아키텍처를 처음부터 다시 지었다. 2M 컨텍스트 창, Deep Think. 같은 주에 나올 Muse Spark 1.1·GPT-5.6 Sol 과의 벤치마크 비교를 지켜볼 것.
- Meta Watermelon — MSL 이 지금 유료 API(Muse Spark 1.1)를 여는 것은 Watermelon 이 임박하지 않았다는 뜻이다. Muse Spark 1.1 이 상업적 가교 모델이고, Watermelon(GPT-5.5 동급 주장, 훈련 컴퓨트 10배)은 아직 훈련 중이다.
[04]
위키 신규
- GPT-Live-1 (신규 — OpenAI 전이중 음성 모델 페이지 생성)
[05]
갱신
- Muse Spark (1.0 / 1.1): 대폭 재작성 — Muse Spark 1.1 사양, 벤치마크(MedScribe·TaxEval·Harvey SOTA), Meta Model API 가격, 비교 표 추가
- Meta AI: Recent Activity 와 Models & Products 에 Muse Spark 1.1 + Meta Model API 추가
- OpenAI: Recent Activity 와 Models & Products 에 ChatGPT Work(7월 9일)와 GPT-Live-1(7월 8일, 지연 수집) 추가
- AlphaEvolve: 얼리 액세스 지표와 Gemini Enterprise 맥락을 담은 GA 섹션 추가
- Google DeepMind: Recent Activity 에 AlphaEvolve GA 추가
- Anthropic: Recent Activity 에 Claude Reflect(7월 9일)와 Fable 5 의 7월 12일 연장 추가
- index: models/gpt-live-1 추가, 통계를 89 페이지·소스 ~150건으로 갱신