AI Trend Notifier
EN
← 아카이브

$ cat briefs/daily/2026-07-07.md

2026-07-07

2026년 7월 7일 (화)

주요 소식 3 · 논문 선정 1 · 주시 4 · 신규 페이지 2

+2new pages
[01]

주요 소식

1. xAI Voice Agent Builder — MCP 를 내장한 노코드 음성 에이전트 (점수: 1.80)

  • xAI 가 2026년 7월 1일 Voice Agent Builder 를 베타로 출시했다. Grok Voice 위에 프로덕션 음성 에이전트를 코드 없이 2분 안에 만드는 플랫폼이다. 7월 4~6일 인제스트에서 놓쳤다.
  • 전화 연결, 지식 검색, 도구 호출, 가드레일, MCP, 관측, 통화 녹음을 하나의 음성-음성 인터페이스로 묶는다 — 벤더 셋을 쓰던 STT+LLM+TTS 스택을 대체한다
  • 연동: Gmail, Calendar, Outlook, Notion, Linear, OneDrive, Google Drive, 커스텀 API. 사람에게 넘기는 핸드오프도 지원한다. 음성 80종 이상, 언어 25개 이상. 가격: 에이전트 오디오 분당 $0.05 + 전화 연결 분당 $0.01(ElevenLabs 와 Vapi 를 밑돈다)
  • Grok Voice Think Fast 1.0 이 구동한다(xAI 내부 tau-voice Bench 67.3% — 자체 측정이다. 비교 대상으로 제시된 것은 Gemini 3.1 Flash Live 와 GPT Realtime 1.5 다)
  • 의의: 첫날부터 MCP 를 지원한다는 점에서, 개방형 연동 표준을 갖춘 첫 노코드 음성 에이전트 도구다. 어떤 MCP 서버든 접착 코드 없이 붙일 수 있다. 공격적인 분당 요금까지 감안하면 xAI 가 겨냥하는 것은 OpenAI Realtime 만이 아니라 기업 음성 AI 스택의 ElevenLabs 와 Vapi 다.
  • xAI, Grok Build (source) (xAI blog)

2. 백악관이 자발적 AI 모델 출시 표준을 마무리 중 (점수: 1.56)

  • 백악관과 NSA 가 Trump 의 6월 2일 행정명령에 따라 OpenAI·Anthropic·Google·Microsoft 와 함께 자발적 "Secure Frontier Model Deployment" 프레임워크를 마무리하고 있다. 발표는 2026년 7월 초로 예상됐다.
  • 프레임워크가 정하는 것: (1) "covered frontier model" 지정을 위한 기술 기준, (2) 출시 30일 전 연방정부 접근 의무화, (3) 초기 프리뷰 기간의 고객별 정부 심사
  • 정부 게이팅으로 진행된 6월 26일 GPT-5.6 Sol 출시가 첫 실전 시험이었다. 미국 정부가 승인한 약 20개 조직이 먼저 접근했고, Sol·Terra·Luna 의 폭넓은 롤아웃 창이 지금 열렸다(7월 714일)
  • GPT-5.6 가격 확정: 백만 토큰당 Sol $5/$30, Terra $2.50/$15, Luna $1/$6
  • 의의: 자발적이되 정해진 틀이 있는 30일 사전 공개 정부 접근은, 전면 차단과 통제 없는 공개 사이의 중간 길이다. 이것이 미국 랩의 관행이 되면 모든 프런티어 모델 출시에 정부 검토 기간이 암묵적으로 끼어들고, 프런티어 경쟁의 속도 자체가 달라진다. 역량을 방아쇠로 삼는 출시 통제를 실제로 작동시킨 미국 최초의 장치다.
  • AI Governance (new page), OpenAI (source) (Yahoo Finance)

3. Gemini 3.5 Pro, 개발자 프리뷰 확대 진입 — 지연 이유 공개 (점수: 1.52)

  • 몇 주간 Vertex AI 기업 전용 프리뷰에 머문 끝에(6월 GA 를 놓치고 이어 7월 1일 목표도 놓쳤다), Gemini 3.5 Pro 가 2026년 7월 초부터 개발자 API 로 점진적 롤아웃을 시작했다
  • GA 예상 가격: 백만 토큰당 약 $1.25/$10(표준 티어). Deep Think 의 추가 요금은 미정이다
  • 초기 기업 테스터들이 지연 원인 세 가지를 짚었다: (1) 다단계 추론에서 토큰을 과도하게 소비한다, (2) 코딩 성능이 I/O 에서 약속한 벤치마크에 못 미친다, (3) 장기 지평 다단계 과제의 성능이 떨어진다
  • 핵심 사양은 그대로다: 2M 컨텍스트 창(여전히 프로덕션 프런티어 모델 중 최대), 개발자에게 보이는 Deep Think 추론 흔적, 텍스트+이미지 멀티모달 확인
  • 의의: 지연 원인 자체가 진단이다. 셋 모두 같은 실패 양상을 가리킨다 — 쉬운 문제에서는 "과하게 생각하고" 어려운 문제에서는 힘을 못 쓰는 모델이다. Google 의 교정이 과하게 들어가면(예컨대 토큰을 아끼려 사고량을 낮추면) Deep Think 는 광고보다 약하게 나올 수 있다. 컨텍스트가 길다고 추론이 나아지지는 않는다는 신호이며, 200만 토큰 컨텍스트 창이 실제로 어떻게 동작할지에 대한 함의가 있다.
  • Gemini 3.5 Pro, Google DeepMind (source)
[02]

논문 선정

ASPIRE: Agentic Skills Discovery for RoboticsarXiv:2607.00272

  • NVIDIA GEAR Lab(Jim Fan), UMich, UIUC, UC Berkeley, CMU — 2026년 6월 30일 제출, 7월 2일 공개
  • TL;DR: 제어 프로그램을 코드로 작성하고 재사용 가능한 스킬을 라이브러리에 쌓아 가는 연속 로봇 학습 시스템이다. 라이브러리가 커질수록 로봇은 본 적 없는 장기 지평 과제로 제로샷 일반화한다. 결과: LIBERO-Pro 조작 +77%, Robosuite 양손 전달 +72%, LIBERO-Pro Long 제로샷 +670%(31% 대 기존 방법의 4%, test-time 추론과 재시도 포함)
  • 읽을 이유: 제로샷 일반화 결과가 핵심 주장이다 — 스킬 50개를 배운 로봇이 51번째 과제를 훈련 없이 해낸다. 이것이 확장된다면 물리 세계판 in-context learning 이다. 스킬 라이브러리가 충분히 길면 경사 갱신 없이 일반화된다는 것이다. ENPIRE: Agentic Robot Policy Self-Improvement in the Real World(실제 하드웨어에서의 에이전틱 로봇 자기개선, 2026년 6월, 역시 NVIDIA)와 짝을 이룬다.
  • ASPIRE: Agentic Skills Discovery for Robotics (new), Embodied Agents, Jim Fan
[03]

주시

  • Mistral 의 차기 오픈 가중치 모델 — CEO Arthur Mensch 이 7월 4일 TechCrunch 인터뷰에서 확인했다: "올여름 아주 흥미로운 모델이 나온다 — 오픈 가중치이며 7월에 얼리 액세스를 연다." ARR 은 $400M 으로 1년 전 $20M 에서 늘었고 $1B 을 향하고 있다. 사양은 공개되지 않았다. 7월 중 얼리 액세스 발표를 지켜볼 것. → Mistral AI (source)

  • GPT-5.6 Sol·Terra·Luna 확대 롤아웃 창 7월 7~14일 — 정부 심사 기간이 닫히고 이번 주 폭넓은 접근이 예상된다. 가격은 확정됐다: Mtok 당 Sol $5/$30, Terra $2.50/$15, Luna $1/$6. 7월 14일까지 열리지 않는다면 자발적 프레임워크가 무너지고 있다는 뜻이다. → GPT-5.6 Sol (and Terra, Luna)

  • Fable 5 결제 절벽 7월 7~8일 — 기존 구독에 포함되던 주간 사용 상한 50% 가 7월 7일 만료되고, 7월 8일부터 크레딧 전용 가격이 시작된다. 6월 23일 Anthropic 의 구독 개편이 무료 기간 종료 후에도 버티는지에 대한 첫 시험이다. → Claude Fable 5

  • Grok 5 — 여전히 부재하며 이제 2026년 3분기가 실질적 목표다. Kalshi 계약은 2026년 7월 말 확률을 약 33% 로 본다. → xAI

[04]

위키 신규

  • ASPIRE: Agentic Skills Discovery for Robotics (신규 — NVIDIA GEAR Lab 의 연속 로봇 스킬 발견. Jim Fan. 검토 권장)
  • AI Governance (신규 — 미국의 자발적 AI 모델 출시 표준, 수출 통제, Fable 5 사례, UN AI Governance Dialogue 를 다루는 개념 페이지. 빠르게 커지고 있어 적극적인 관리가 필요하다)
[05]

갱신

  • xAI: Recent Activity 와 Models & Products 에 Voice Agent Builder(7월 1일) 추가. 소스와 태그 갱신
  • OpenAI: Recent Activity 에 백악관 자발적 표준 프레임워크(7월 7일) 추가. 소스 갱신
  • Google DeepMind: Recent Activity 에 Gemini 3.5 Pro 개발자 프리뷰 확대 추가. 소스 갱신
  • Gemini 3.5 Pro: 상태 갱신(제한 → 개발자 프리뷰), 예상 가격 기재, 지연 원인 추가, Release Date 섹션 갱신
  • Mistral AI: Recent Activity 에 CEO 의 오픈 가중치 모델 확인(7월 4일) 추가. 소스 갱신