AI Trend Notifier
EN
← 아카이브

$ cat briefs/daily/2026-07-15.md

2026-07-15

2026년 7월 15일 (수)

주요 소식 3 · 논문 선정 1 · 주시 2 · 위키 신규 1

+1new page
[01]

주요 소식

1. Grok Build CLI 가 Git 저장소 전체를 몰래 업로드 — 27,800배 초과 전송, .env 비밀값 포함

  • 보안 연구자 cereblab 이 통신 수준 분석을 공개했다. Grok Build CLI v0.2.93 이 192 KiB 만 필요한 상황에서 11.2 GiB 저장소 중 5.1 GiB 를 전송했다는 내용이다
  • Git 이력 전체, 추적되지 않는 파일, 마스킹되지 않은 .env 비밀값(API 키, DB 비밀번호, SSH 키)이 xAI 의 Google Cloud Storage 버킷 grok-code-session-traces 로 전송됐다
  • xAI 는 이 도구를 "세션 중 코드베이스의 어떤 것도 xAI 서버로 전송되지 않는다" 고 홍보해 왔다 — 통신 데이터가 이를 정면으로 반박한다
  • /privacy 토글은 무력했다. 업로드 여부가 아니라 업로드 이후의 보관만 통제한다
  • 7월 14일 Hacker News 첫 화면에 올랐고, xAI 는 공개 약 24시간 뒤 서버 측 수정(disable_codebase_upload: true)을 배포했다
  • Elon Musk 은 7월 13일 X 에서 앞서 업로드된 사용자 데이터를 전 세계적으로 삭제하겠다고 약속했다 — 독립적으로 확인되지는 않았다
  • 의의: 에이전틱 코딩 CLI 라는 범주가 생긴 이래 가장 신호가 큰 신뢰 사고다. 7월 13일 이전에 비밀값이 든 저장소에서 Grok Build 를 돌린 개발자는 지금 바로 그 값들을 교체해야 한다. xAI 가 Claude Code 와 가장 치열하게 붙는 시점에 Grok Build 의 기업 도입에 제동이 걸렸다.
  • xAI · Grok Build (source) (The Hacker News)

2. Gemini 3.5 Pro 7월 17일 GA 확정 — 아키텍처 전면 재구축 완료, 2M 컨텍스트

  • 7월 14일 기준 여러 소스가 Gemini 3.5 Pro 의 확정 GA 일자를 내일(7월 17일) 로 확인했다 — 앞서 나온 7월 22~28일 지연 추정을 대체한다
  • 2.5 Pro 기반의 전면 아키텍처 재구축이 끝났다. 재작성의 목표는 수학 추론, SVG·이미지 품질, 장기 지평 코딩이었다
  • 유출된 사양(아직 공식 아님): 2M 토큰 컨텍스트 창, Deep Think Reasoning Layer(게이팅), 자율 워크플로 모드
  • 공식 벤치마크 시트는 아직 없다. 전체 데이터는 GA 발표 때 나올 것으로 보인다
  • 동시에: 용량이 빠듯해지자 Google 이 Meta 의 Gemini 컴퓨트 접근에 상한을 걸었다 — Meta 의 AI 프로젝트가 지연됐다. 모델·TPU·클라우드를 모두 가진 Google 의 수직 통합 우위로 읽힌다
  • 의의: 이번 아키텍처 재구축은 주요 프런티어 랩이 출시 주기 도중에 사전학습 사이클을 폐기하고 다시 시작한 첫 사례다. 재구축이 성과를 내면, Fable 5 가 크레딧 전용이 되고 Grok Build 가 프라이버시 사고로 휘청이는 바로 그 시점에 Gemini 3.5 Pro 가 경쟁 구도를 흔들 수 있다.
  • Gemini 3.5 Pro (source)

3. Anthropic Claude for Teachers — 미국 K-12 교사에게 프리미엄 무료 제공

  • Anthropic 이 7월 14일 Claude for Teachers 를 시작했다. 인증된 미국 K-12 교사는 프리미엄 Claude 를 1년 무료로 쓴다(2027년 6월 30일까지 신청). Claude Code, Claude Cowork, 그리고 50개 주 전체의 교육 기준을 담은 Learning Commons 커넥터가 포함된다
  • 교수 스킬 라이브러리는 학습과학자들과 공동 개발했다. FERPA 를 준수하는 K-12 데이터 협약을 맺었고 훈련 데이터에서는 제외된다
  • 생태계: ASSISTments, Brisk Teaching, Canva Education, Coteach, Diffit, Eedi, MagicSchool, Snorkl
  • 의의: 미국 공립학교 시스템은 IT 승인 전에 FERPA 준수와 훈련 데이터 제외를 요구한다. Anthropic 은 두 관문을 모두 통과해 Microsoft Copilot for Education 과 Google Workspace for Education 보다 앞선 자리를 잡았다. 도달 범위는 미국 K-12 교사 약 370만 명이다. 교육 층위는 Claude 에 대한 기업 사용자의 친숙함을 대규모로 길러 줄 수 있다.
  • Anthropic (source) (Anthropic)
[02]

논문 선정

Long-Horizon-Terminal-Bench (LHTB)arXiv:2607.08964

  • 7월 14일 HF Daily 1위 논문(25 스타)
  • 상태를 유지하는 컨테이너 터미널에서 수백 단계에 걸친 LLM 에이전트 성능을 재는 46개 과제 벤치마크. 조밀 보상으로 채점한다(산출물에서 재구성하는 검증기를 쓰므로 자기 보고한 진척은 인정되지 않는다)
  • SOTA 결과: 최고 모델도 부분 보상 임계 0.95 에서 pass@1 15.2% 에 그친다. 완전 완료(1.0)는 10.9% 뿐이다
  • 평균 토큰 소비: 과제당 990만. 평균 실행 시간: 실행당 85.3분
  • 읽을 이유: 평가 방법론(조밀 보상 + 상태를 유지하는 컨테이너 환경)이 통과·실패 이분법의 단기 과제 벤치마크에서 한 단계 도약한 것이며, 15% 라는 천장은 지금의 "에이전틱" 시스템이 신뢰할 만한 장기 자율성에서 얼마나 멀리 있는지를 정확히 알려 준다
  • Long-Horizon-Terminal-Bench (LHTB)
[03]

주시

  • Gemini 3.5 Pro GA: 내일(7월 17일) — 공식 벤치마크 시트와 가격이 나올 것으로 보인다. Fable 5 가 중단되고 GPT-5.6 이 지배하는 현 구도를 마침내 흔들 수도 있다. Deep Think 벤치마크가 Fable 5 의 SWE-bench Pro 80.3% 와 어떻게 비교되는지 지켜볼 것.
  • Grok Build 자격증명 교체: 2026년 7월 13일 이전에 Grok Build CLI 를 썼다면 API 키, DB 비밀번호, SSH 키, 그리고 추적 파일이나 Git 이력에 있던 모든 비밀값을 교체할 것. xAI 의 삭제 약속은 독립적으로 확인되지 않았다.
[04]

위키 신규

[05]

갱신

  • xAI: Grok Build 의 저장소 전체 프라이버시 침해(7월 12~14일). 태그 갱신
  • Grok Build: 기술 세부와 보안 권고를 담은 Privacy Breach 섹션 추가
  • Anthropic: Recent Activity 에 Claude for Teachers(7월 14일) 추가
  • Gemini 3.5 Pro: 상태 갱신 — 7월 17일 GA 재확인(7월 22~28일 지연 추정을 대체). 타임라인 항목 추가, 소스 갱신