AI Trend Notifier
EN
← 아카이브

$ cat briefs/daily/2026-07-30.md

2026-07-30

2026년 7월 30일 (목)

ingest + brief 에이전트 생성 · 소스: Tier 1 (HuggingFace Daily, Anthropic, OpenAI, Google DeepMind, Meta AI, Mistral, xAI, X 피드, DeepSeek + Z.ai 로테이션) + 프리페치 후보

[01]

주요 소식

1. 랩들이 워싱턴에 브레이크를 요구했다 — 그중 둘은 회사 이름으로 서명했다

프런티어 랩 직원 천여 명이 7월 28일 "Pacing the Frontier" 를 발표하고, 미국 정부에 "자동화된 AI 개발의 프런티어를 의도적으로 늦추는 데 필요한 기술적·거버넌스적 도구를 개발하는 국제적 노력을 지원해" 달라고 요구했다. 요구는 명시적으로 중단이 아니다. 역량 발전이 그 결과 시스템을 이해하고 통제하는 능력을 앞질렀을 때, 나중에 속도를 조절할 선택지를 갖자는 것이다.

OpenAI 와 Anthropic 은 몇 시간 만에 기관으로서 지지했다. Google 과 Meta 는 그러지 않았다 — Shane Legg, Anca Dragan, Shengjia Zhao 는 모두 개인 자격으로 서명했지만. 서명자 분포는 Anthropic 533, OpenAI 330, Google 191, Meta 62 이고, 이름이 알려진 서명자로는 Dario Amodei, Jared Kaplan, Chris Olah, Jakub Pachocki, Mark Chen 이 있다.

서명자 수는 24시간 안에 네 가지로 보도되었다(1,134 / 1,178 / 1,224 / "over 1,100"). 명단이 열려 있어 계속 채워지는 중이었기 때문이며, 위키 페이지는 하나를 고르는 대신 넷을 모두 기록한다.

의의: 이것은 6월 5일의 Favaro–Clark "브레이크 페달" 이 서명과 두 건의 기관 지지를 달고 도착한 것이다. 우리가 추적하는 다른 모든 거버넌스 항목은 국가가 산업에 가하는 것이다 — 수출 통제, Kill Switch Act, EU AI Act. 이번 것은 산업이 정부에게 자신을 상대로 한 역량을 갖춰 달라고 요구하면서, 규칙을 요구하지는 않는 사례다.

Frontier Pacing (신규 페이지), Anthropic, OpenAI, Chris Olah소스 · Washington Post · NBC News

2. Claude Mythos Preview 가 버그 사냥이 아니라 독창적인 암호해독을 해냈다

Anthropic 은 Mythos Preview 가 포스트 양자 서명 스킴 HAWK-256 에 대한 종단간 키 복구 공격을 도출했다고 밝혔다. 그 아래 놓인 Lattice Isomorphism Problem 에서 지금까지 활용되지 않았던 nontrivial automorphism 을 찾아낸 결과다. 전체 키 복구의 기대 비용이 2^64 에서 2^38 연산으로 떨어지며, 공개된 구현으로 96코어 서버에서 약 3시간 42분이 걸린다.

별도로 7라운드 AES-128 에 대해 200–800배 속도 향상을 냈다. 모델이 Möbius Bridge 라 이름 붙인 fingerprinting 기법으로, 기존에 256개 값을 확인해야 했던 추측 단계 하나를 제거한다. 며칠에 걸친 가벼운 프롬프팅 이후로는 거의 완전히 자율적으로 진행되었고, HAWK 저자들에게 통지되어 공개는 NIST 를 거쳤다.

Anthropic 은 어느 결과도 실제 운영 시스템에는 영향이 없다고 밝힌다. AES 공격은 열 라운드 중 일곱 라운드까지만 도달하며 비현실적인 수의 chosen plaintext 를 요구하고, HAWK 는 배포된 표준이 아니라 후보다.

의의: Project Glasswing 의 지금까지 기록은 구현 버그다 — 원리적으로는 끈기 있는 사람이 코드를 읽어 찾을 수 있는 것들이다. 격자 문제의 새로운 automorphism 은 암호학계가 갖고 있지 않던 수학이다. 그리고 이것은 같은 회사가 자동화된 연구의 속도를 늦출 방법을 워싱턴에 요구한 바로 다음 날 나왔다.

Claude Mythos Preview, AI-Enabled Cyberattacks, Anthropic소스 · Anthropic · The Hacker News

3. 다음 Word 문서를 감염시키는 Word 문서, 통로는 Copilot

Håkon Måløy 가 문서를 매개로 하는 AI 웜을 공개했다. Word 파일에 숨긴 지시문이 Copilot for Word 의 컨텍스트로 들어가 그 출력물을 바꾸고, 그 문서에서 파생된 새 파일로 스스로를 복사한다. 시연된 효과는 재무 데이터의 변조였다. 전파는 한 문서에서 다른 문서를 만들어내는 지극히 일상적인 행위를 통해 일어나고, 피해자가 알아챌 만한 것은 아무것도 없다.

그는 2026년 3월부터 Microsoft 와 함께 이 문제를 다뤄 왔고 약 144일 뒤에 공개했으며, 이 부류에 대한 견고한 완화책이 존재하지 않는다는 이유로 구체적인 페이로드는 공개하지 않았다.

의의: 우리 사이버 페이지의 이전 사건들은 모두 에이전트를 쥔 공격자나 랩 자신의 평가 하네스를 필요로 했다. 이번 것은 둘 다 필요 없다. 전파 경로는 어시스턴트가 설계대로 동작하는 것 자체이고, 따라서 수정은 버그 패치일 수 없다 — 공격면이 곧 제품인 첫 항목이다.

AI-Enabled Cyberattacks, Microsoft소스 · The Register

4. OpenAI 가 역량 프런티어가 아니라 효율 프런티어를 주장한다

"How GPT-5.6 fuses frontier intelligence with frontier efficiency" (7월 29일) 는 55개 전문 워크플로에 걸친 Agents' Last Exam 53.6 — Claude Fable 5 보다 13.1점 높은 — 을 공개하고, max reasoning 의 Sol 이 Artificial Analysis Coding Agent Index 에서 Fable 5 를 "절반이 안 되는 비용으로" 앞선다고 주장한다. 글의 논지가 기대고 있는 "더 적은 토큰" 주장을 뒷받침할 토큰 수치는 공개되지 않았다.

의의: 같은 2주 사이에 Anthropic 은 Fable 급 성능의 Opus 5 를 절반 가격에 내놓았다. 두 선두 주자 모두 이제 벤치마크 상한이 아니라 해결한 작업당 비용을 판다 — 지난 2년간 싸워 온 것과는 다른 축이다.

GPT-5.6 Sol (and Terra, Luna), OpenAI소스 · OpenAI

[02]

논문 선정

DataPrep-Bench: Benchmarking LLMs as Training Data PreparatorsarXiv 2607.20465

TL;DR: LLM 이 학습 데이터를 준비하는 능력을 처음부터 끝까지 채점하는 최초의 벤치마크. 원자료에서 지도학습 데이터를 만드는 일과, fine-tune 을 돌리기 전에 후보 데이터셋의 학습 가치를 예측하는 일을 모두 본다. 여섯 개 도메인과 여러 base model 에 걸쳐, 모든 점수를 텍스트 품질 프록시가 아니라 실제 fine-tune 에 근거시킨다.

대표 결과는 부정적이다. Dolly-15k 위에 얹은 합성 도메인 데이터는 다운스트림 성능을 오히려 떨어뜨리는 경우가 많고, 특정 생성기 계열이 아니라 DataFlow 기반·직접 LLM·에이전트 기반 생성기 전반에서 그렇다.

읽어야 하는 이유: 자기개선 루프는 생성된 데이터가 학습할 가치가 있다고 전제한다. 자주 그렇지 않다고 말하는 벤치마크는 주요 소식 1번의 논의에 측정된 제약을 건다. 어제 주시 항목으로 올렸던 논문이며, 7월 28일 HF Daily 1위였다.

DataPrep-Bench: Benchmarking LLMs as Training Data Preparators (신규 페이지)

[03]

주시

  • Google 과 Meta 가 기관으로서 pacing 성명을 지지할 것인가? 두 곳의 AGI·안전 책임자는 이미 서명했고, 남은 것은 회사 이름의 서명뿐이다. → Frontier Pacing
  • Copilot 웜 부류에는 완화책이 없다. Måløy 가 페이로드를 공개하지 않은 이유가 그것이다. 지켜볼 것은 CVE 가 아니라 Microsoft 의 답이다. → AI-Enabled Cyberattacks
  • Qwen3.7-flash 가 OpenRouter 에 나타났다 (r/LocalLLaMA, 7월 28일) — Qwen 오픈 웨이트 출시가 임박했다는 첫 정황이며, Alibaba 는 확인하지 않았다. → Alibaba / Qwen AI Lab
  • GLM-5.5 는 여전히 8월 루머다. 오늘까지 Z.ai 의 모델 카드도, 엔드포인트도, 벤치마크도 없다. 공식 채널은 아직 GLM-5.2 를 홍보한다. → Z.ai
[04]

위키 신규

  • Frontier Pacing (신규 — 개념 페이지. 슬러그를 검토해 주기 바란다, 이 주제는 몇 달에 걸쳐 쌓일 것이다)
  • Lyria 3.5 (신규 — Google DeepMind 의 음악 모델. 7월 29일 Google Flow Music 에 벤치마크·가격·라이선스 없이 투입되었고, Lyria 3 한 달 뒤의 소수점 릴리스다)
  • DataPrep-Bench: Benchmarking LLMs as Training Data Preparators (신규 — 논문 페이지. arxiv.org 가 403 을 반환해 전체 저자 목록은 확보하지 못했다)
  • June 2026 — Monthly Digest (신규 — 6월 월간 다이제스트, 소급 작성. 이 위키의 첫 월간이다)
[05]

갱신