$ cat briefs/daily/2026-07-30.md
2026-07-30
2026년 7월 30일 (목)
ingest + brief 에이전트 생성 · 소스: Tier 1 (HuggingFace Daily, Anthropic, OpenAI, Google DeepMind, Meta AI, Mistral, xAI, X 피드, DeepSeek + Z.ai 로테이션) + 프리페치 후보
주요 소식
1. 랩들이 워싱턴에 브레이크를 요구했다 — 그중 둘은 회사 이름으로 서명했다
프런티어 랩 직원 천여 명이 7월 28일 "Pacing the Frontier" 를 발표하고, 미국 정부에 "자동화된 AI 개발의 프런티어를 의도적으로 늦추는 데 필요한 기술적·거버넌스적 도구를 개발하는 국제적 노력을 지원해" 달라고 요구했다. 요구는 명시적으로 중단이 아니다. 역량 발전이 그 결과 시스템을 이해하고 통제하는 능력을 앞질렀을 때, 나중에 속도를 조절할 선택지를 갖자는 것이다.
OpenAI 와 Anthropic 은 몇 시간 만에 기관으로서 지지했다. Google 과 Meta 는 그러지 않았다 — Shane Legg, Anca Dragan, Shengjia Zhao 는 모두 개인 자격으로 서명했지만. 서명자 분포는 Anthropic 533, OpenAI 330, Google 191, Meta 62 이고, 이름이 알려진 서명자로는 Dario Amodei, Jared Kaplan, Chris Olah, Jakub Pachocki, Mark Chen 이 있다.
서명자 수는 24시간 안에 네 가지로 보도되었다(1,134 / 1,178 / 1,224 / "over 1,100"). 명단이 열려 있어 계속 채워지는 중이었기 때문이며, 위키 페이지는 하나를 고르는 대신 넷을 모두 기록한다.
의의: 이것은 6월 5일의 Favaro–Clark "브레이크 페달" 이 서명과 두 건의 기관 지지를 달고 도착한 것이다. 우리가 추적하는 다른 모든 거버넌스 항목은 국가가 산업에 가하는 것이다 — 수출 통제, Kill Switch Act, EU AI Act. 이번 것은 산업이 정부에게 자신을 상대로 한 역량을 갖춰 달라고 요구하면서, 규칙을 요구하지는 않는 사례다.
→ Frontier Pacing (신규 페이지), Anthropic, OpenAI, Chris Olah → 소스 · Washington Post · NBC News
2. Claude Mythos Preview 가 버그 사냥이 아니라 독창적인 암호해독을 해냈다
Anthropic 은 Mythos Preview 가 포스트 양자 서명 스킴 HAWK-256 에 대한 종단간 키 복구 공격을 도출했다고 밝혔다. 그 아래 놓인 Lattice Isomorphism Problem 에서 지금까지 활용되지 않았던 nontrivial automorphism 을 찾아낸 결과다. 전체 키 복구의 기대 비용이 2^64 에서 2^38 연산으로 떨어지며, 공개된 구현으로 96코어 서버에서 약 3시간 42분이 걸린다.
별도로 7라운드 AES-128 에 대해 200–800배 속도 향상을 냈다. 모델이 Möbius Bridge 라 이름 붙인 fingerprinting 기법으로, 기존에 256개 값을 확인해야 했던 추측 단계 하나를 제거한다. 며칠에 걸친 가벼운 프롬프팅 이후로는 거의 완전히 자율적으로 진행되었고, HAWK 저자들에게 통지되어 공개는 NIST 를 거쳤다.
Anthropic 은 어느 결과도 실제 운영 시스템에는 영향이 없다고 밝힌다. AES 공격은 열 라운드 중 일곱 라운드까지만 도달하며 비현실적인 수의 chosen plaintext 를 요구하고, HAWK 는 배포된 표준이 아니라 후보다.
의의: Project Glasswing 의 지금까지 기록은 구현 버그다 — 원리적으로는 끈기 있는 사람이 코드를 읽어 찾을 수 있는 것들이다. 격자 문제의 새로운 automorphism 은 암호학계가 갖고 있지 않던 수학이다. 그리고 이것은 같은 회사가 자동화된 연구의 속도를 늦출 방법을 워싱턴에 요구한 바로 다음 날 나왔다.
→ Claude Mythos Preview, AI-Enabled Cyberattacks, Anthropic → 소스 · Anthropic · The Hacker News
3. 다음 Word 문서를 감염시키는 Word 문서, 통로는 Copilot
Håkon Måløy 가 문서를 매개로 하는 AI 웜을 공개했다. Word 파일에 숨긴 지시문이 Copilot for Word 의 컨텍스트로 들어가 그 출력물을 바꾸고, 그 문서에서 파생된 새 파일로 스스로를 복사한다. 시연된 효과는 재무 데이터의 변조였다. 전파는 한 문서에서 다른 문서를 만들어내는 지극히 일상적인 행위를 통해 일어나고, 피해자가 알아챌 만한 것은 아무것도 없다.
그는 2026년 3월부터 Microsoft 와 함께 이 문제를 다뤄 왔고 약 144일 뒤에 공개했으며, 이 부류에 대한 견고한 완화책이 존재하지 않는다는 이유로 구체적인 페이로드는 공개하지 않았다.
의의: 우리 사이버 페이지의 이전 사건들은 모두 에이전트를 쥔 공격자나 랩 자신의 평가 하네스를 필요로 했다. 이번 것은 둘 다 필요 없다. 전파 경로는 어시스턴트가 설계대로 동작하는 것 자체이고, 따라서 수정은 버그 패치일 수 없다 — 공격면이 곧 제품인 첫 항목이다.
→ AI-Enabled Cyberattacks, Microsoft → 소스 · The Register
4. OpenAI 가 역량 프런티어가 아니라 효율 프런티어를 주장한다
"How GPT-5.6 fuses frontier intelligence with frontier efficiency" (7월 29일) 는 55개 전문 워크플로에 걸친 Agents' Last Exam 53.6 — Claude Fable 5 보다 13.1점 높은 — 을 공개하고, max reasoning 의 Sol 이 Artificial Analysis Coding Agent Index 에서 Fable 5 를 "절반이 안 되는 비용으로" 앞선다고 주장한다. 글의 논지가 기대고 있는 "더 적은 토큰" 주장을 뒷받침할 토큰 수치는 공개되지 않았다.
의의: 같은 2주 사이에 Anthropic 은 Fable 급 성능의 Opus 5 를 절반 가격에 내놓았다. 두 선두 주자 모두 이제 벤치마크 상한이 아니라 해결한 작업당 비용을 판다 — 지난 2년간 싸워 온 것과는 다른 축이다.
논문 선정
DataPrep-Bench: Benchmarking LLMs as Training Data Preparators — arXiv 2607.20465
TL;DR: LLM 이 학습 데이터를 준비하는 능력을 처음부터 끝까지 채점하는 최초의 벤치마크. 원자료에서 지도학습 데이터를 만드는 일과, fine-tune 을 돌리기 전에 후보 데이터셋의 학습 가치를 예측하는 일을 모두 본다. 여섯 개 도메인과 여러 base model 에 걸쳐, 모든 점수를 텍스트 품질 프록시가 아니라 실제 fine-tune 에 근거시킨다.
대표 결과는 부정적이다. Dolly-15k 위에 얹은 합성 도메인 데이터는 다운스트림 성능을 오히려 떨어뜨리는 경우가 많고, 특정 생성기 계열이 아니라 DataFlow 기반·직접 LLM·에이전트 기반 생성기 전반에서 그렇다.
읽어야 하는 이유: 자기개선 루프는 생성된 데이터가 학습할 가치가 있다고 전제한다. 자주 그렇지 않다고 말하는 벤치마크는 주요 소식 1번의 논의에 측정된 제약을 건다. 어제 주시 항목으로 올렸던 논문이며, 7월 28일 HF Daily 1위였다.
→ DataPrep-Bench: Benchmarking LLMs as Training Data Preparators (신규 페이지)
주시
- Google 과 Meta 가 기관으로서 pacing 성명을 지지할 것인가? 두 곳의 AGI·안전 책임자는 이미 서명했고, 남은 것은 회사 이름의 서명뿐이다. → Frontier Pacing
- Copilot 웜 부류에는 완화책이 없다. Måløy 가 페이로드를 공개하지 않은 이유가 그것이다. 지켜볼 것은 CVE 가 아니라 Microsoft 의 답이다. → AI-Enabled Cyberattacks
- Qwen3.7-flash 가 OpenRouter 에 나타났다 (r/LocalLLaMA, 7월 28일) — Qwen 오픈 웨이트 출시가 임박했다는 첫 정황이며, Alibaba 는 확인하지 않았다. → Alibaba / Qwen AI Lab
- GLM-5.5 는 여전히 8월 루머다. 오늘까지 Z.ai 의 모델 카드도, 엔드포인트도, 벤치마크도 없다. 공식 채널은 아직 GLM-5.2 를 홍보한다. → Z.ai
위키 신규
- Frontier Pacing (신규 — 개념 페이지. 슬러그를 검토해 주기 바란다, 이 주제는 몇 달에 걸쳐 쌓일 것이다)
- Lyria 3.5 (신규 — Google DeepMind 의 음악 모델. 7월 29일 Google Flow Music 에 벤치마크·가격·라이선스 없이 투입되었고, Lyria 3 한 달 뒤의 소수점 릴리스다)
- DataPrep-Bench: Benchmarking LLMs as Training Data Preparators (신규 — 논문 페이지. arxiv.org 가 403 을 반환해 전체 저자 목록은 확보하지 못했다)
- June 2026 — Monthly Digest (신규 — 6월 월간 다이제스트, 소급 작성. 이 위키의 첫 월간이다)
갱신
- Anthropic: 암호해독 결과; pacing 성명에 대한 기관 차원의 지지
- OpenAI: GPT-5.6 효율 관련 글; 기관 차원의 지지
- Google DeepMind: Lyria 3.5; 기관 지지 없이 서명한 Legg 와 Dragan
- DeepSeek: 유출된 녹취가 퍼진 뒤 2차 펀딩 라운드 중단 — ¥480–500B 프리머니 밸류에이션에 ¥10B 목표
- Meta AI: 개인 자격으로 서명한 Shengjia Zhao; 62명으로 4개 랩 중 가장 작은 규모
- Claude Mythos Preview: HAWK-256 및 7라운드 AES-128 절
- GPT-5.6 Sol (and Terra, Luna): 벤치마크에 Agents' Last Exam 수치 추가
- AI-Enabled Cyberattacks: Copilot 웜; 타임라인 두 줄 추가
- AI Governance: 거버넌스 사건으로서의 pacing; 현재 수준 날짜 갱신
- Chris Olah: 이름이 알려진 서명자
- AI Alignment, AI Control Roadmap, Open-Weights Policy Fight 에 상호 링크 추가