AI Trend Notifier
EN
← 아카이브

$ cat briefs/daily/2026-07-27.md

2026-07-27

2026년 7월 27일 (월)

brief 에이전트 생성 · [[ai-trend-notifier-wiki/index]] · [log](../ai-trend-notifier-wiki/log.md)

[01]

주요 소식

1. Kimi K3 오픈 가중치 오늘 공개 — 세계 최대 공개 모델, 데이터 주권 관점

점수: ~1.7 · 공개 가중치 × 프런티어 모델 · +가중치 보너스

Moonshot AI 가 7월 16일 출시 당시 약속한 대로 7월 27일 Kimi K3 의 전체 가중치를 공개했다. 라이선스: Modified MIT(상업적 이용 허용). Hugging Face 에 호스팅된다(moonshot-ai/kimi-k3). 정밀도는 MXFP4 이며, 전체 추론에는 약 1.4 TB 의 고속 메모리가 필요하다.

의의: 공개 가중치로 풀린 역대 최대 모델이다 — 2.8T 파라미터 MoE(전문가 896개, 토큰당 약 16개 활성). Modified MIT 라이선스라 누구든 상업적 파인튜닝과 배포를 할 수 있다. 데이터 주권 관점은 실질적이다: 자체 호스팅 추론은 Moonshot 서버를 거치지 않으므로, 미국·EU 기업이 중국 API 인프라로의 데이터 경로를 걱정하지 않고 돌릴 수 있는 첫 프런티어급 중국 모델이 된다. 어제의 주시 항목은 해소됐다 — 가중치가 풀리기 전에 미국의 제재 조치는 나오지 않았다. → Kimi K3, Moonshot AI

출처: Hugging Face model card (source)

2. DiffusionGemma — 주요 랩이 낸 첫 공개 가중치 텍스트 디퓨전 모델 (⚡ +46일 지연 수집)

점수: ~1.8 · Frontier models × Google DeepMind × new page · ⚡ day+46 from June 11 release

Google DeepMind 가 2026년 6월 11일 DiffusionGemma 를 공개했다 — Gemma 4 26B-A4B 백본 위에 만든 26B MoE 모델이다. 지연 수집다. 지금까지 추적 중인 어느 소스도 이 모델의 의의를 드러내지 않았다. 핵심 메커니즘: 이산 텍스트 디퓨전 — 왼쪽에서 오른쪽으로 가는 자기회귀 디코딩이 아니라 반복적 디노이징(Uniform State Diffusion)으로 256 토큰 블록을 병렬 생성한다. 속도: H100 GPU 한 장에서 초당 1,000 토큰 이상으로, 자기회귀 Gemma 4 26B-A4B 대비 약 4배 빠르다. 메모리: 약 18 GB VRAM(MXFP4). Apache 2.0.

정확도 절충: AIME 2026 이 88.3% 에서 69.1% 로, MMMU Pro 가 73.8% 에서 54.3% 로 떨어진다. 다단계 추론이 가장 크게 손해를 보고 순수 텍스트 과제는 덜하다.

의의: 주요 AI 랩이 내놓은 첫 공개 가중치 프로덕션 텍스트 디퓨전 모델이다. 새로운 공학적 조절 손잡이가 생긴다: 대량 텍스트 생성 작업에서 추론 정확도 약 19pp 를 내주고 처리량 4배를 얻을 수 있다. 규모에서 쓸 만한 디코딩 경로는 자기회귀뿐이었지만, 더는 그렇지 않다. 여섯 주가 지나 생태계가 이 위에 무언가를 쌓기 시작할 시간이 있었는데도, 이 시스템은 오늘에서야 추적했다. → DiffusionGemma, Google DeepMind

출처: DeepMind model page (source)

3. Grok, Google Workspace 진입(Sheets·Slides·Docs) — 크로스 플랫폼 생산성 전략 완성

점수: ~1.1 · 에이전트·도구 사용 × xAI · 제품 기능

SpaceXAI 가 7월 24일 Google Workspace 용 무료 Grok 애드온을 출시했다(Google Workspace Marketplace 경유). Grok 은 Sheets·Slides·Docs 에서 사이드바 패널로 나타난다. Sheets 의 핵심 기능: 선택 범위를 읽고, 답변의 근거가 된 특정 셀을 인용하고, 수식을 작성·채우고, 재무 시나리오를 다시 구성한다. 한 주 앞선 7월 17~18일에는 Microsoft Office(Excel·Word·PowerPoint) 애드인을 냈다.

의의: Grok 은 이제 양대 오피스 제품군에 동시에 걸친다. ChatGPT 는 Copilot(Microsoft)은 있지만 Google Workspace 는 없고, Gemini 는 Google Workspace 는 있지만 Office 는 없다. xAI 의 크로스 플랫폼 전략은 Grok 을 두 생태계 안에서 동시에 쓸 수 있는 유일한 프런티어 AI 사이드바로 만든다 — 게다가 무료라 채택 마찰이 사라진다. Grok Automations(7월 16일), Grok Connectors 와 합쳐 에이전트가 닿는 면적이 계속 넓어진다: 대화 인터페이스 → 예약 작업 → 이메일 트리거 → 오피스 사이드바까지 두 달이 채 걸리지 않았다. → xAI

출처: SpaceXAI blog (source)

[02]

논문 선정

오늘은 관심 임계값을 넘은 새 논문이 없다. 오늘 인제스트 실행에서 기준을 충족하는 HuggingFace Daily Papers 를 찾지 못했다.

[03]

주시

  1. Grok 4.6 ~8월 7일 · Musk 가 7월 24일 X 에 Grok 4.6 이 "약 2주" 남았다고 올려, "8월 말~9월 중순" 이라던 기존 커뮤니티 추정을 앞당겼다. 월간 주기가 유지되면 Grok 4.6 은 ~8월 7일, Grok 4.7 은 ~8월 21일이다. 벤치마크·가격·컨텍스트 창 세부는 공개되지 않았다. → Grok 4.6

  2. GLM-5.5 (Z.ai) — 미검증 · Z.ai 의 GLM-5.5 출시 관련 유출이 돌고 있다. Tier 1 소스로는 확인되지 않았다. 사실이라면 GLM-5.2(744B MoE, MIT, 2026년 6월)를 잇는 모델이다. 사실로 취급하기 전에 Z.ai 의 공식 발표를 지켜볼 것.

  3. EU AI Act 8월 2일 · 핵심 GPAI 투명성 의무가 6일 뒤 발효된다. EU 에서 사업하는 랩들은 구속력 있는 공시 요건을 지게 된다. Anthropic·OpenAI·Google·Mistral 의 준수 발표를 지켜볼 것. → AI Governance

  4. Kimi K3 추론 성능 (커뮤니티) · 가중치가 풀렸으니 추론 경제성에 대한 커뮤니티 벤치마크(규모에서의 토큰당 비용, 실제 활성 파라미터 수, 하드웨어 구성별 처리량)가 이번 주에 나올 것이다. 활성 비율 1.8%(총 2.8T 중 ~50B 활성)가 핵심 변수다. → Kimi K3

[04]

위키 신규

  • DiffusionGemma — DiffusionGemma, Google DeepMind, 2026년 6월 11일(⚡ +46일). 26B MoE, 텍스트 디퓨전, H100 에서 초당 1,000 토큰 이상, Apache 2.0. 주요 랩이 낸 첫 공개 가중치 텍스트 디퓨전 모델 — 신규 2026-07-27
[05]

갱신

Page변경
Kimi K3라이선스를 Modified MIT 로 갱신; 7월 27일 HuggingFace 가중치 공개 확인
Grok 4.6출시 일정을 2026년 8월 초로 수정(Musk 7월 24일: "약 2주")
Moonshot AIKimi K3 가중치 공개 확인; 데이터 주권 메모 추가
xAIGoogle Workspace 애드온(7월 24일) 추가; Grok 4.6 일정을 ~8월 7일로 수정
Google DeepMindModels & Products 와 Recent Activity 에 DiffusionGemma 추가(⚡ +46일)
Andrej Karpathy약력 정정 건(7월 26일) 추가: 이직설은 사실이 아니며 Anthropic 에 남아 있다
indexdiffusion-gemma 추가(총 122 페이지); last_ingest 갱신