$ cat wiki/models/gemini-3-1-deep-think.md
Gemini 3.1 Deep Think
modelupdated 2026-07-21created 2026-05-17
Spec
| Attribute | Value |
|---|---|
| Developer | Google DeepMind |
| Released | unknown |
| Announced | 2026-01 (고급 버전. 원본 Deep Think 는 2025년 7월 IMO 금메달 달성) |
| Context window | unknown |
| Pricing | unknown |
| License | unknown |
| Availability | unknown |
| Model family | Gemini 3.x |
| Variant | Deep Think (확장 추론 모드) |
| Focus | 수학·과학 추론, 자율 연구 |
| IMO-ProofBench Advanced | 최대 90% (고급 버전, 2026년 1월) |
| Prior milestone | IMO 금메달 수준 (2025년 7월) |
Release Date
- IMO 금메달: 2025년 7월
- 고급 "Deep Think" 버전: ~2026년 1월
- 과학 도메인 확장(물리·화학 올림피아드 수준): 2026년
Benchmarks
- IMO-ProofBench Advanced: 최대 90%
- 2025 국제수학올림피아드: 금메달 수준 (자연어 추론)
- 2025 국제물리올림피아드 (필기): 금메달 수준
- 2025 국제화학올림피아드 (필기): 금메달 수준
Key Capabilities
자율 수학 연구: Aletheia
Google DeepMind 는 Gemini Deep Think 로 구동되는 Aletheia 라는 자율 연구 에이전트를 만들었다:
- 증명의 결함을 찾아내는 자연어 검증기
- 생성-수정을 반복하는 루프. 풀 수 없음을 인정할 수도 있다
- 수학·물리·CS·경제학에서 미해결 문제 18건 해결
- 10년 된 추측 반증 (온라인 서브모듈러 최적화, 2015년부터 미해결)
- 인간 개입 없이 논문 Feng26 생성 — 산술기하학에서 고유가중치 계산 → AI 에 의한 진정한 자율 수학 연구의 첫 사례 중 하나
과학 도메인
수학을 넘어 화학과 물리에서도 연구 수준으로 뛰어나다.
Compared To
| Model | IMO-Level Math | Autonomous Research |
|---|---|---|
| Gemini 3.1 Deep Think | 금메달 (2025-07) | 미해결 문제 18건 (2026) |
| o1/o3 (OpenAI) | 금메달급 보고됨 | 미보고 |
| Claude Opus 4.7 | IMO 벤치마크 없음 | 미보고 |
Use Cases
- 수학 연구 가속
- 과학 올림피아드 대비
- 새로운 정리 증명
- 알고리즘 설계 (AlphaEvolve 경유)
Related
- Google DeepMind
- AlphaEvolve — 역시 Gemini 로 구동되는 짝 코딩·알고리즘 에이전트
- Reasoning Models — Gemini Deep Think 는 test-time compute 스케일링의 대표 사례다
- Achieving Gold-Medal-Level Olympiad Reasoning via Simple and Unified Scaling — 다른 그룹의 병렬 결과, 같은 역량 프런티어