$ cat wiki/models/leanstral-1-5.md
Leanstral 1.5
modelupdated 2026-07-21created 2026-07-05
Spec
| Attribute | Value |
|---|---|
| Developer | Mistral AI |
| Released | 2026-07-01 / 2026-07-02 |
| Announced | 2026-07-01 / 2026-07-02 (릴리스 블로그) |
| Context window | unknown |
| Pricing | 무료 API 엔드포인트 (leanstral-1-5, Mistral Labs), 공개 가중치 |
| License | Apache 2.0 |
| Availability | HuggingFace 가중치 + Mistral Labs 의 무료 API (leanstral-1-5) |
| Architecture | Mixture-of-Experts (MoE) |
| Total parameters | 119B |
| Active parameters | 토큰당 약 6.5B |
| Specialization | Lean 4 형식 검증, 정리 증명 |
Benchmarks
| Benchmark | Score | Notes |
|---|---|---|
| miniF2F | 100% | 고교 → 수학 올림피아드. 완전 포화 |
| PutnamBench | 587 / 672 | Putnam 대회 문제 (87.4%) |
| FATE-H | 87% | 대수, 상급 |
| FATE-X | 34% | 대수, 전문가 등급 |
Use Cases
- 형식 검증: 함수와 알고리즘에 대한 Lean 4 증명 생성
- 자동 정리 증명: 수학적으로 엄밀한 도출
- 에이전틱 증명 엔지니어링: 도구를 쓰는 다단계 증명 구성
- 실제 코드 검증: 오픈소스 저장소 57곳에서 이전에 알려지지 않은 버그 5건 발견
Compared To
Mistral 은 다른 형식 검증 모델(DeepSeek-Prover, Kimina-Prover 등)과의 직접 비교를 공개하지 않았다. 2026년 7월 기준 miniF2F 100% 와 PutnamBench 587/672 는 동급 최고다.
Why It Matters
형식 검증은 그동안 증명 보조 도구(Lean, Coq, Isabelle)에 대한 전문 지식을 요구해 왔다. 활성 파라미터 6.5B 모델이 miniF2F 를 포화시키고 프로덕션 코드에서 실제 버그를 찾아내면서, 수학적으로 인증된 소프트웨어를 배포하는 문턱이 크게 낮아졌다. Apache 2.0 라이선스는 항공우주·금융·핵심 인프라에서 상업적으로 쓸 수 있게 한다.
Sources
- Mistral 공식 블로그: Leanstral 1.5: Proof Abundance for All — 2026년 7월
- The Decoder
- sources/blogs/mistral-2026-07-02-leanstral-1-5.md
Open Questions
- Leanstral 1.5 는 DeepSeek-Prover v2 등 전용 형식 증명 모델과 비교하면 어떤가?
- Lean 4 를 넘어 다른 증명 보조 도구(Coq, Isabelle)로 일반화되는가?
- Mistral 이 도메인 특화 검증 과제를 위한 파인튜닝 레시피를 공개할 것인가?