AI 모델 · Google
Gemini 2.0 Flash-Lite
Google 모델 · 2025년 2월 5일 공개. 독립 벤치마크 점수, 종합 지수, 사람 투표 순위와 개발사 발표 점수를 그래프로 정리했습니다.
- 개발
- Google DeepMind
- 공개일
- 이용 방식
- API 제공
- 종합 능력 지수(ECI)
- 아직 없음
- Arena 점수(사람 투표)
- 1330225위 · 투표 24,955표
독립 벤치마크 점수
독립 평가 기관이 아직 이 모델의 점수를 발표하지 않았습니다. 점수가 나오면 반영합니다.
개발사 발표 점수
개발사가 공식 페이지나 논문에 직접 밝힌 수치입니다. 평가 조건이 서로 달라 다른 모델과 바로 비교하기는 어렵습니다. 항목마다 원문에서 확인할 수 있습니다.
| 항목 | 발표 값 | 원문 |
|---|---|---|
| Code LiveCodeBench (v6) | 28.5% | deepmind.google |
| Code BigCodeBench | 45.8% | deepmind.google |
| Code LBPP (v2) | 56% | deepmind.google |
| Code SWE-Bench Verified* | 28.5% | deepmind.google |
| Code HumanEval | 90.2% | deepmind.google |
| Code MBPP | 75.8% | deepmind.google |
| Science GPQA Diamond | 56.5% | deepmind.google |
| Mathematics AIME 2025 | 20% | deepmind.google |
| Reasoning BIG-Bench Extra Hard | 21% | deepmind.google |
| Multilingual Global MMLU (Lite) | 79% | deepmind.google |
함께 볼 모델
Gemini 2.0 Pro Google · 2025-02-05
Gemini 2.5 Pro (Mar 2025) Google · 2025-03-25- o3-mini OpenAI · 2025-01-31
- Claude 3.7 Sonnet Anthropic · 2025-02-24