BENCHMARK · 공간·학습
EBR-bench 순위
덜 알려진 게임 Earthborne Rangers를 반복해서 할수록 점수가 오르는지 보는 학습 능력 시험.
상위 모델
- OpenAI
- Anthropic
Google- xAI
공개일에 따른 점수
선은 개발사별로 그때까지의 최고 점수를 잇습니다. 오른쪽 위로 갈수록 최근에 나온 높은 점수입니다.
- GPT-6 Astra 76%
- Claude Opus 5.5 71%
- Grok 4.6 30%
- Gemini 3.1 Pro 14%
전체 순위
| 순위 | 모델 | 점수 | 생각 수준 | 공개일 |
|---|---|---|---|---|
| 1 | GPT-6 AstraOpenAI | 76.2%±8.4% | 최대 | 2026-09-03 |
| 2 | Claude Opus 5.5Anthropic | 71.4%±7.1% | 최대 | 2026-09-22 |
| 3 | Claude Fable 5.1Anthropic | 57.1%±6% | 최대 | 2026-09-01 |
| 4 | GPT-6.1 SolOpenAI | 54.3%±5.8% | 최대 | 2026-09-29 |
| 5 | GPT-6 SolOpenAI | 53.3%±4.6% | 최대 | 2026-09-22 |
| 6 | Claude Opus 5Anthropic | 45.7%±3.6% | 최대 | 2026-07-24 |
| 7 | GPT-5.6 SolOpenAI | 44.8%±4.2% | 최대 | 2026-07-09 |
| 8 | Claude Fable 5Anthropic | 39.5%±2% | 최대 | 2026-06-09 |
| 9 | GPT-5.5OpenAI | 34.3%±2% | 매우 높음 | 2026-04-23 |
| 10 | Grok 4.6xAI | 30.5%±1.6% | 매우 높음 | 2026-08-12 |
| 11 | Claude Opus 4.8Anthropic | 28.6%±1.4% | — | 2026-05-28 |
| 12 | GPT-5.4OpenAI | 25.4% | 매우 높음 | 2026-03-05 |
| 13 | GPT-5.2OpenAI | 23% | 매우 높음 | 2025-12-11 |
| 14 | Claude Opus 4.7Anthropic | 19.1% | 최대 | 2026-04-16 |
| 15 | 14.3% | — | 2026-02-19 | |
| 15 | Claude Opus 4.5Anthropic | 14.3% | — | 2025-11-24 |
| 17 | Claude Opus 4.6Anthropic | 12.7% | 최대 | 2026-02-05 |
| 17 | GPT-5OpenAI | 12.7% | 높음 | 2025-08-07 |
| 19 | Claude Opus 4.1Anthropic | 7.9% | — | 2025-08-05 |
| 20 | 4.8% | — | 2026-05-19 | |
| 21 | Claude Sonnet 4.5Anthropic | 2.4% | — | 2025-09-29 |