AI 모델 · Google
Gemini 1.0 Ultra
Google 모델 · 2023년 12월 6일 공개. 독립 벤치마크 점수, 종합 지수, 사람 투표 순위와 개발사 발표 점수를 그래프로 정리했습니다.
- 개발
- Google DeepMind
- 공개일
- 이용 방식
- API 제공
- 학습 연산량
- 5.0×10²⁵ FLOPEpoch AI 추정치
- 종합 능력 지수(ECI)
- 아직 없음
- Arena 점수(사람 투표)
- 아직 없음
주요 반응
Gemini 1.0 Ultra는 발표 직후 벤치마크 우위와 시연 영상으로 주목받았으나, 실시간처럼 편집된 영상과 서로 다른 조건의 MMLU 비교가 비판을 받았다. Gemini Advanced 출시 후 리뷰에서는 속도와 창의성은 호평받았지만 추론력은 GPT-4에 못 미친다는 평이 많았다.
- 비판발표 때 공개한 시연 영상은 실시간 음성 대화가 아니라 정지 이미지와 텍스트 프롬프트로 만든 것으로 알려져 논란이 됐다. Google은 입력과 출력이 실제라고 해명했고, 개발자에게 영감을 주려는 영상이라고 설명했다.[1]
- 엇갈림Google은 MMLU 90.04%로 GPT-4를 앞섰다고 밝혔지만 자사는 CoT@32, GPT-4는 5-shot으로 측정해 공정한 비교가 아니라는 지적이 나왔다. 같은 5-shot 기준에서는 Ultra가 GPT-4보다 낮았다.[1][2][3]
- 엇갈림Gemini Advanced를 써 본 리뷰어들은 GPT-4보다 응답이 빠르고 창작이 조금 더 창의적이라고 평가했다. 반면 추론은 GPT-4가 낫다는 평이 우세했고, 코딩은 첫 실행에 성공했다는 후기와 일부 과제에 실패했다는 후기가 엇갈렸다.[4][5]
- 비판단점으로는 컨텍스트가 32k 토큰으로 GPT-4 Turbo의 128k보다 짧다는 점, 이미지 생성이 DALL-E 3에 크게 못 미친다는 점, 일부 주제에서 응답이 지나치게 조심스럽다는 점이 꼽혔다.[4][5]
- 엇갈림한 분석가는 초기에는 호평이 많았고 반응이 나빠진 것은 모델보다 Google의 발표 방식 탓이라고 봤다. 한편 GPT-4에 맞설 강력한 경쟁자의 등장을 환영하는 목소리도 있었다.[3][2]
반응 출처 5개
- Gemini co-lead Oriol Vinyals addresses criticism of Google Deepmind's staged multimodal demo · the-decoder.com
- Gemini Is Google's Best AI Model Yet, But Who Cares? · spectrum.ieee.org
- Why Are People Bashing Google Gemini if It's Better Than GPT-4? · thealgorithmicbridge.com
- A Review of Gemini Advanced (powered by Gemini Ultra 1.0) · ilikekillnerds.com
- Gemini Ultra Released - A First Look · patmcguinness.substack.com
출시 기사·리뷰·전문가 평가·개발자 커뮤니티 토론을 LUCAS AI News가 읽고 요약했습니다(2026-10-11 기준). 원문 표현은 옮기지 않았으니 자세한 내용은 출처에서 확인하세요.
독립 벤치마크 점수
독립 평가 기관이 아직 이 모델의 점수를 발표하지 않았습니다. 점수가 나오면 반영합니다.
함께 볼 모델
Gemini 1.0 Pro Google · 2023-12-13
Gemini 1.5 Pro (May 2024) Google · 2024-05-14- Claude 2.1 Anthropic · 2023-11-21
- GPT-3.5 Turbo (Nov 2023) OpenAI · 2023-11-06