AI의 변화, 근거와 맥락까지.AI NEWS & CONTEXT
AI 모델 · Google

Gemini 1.0 Ultra

Google 모델 · 2023년 12월 6일 공개. 독립 벤치마크 점수, 종합 지수, 사람 투표 순위와 개발사 발표 점수를 그래프로 정리했습니다.

개발
Google DeepMind
공개일
이용 방식
API 제공
학습 연산량
5.0×10²⁵ FLOPEpoch AI 추정치
종합 능력 지수(ECI)
아직 없음
Arena 점수(사람 투표)
아직 없음

비슷한 모델과 비교하기사전에서 Gemini 알아보기

주요 반응

Gemini 1.0 Ultra는 발표 직후 벤치마크 우위와 시연 영상으로 주목받았으나, 실시간처럼 편집된 영상과 서로 다른 조건의 MMLU 비교가 비판을 받았다. Gemini Advanced 출시 후 리뷰에서는 속도와 창의성은 호평받았지만 추론력은 GPT-4에 못 미친다는 평이 많았다.

  • 비판발표 때 공개한 시연 영상은 실시간 음성 대화가 아니라 정지 이미지와 텍스트 프롬프트로 만든 것으로 알려져 논란이 됐다. Google은 입력과 출력이 실제라고 해명했고, 개발자에게 영감을 주려는 영상이라고 설명했다.[1]
  • 엇갈림Google은 MMLU 90.04%로 GPT-4를 앞섰다고 밝혔지만 자사는 CoT@32, GPT-4는 5-shot으로 측정해 공정한 비교가 아니라는 지적이 나왔다. 같은 5-shot 기준에서는 Ultra가 GPT-4보다 낮았다.[1][2][3]
  • 엇갈림Gemini Advanced를 써 본 리뷰어들은 GPT-4보다 응답이 빠르고 창작이 조금 더 창의적이라고 평가했다. 반면 추론은 GPT-4가 낫다는 평이 우세했고, 코딩은 첫 실행에 성공했다는 후기와 일부 과제에 실패했다는 후기가 엇갈렸다.[4][5]
  • 비판단점으로는 컨텍스트가 32k 토큰으로 GPT-4 Turbo의 128k보다 짧다는 점, 이미지 생성이 DALL-E 3에 크게 못 미친다는 점, 일부 주제에서 응답이 지나치게 조심스럽다는 점이 꼽혔다.[4][5]
  • 엇갈림한 분석가는 초기에는 호평이 많았고 반응이 나빠진 것은 모델보다 Google의 발표 방식 탓이라고 봤다. 한편 GPT-4에 맞설 강력한 경쟁자의 등장을 환영하는 목소리도 있었다.[3][2]
반응 출처 5개
  1. Gemini co-lead Oriol Vinyals addresses criticism of Google Deepmind's staged multimodal demo · the-decoder.com
  2. Gemini Is Google's Best AI Model Yet, But Who Cares? · spectrum.ieee.org
  3. Why Are People Bashing Google Gemini if It's Better Than GPT-4? · thealgorithmicbridge.com
  4. A Review of Gemini Advanced (powered by Gemini Ultra 1.0) · ilikekillnerds.com
  5. Gemini Ultra Released - A First Look · patmcguinness.substack.com

출시 기사·리뷰·전문가 평가·개발자 커뮤니티 토론을 LUCAS AI News가 읽고 요약했습니다(2026-10-11 기준). 원문 표현은 옮기지 않았으니 자세한 내용은 출처에서 확인하세요.

독립 벤치마크 점수

독립 평가 기관이 아직 이 모델의 점수를 발표하지 않았습니다. 점수가 나오면 반영합니다.

함께 볼 모델