AI 모델 · xAI
Grok-1
xAI 모델 · 2023년 11월 4일 공개. 독립 벤치마크 점수, 종합 지수, 사람 투표 순위와 개발사 발표 점수를 그래프로 정리했습니다.
- 개발
- xAI
- 공개일
- 이용 방식
- 공개 가중치
- 매개변수(공개·추정치)
- 3140억 개
- 학습 연산량
- 2.9×10²⁴ FLOPEpoch AI 추정치
- 종합 능력 지수(ECI)
- 아직 없음
- Arena 점수(사람 투표)
- 아직 없음
주요 반응
출시 당시에는 xAI가 직접 내놓은 벤치마크 위주로 소개되었고, 2024년 3월 가중치가 공개되자 3,140억 파라미터 규모와 Apache 2.0 라이선스가 주목받았다. 다만 미세조정되지 않은 베이스 모델이라 성능과 연구 활용도를 두고 회의적인 평가도 많았다.
- 엇갈림2023년 11월 공개 당시 xAI는 Grok-1이 같은 연산 규모의 모델을 앞선다고 밝혔다. 다만 헝가리 수학 시험에서는 GPT-4(68%)보다 낮은 59%였고, 학습 2개월의 초기 베타라는 점도 언급됐다.[1]
- 호평2024년 3월 3,140억 파라미터 MoE 모델의 가중치가 Apache 2.0으로 공개되자, 당시 공개된 언어 모델 중 가장 크고 상업적 이용도 가능하다는 점이 주목받았다.[2][3][4]
- 비판Vector Institute 평가에서는 MMLU 일부 과목에서 Mixtral 8x7B에 뒤졌고 독성 점수도 GPT-3.5·GPT-4보다 높았다. 필요한 하드웨어에 비해 성과가 기대에 못 미친다는 결론이었다.[2][5]
- 엇갈림전문가들은 학습 데이터와 코드가 빠져 오픈소스라기보다 가중치 공개에 가깝다고 짚었다. 일부는 규모를 긍정적으로 봤지만, 다른 전문가는 Falcon 180B처럼 잊힐 것이라고 전망했다.[4]
- 엇갈림Perplexity CEO Aravind Srinivas는 대화형 검색용으로 미세조정해 쓰겠다고 밝혔다. 개발자 커뮤니티에서는 H100 8장이 필요하다는 답이 나올 만큼 실행 부담이 크다는 반응이 있었다.[6][7]
반응 출처 7개
- Elon Musk's xAI Unveils Grok, an AI Assistant with a "Rebellious Streak" · maginative.com
- Benchmarking xAI's Grok-1 · vectorinstitute.ai
- X.ai's Grok-1 Model is Officially Open-Source and Larger Than Expected · synthedia.substack.com
- Grokking X.ai's Grok—Real Advance or Just Real Troll? · spectrum.ieee.org
- Grok-1 chatbot model released – open source or open Pandora's box? · theregister.com
- xAI open sources base model of Grok, but without any training code · techcrunch.com
- Grok Weights Available via Torrent | Hacker News · news.ycombinator.com
출시 기사·리뷰·전문가 평가·개발자 커뮤니티 토론을 LUCAS AI News가 읽고 요약했습니다(2026-10-11 기준). 원문 표현은 옮기지 않았으니 자세한 내용은 출처에서 확인하세요.
독립 벤치마크 점수
독립 평가 기관이 아직 이 모델의 점수를 발표하지 않았습니다. 점수가 나오면 반영합니다.
개발사 발표 점수
개발사가 공식 페이지나 논문에 직접 밝힌 수치입니다. 평가 조건이 서로 달라 다른 모델과 바로 비교하기는 어렵습니다. 항목마다 원문에서 확인할 수 있습니다.
함께 볼 모델
- Grok-1.5 xAI · 2024-03-28
- Grok-2 mini xAI · 2024-08-13
- GPT-3.5 Turbo (Nov 2023) OpenAI · 2023-11-06
- Claude 2.1 Anthropic · 2023-11-21