AI 모델 · OpenAI
GPT-3 175B (davinci)
OpenAI 모델 · 2020년 5월 28일 공개. 독립 벤치마크 점수, 종합 지수, 사람 투표 순위와 개발사 발표 점수를 그래프로 정리했습니다.
- 개발
- OpenAI
- 공개일
- 이용 방식
- API 제공
- 매개변수(공개·추정치)
- 1746억 개
- 학습 연산량
- 3.1×10²³ FLOPEpoch AI 집계
- 종합 능력 지수(ECI)
- 아직 없음
- Arena 점수(사람 투표)
- 아직 없음
주요 반응
GPT-3는 1750억 개 매개변수의 규모와 사람 같은 문장, 코드 작성 능력으로 큰 반향을 일으켰다. 한편 상식 부족과 편향된 출력, 선별된 시연 결과에 대한 지적이 이어졌고 샘 올트먼도 과열된 기대를 경계했다. 허위 콘텐츠 악용 우려도 함께 제기됐다.
- 호평1750억 개 매개변수는 GPT-2(15억 개)의 100배가 넘는 규모였다. 개발자들이 평문 설명으로 웹 레이아웃을 만들었고, 존 카맥은 우연히 나타난 코딩 능력에 가벼운 전율을 느꼈다고 평했다.[1]
- 엇갈림올트먼은 GPT-3를 둘러싼 기대가 지나치다고 선을 그었다. 성차별·인종차별적 표현과 상식 부족에서 오는 기초 오류가 남아 있고, 결과물이 인터넷 문장 조각의 재조합에 가깝다는 비판도 나왔다.[1]
- 엇갈림블로그 실험에서 GPT-3는 잡학 질문에 사람 이상으로 답했지만, 말이 안 되는 질문에도 모른다고 하지 않고 답했다. 전문가 기고는 물리·사회적 상황 추론에서 엉뚱한 답을 낸다고 지적했다.[2][3]
- 비판한 개발자는 자신의 트윗 생성 실험에서 쓸 만한 결과가 30~40%(GPT-2는 5~10%)라며 시연이 선별된 결과임을 짚었다. 지연 시간, 미정인 비용, 유해 출력 위험도 한계로 꼽았다.[4]
- 엇갈림개발자 커뮤니티에서는 문장의 일관성에 감탄하는 반응과 패턴만 맞출 뿐 이해는 없다는 회의가 갈렸다. GPT-3로 쓴 가짜 블로그 글이 한 커뮤니티 인기글 1위에 올라 스팸·허위 콘텐츠 우려가 커졌다.[5][6]
반응 출처 6개
- OpenAI’s new language generator GPT-3 is shockingly good—and completely mindless · technologyreview.com
- Giving GPT-3 a Turing Test · lacker.io
- GPT-3, Bloviator: OpenAI’s language generator has no idea what it’s talking about · technologyreview.com
- Tempering Expectations for GPT-3 and OpenAI’s API · minimaxir.com
- OpenAI's GPT-3 may be the biggest thing since Bitcoin · news.ycombinator.com
- A college kid created a fake, AI-generated blog. It reached #1 on Hacker News. · technologyreview.com
출시 기사·리뷰·전문가 평가·개발자 커뮤니티 토론을 LUCAS AI News가 읽고 요약했습니다(2026-10-11 기준). 원문 표현은 옮기지 않았으니 자세한 내용은 출처에서 확인하세요.
독립 벤치마크 점수
독립 평가 기관이 아직 이 모델의 점수를 발표하지 않았습니다. 점수가 나오면 반영합니다.
함께 볼 모델
- GPT-2 (1.5B) OpenAI · 2019-11-05
- GPT-1 OpenAI · 2018-06-01
- Claude 2 Anthropic · 2023-07-11
- Claude Instant Anthropic · 2023-08-09