아레나 · AI 모델 리뷰

Gemini 3 Pro

제공: Google

Google의 2025년 11월 프런티어 모델: 1M 컨텍스트, LMArena 1500 Elo 최초 돌파, Gemini 3.1 Pro로 대체됨.

아레나 점수 4/557% 추천 · 투표 3건
추론4.5
코딩4.5
글쓰기3.5
속도3.5
가성비4.0
Gemini 3 Pro 방문멀티모달 분석(영상/오디오/이미지)장문 컨텍스트 추론에이전트 코딩수학 및 과학 추론
가격

$12/1M out (prompts ≤200K)

표준 요금제: 프롬프트 ≤200K는 1M 토큰당 $2/$12, 200K 초과는 $4/$18, 배치 50% 할인. 2026년 3월 9일 퇴역, 후속 Gemini 3.1 Pro가 동일 가격을 유지합니다.

제공사

Google (DeepMind)

컨텍스트 윈도우

1M tokens (64K output)

입력 가격

$2/1M in (prompts ≤200K)

출력 가격

$12/1M out (prompts ≤200K)

모달리티

text, image, audio, video in; text out

오픈 웨이트

없음

Gemini 3 Pro은(는) 어떤 툴인가?

2025년 11월 18일에 출시된 Google DeepMind의 프런티어 추론 모델입니다. LMArena에서 최초로 1500 Elo를 돌파했으며, 1M 토큰 컨텍스트 윈도우와 텍스트, 이미지, 오디오, 영상 네이티브 이해를 갖췄습니다. 2026년 3월 9일에 동일 가격의 Gemini 3.1 Pro에 자리를 내주고 퇴역했습니다.

Gemini 3 Pro의 장단점

장점

  • 출시 시점 LMArena 1위(기록적인 1501 Elo)와 GPQA Diamond 91.9%로 당시 최고 기록
  • ARC-AGI-2 31.1%로 당시 Gemini 2.5 Pro(4.9%)의 약 6배, GPT-5.1(17.6%)의 거의 두 배
  • 동급 최고의 멀티모달 이해: MMMU-Pro 81%, Video-MMMU 87.6%, 1M 토큰 컨텍스트 윈도우
  • 강력한 에이전트 코딩: SWE-bench Verified 76.2%, Terminal-Bench 2.0 54.2%, WebDev Arena 1487 Elo
  • 1M 토큰당 $2/$12로 경쟁사보다 저렴했으며, Claude Sonnet급 가격($3/$15)보다 낮았습니다
  • 조절 가능한 thinking_level(low/medium/high)로 추론 깊이와 지연 시간, 비용을 맞바꿀 수 있습니다

단점

  • 과신에 찬 환각: AA-Omniscience에서 답을 거절하는 대신 88%의 확률로 오답을 냈습니다, Claude Sonnet 4.5는 48%였습니다(the-decoder)
  • 아부 성향이 리뷰어들 사이에서 널리 지적되었습니다(Zvi Mowshowitz: '척추 없는 방대한 지능'). 엄격한 시스템 프롬프트가 필요합니다
  • 에이전트 스택에서 툴 호출 신뢰성 문제: 툴 출력이 챗 스레드에 그대로 쏟아지고, OpenAI/Anthropic 모델보다 스캐폴딩이 더 필요하다는 개발자 보고가 있습니다
  • high thinking 레벨에서 느립니다: 출력 속도는 약 130 tok/s인데도 AI Studio에서 첫 토큰까지 약 30-60초가 측정되었습니다
  • 퇴역: 2026년 3월 9일에 Gemini API와 AI Studio에서 종료되었으며, gemini-3-pro-preview는 이제 Gemini 3.1 Pro로 연결됩니다

아레나의 평결

2025년 말 Google을 다시 정상에 올려놓은 기념비적인 릴리스로, Gemini 2.5 Pro 대비 거대한 추론 도약과 세대 최고의 멀티모달 점수를 보였습니다. 그러나 2026년 중반 기준으로 선택할 이유가 없습니다: Google이 2026년 3월 9일에 API에서 종료했고, Gemini 3.1 Pro가 정확히 같은 가격에 ARC-AGI-2 성능을 두 배 이상(77.1% vs 31.1%)으로 끌어올렸습니다. 레거시 배포를 쓰는 팀은 3.1 Pro로 이전해야 하며, 어차피 기존 모델 ID도 이제 그쪽을 가리킵니다. 리뷰어들이 반복해서 지적한 약점인 만큼, 그라운딩 없이는 환각에 민감한 워크로드에 피하십시오.

엄지 위인가, 엄지 아래인가

평결을 내리세요

Gemini 3 Pro을(를) 추천하시겠습니까, 아니면 대중에게 경고하시겠습니까?

57%대중 점수 · 3

Gemini 3 Pro 대안 베스트

모든 대안 보기
1
Claude Haiku 4.5

Anthropic의 최고속 모델: Sonnet 4.5 코딩 실력의 약 90%를 1M 토큰당 $1/$5에, 200K 컨텍스트.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Anthropic의 2026년 6월 Mythos급 플래그십: SWE-bench Pro 80.3%, 다른 모든 프런티어 모델을 11점 차로 앞섬

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Anthropic의 2026년 4월 Opus: SWE-bench Verified 87.6%, 1M 컨텍스트, 고해상도 비전, 현재는 Opus 4.8에 뒤처짐

$25/1M out57%(3)
Visit

Gemini 3 Pro 1:1 비교

대중의 목소리

공포의 판관

Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.

바이브의 챔피언

ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.

글로리우스 막시무스

1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.

Gemini 3 Pro: 자주 묻는 질문

Gemini 3 Pro의 1M 토큰당 비용은 얼마인가요?

Gemini 3 Pro은(는) 입력 토큰 1M당 $2/1M in (prompts ≤200K), 출력 토큰 1M당 $12/1M out (prompts ≤200K)입니다. 표준 요금제: 프롬프트 ≤200K는 1M 토큰당 $2/$12, 200K 초과는 $4/$18, 배치 50% 할인. 2026년 3월 9일 퇴역, 후속 Gemini 3.1 Pro가 동일 가격을 유지합니다.