Đấu trường · Đánh giá mô hình AI

Gemini 3 Pro

bởi Google

Model đỉnh cao tháng 11/2025 của Google: ngữ cảnh 1M, đầu tiên vượt 1500 Elo trên LMArena, đã bị Gemini 3.1 Pro thay thế.

Điểm đấu trường 4/557% khuyên dùng · 3 phiếu
Suy luận4.5
Lập trình4.5
Viết lách3.5
Tốc độ3.5
Đáng tiền4.0
Truy cập Gemini 3 Prophân tích đa phương thức (video/âm thanh/hình ảnh)suy luận ngữ cảnh dàilập trình agenticsuy luận toán và khoa học
Giá

$12/1M out (prompts ≤200K)

Bậc chuẩn: $2/$12 mỗi 1M tokens cho prompt ≤200K, $4/$18 trên 200K; batch giảm 50%. Ngừng hoạt động ngày 9 tháng 3 năm 2026, model kế nhiệm Gemini 3.1 Pro giữ nguyên giá.

Nhà cung cấp

Google (DeepMind)

Cửa sổ ngữ cảnh

1M tokens (64K output)

Giá input

$2/1M in (prompts ≤200K)

Giá output

$12/1M out (prompts ≤200K)

Phương thức

text, image, audio, video in; text out

Open weights

Không

Gemini 3 Pro là gì?

Model suy luận đỉnh cao từ Google DeepMind, ra mắt ngày 18 tháng 11 năm 2025. Là model đầu tiên phá mốc 1500 Elo trên LMArena, với cửa sổ ngữ cảnh 1M tokens và khả năng hiểu văn bản, hình ảnh, âm thanh, video nguyên bản. Ngừng hoạt động ngày 9 tháng 3 năm 2026, nhường chỗ cho Gemini 3.1 Pro ở cùng giá.

Ưu và nhược điểm của Gemini 3 Pro

Ưu điểm

  • Đứng đầu LMArena lúc ra mắt với kỷ lục 1501 Elo và đạt 91.9% trên GPQA Diamond, SOTA lúc phát hành
  • ARC-AGI-2 đạt 31.1%, khoảng 6x Gemini 2.5 Pro (4.9%) và gần gấp đôi GPT-5.1 (17.6%) vào thời điểm đó
  • Hiểu đa phương thức thuộc hàng tốt nhất: 81% MMMU-Pro, 87.6% Video-MMMU, với cửa sổ ngữ cảnh 1M tokens
  • Lập trình agentic mạnh: 76.2% SWE-bench Verified, 54.2% Terminal-Bench 2.0, 1487 Elo trên WebDev Arena
  • Phá giá đối thủ ở mức $2/$12 mỗi 1M tokens, thấp hơn giá hạng Claude Sonnet ($3/$15)
  • thinking_level chỉnh được (low/medium/high) cho phép dev đánh đổi độ sâu suy luận lấy độ trễ và chi phí

Nhược điểm

  • Ảo giác quá tự tin: trên AA-Omniscience nó đưa câu trả lời sai 88% số lần thay vì từ chối, so với 48% của Claude Sonnet 4.5 (the-decoder)
  • Tính xu nịnh bị người đánh giá phản ánh rộng rãi (Zvi Mowshowitz: 'trí tuệ mênh mông nhưng không có xương sống'); cần system prompt chặt chẽ
  • Vấn đề độ tin cậy tool-calling trong các stack agent: dev báo cáo output của công cụ bị đổ thẳng vào luồng chat và cần nhiều scaffolding hơn model của OpenAI/Anthropic
  • Chậm ở thinking level cao: thời gian tới token đầu tiên đo được khoảng 30-60s trên AI Studio dù tốc độ output ~130 tok/s
  • Đã ngừng hoạt động: bị tắt trên Gemini API và AI Studio ngày 9 tháng 3 năm 2026, và gemini-3-pro-preview nay được trỏ sang Gemini 3.1 Pro

Phán quyết của đấu trường

Một bản phát hành cột mốc đưa Google trở lại đỉnh vào cuối 2025, với bước nhảy suy luận khổng lồ so với Gemini 2.5 Pro và điểm đa phương thức tốt nhất thế hệ của nó. Đến giữa 2026 không còn lý do gì để chọn nó: Google đã tắt nó trên API ngày 9 tháng 3 năm 2026, và Gemini 3.1 Pro giá y hệt trong khi hơn gấp đôi hiệu năng ARC-AGI-2 (77.1% so với 31.1%). Các đội còn chạy triển khai cũ nên di trú sang 3.1 Pro, đằng nào model ID cũ nay cũng trỏ về đó. Tránh nó cho các workload nhạy cảm với ảo giác trừ khi bạn bổ sung grounding, một điểm yếu được người đánh giá cảnh báo nhiều lần.

Ngón cái lên hay ngón cái xuống

Đưa ra phán quyết của bạn

Bạn sẽ khuyên dùng Gemini 3 Pro, hay cảnh báo đám đông tránh xa?

57%điểm đám đông · 3

Những lựa chọn thay thế Gemini 3 Pro hàng đầu

Tất cả lựa chọn thay thế
1
Claude Haiku 4.5

Model nhanh nhất của Anthropic: khoảng 90% năng lực lập trình của Sonnet 4.5 ở mức $1/$5 mỗi 1M tokens, ngữ cảnh 200K.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Chủ lực hạng Mythos tháng 6/2026 của Anthropic: 80.3% trên SWE-bench Pro, bỏ xa mọi model đỉnh cao khác 11 điểm

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Opus tháng 4/2026 của Anthropic: 87.6% SWE-bench Verified, ngữ cảnh 1M, vision độ phân giải cao, nay xếp sau Opus 4.8

$25/1M out57%(3)
Visit

So sánh Gemini 3 Pro đối đầu trực tiếp

Đám đông nói gì

Thẩm Phán Đáng Sợ

Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.

Nhà Vô Địch Cảm Hứng

ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.

Glorius Maximus

1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.

Gemini 3 Pro: câu hỏi thường gặp

Gemini 3 Pro giá bao nhiêu cho mỗi 1M tokens?

Gemini 3 Pro có giá $2/1M in (prompts ≤200K) cho 1M input tokens và $12/1M out (prompts ≤200K) cho 1M output tokens. Bậc chuẩn: $2/$12 mỗi 1M tokens cho prompt ≤200K, $4/$18 trên 200K; batch giảm 50%. Ngừng hoạt động ngày 9 tháng 3 năm 2026, model kế nhiệm Gemini 3.1 Pro giữ nguyên giá.