Đối đầu trực tiếp

Logo Gemini 3.5 FlashvsLogo Gemini 3 Pro

Gemini 3.5 Flash vs Gemini 3 Pro: mô hình AI nào thắng trong năm 2026?

Gemini 3.5 Flash ($9.00/1M out) và Gemini 3 Pro ($12/1M out (prompts ≤200K)) là hai trong số mô hình AI được dùng nhiều nhất năm 2026. Trên 3 phiếu của cộng đồng, Gemini 3 Pro dẫn đầu với 57% ủng hộ.

Phán quyết nhanh

Về Suy luận, hãy chọn Gemini 3 Pro: đấu trường chấm 4.5/5 so với 3.5/5 của Gemini 3.5 Flash. Về ngân sách, Gemini 3.5 Flash thắng: giá từ $9.00/1M out so với $12/1M out (prompts ≤200K) của Gemini 3 Pro.

So sánh từng dòng

Từ
$9.00/1M outBậc trả phí giá phẳng $1.50/$9.00 mỗi 1M; batch API giảm 50% ($0.75/$4.50), context caching $0.15/1M cộng $1.00/1M mỗi giờ lưu trữ, có gói miễn phí
$12/1M out (prompts ≤200K)Bậc chuẩn: $2/$12 mỗi 1M tokens cho prompt ≤200K, $4/$18 trên 200K; batch giảm 50%. Ngừng hoạt động ngày 9 tháng 3 năm 2026, model kế nhiệm Gemini 3.1 Pro giữ nguyên giá.
Nhà cung cấp
Google
Google (DeepMind)
Cửa sổ ngữ cảnh
1M tokens (1,048,576 in / 65,536 out)
1M tokens (64K output)
Giá input
$1.50/1M in
$2/1M in (prompts ≤200K)
Giá output
$9.00/1M out
$12/1M out (prompts ≤200K)
Phương thức
text, vision, audio, video, PDF in; text out
text, image, audio, video in; text out
Open weights
Không
Không
Điểm đám đông
50%(0)
57%(3)
Điểm đấu trường (1-5)
Suy luận
3.5
4.5
Lập trình
4.0
4.5
Viết lách
3.0
3.5
Tốc độ
5.0
3.5
Đáng tiền
4.5
4.0

Điểm mạnh và điểm yếu

Gemini 3.5 Flash

  • Thắng Gemini 3.1 Pro trên các benchmark agentic: 76.2% Terminal-Bench 2.1, 1656 Elo GDPval-AA (so với 1314 của 3.1 Pro), 83.6% MCP Atlas
  • Artificial Analysis Intelligence Index đạt 50 ở thinking effort cao, xếp hạng #10 trên 170 model được theo dõi
  • Sinh output rất nhanh (~185 output tokens/giây theo Artificial Analysis); Google tuyên bố output nhanh 4x các model đỉnh cao khác
  • Cửa sổ ngữ cảnh 1M tokens (1,048,576) với input đa phương thức: văn bản, hình ảnh, âm thanh, video, PDF
  • Rẻ hơn Gemini 3.1 Pro 25% ($1.50/$9 so với $2/$12) trong khi vượt trội trên các workload agent production
  • Thinking effort chỉnh được (minimal/low/medium/high) cùng batch giảm 50% và context caching $0.15/1M
  • Tăng giá 3x so với Gemini 3 Flash ($0.50/$3.00) và 5-6x so với 2.5 Flash; dev trên HN xem đây là cách Google thăm dò mức chịu giá
  • Quá hăng hái và dài dòng: dev báo cáo nó phớt lờ tiêu chí hoàn thành và thêm thắt vượt quá chỉ dẫn (được so với 'khoảnh khắc Sonnet 3.7' của Claude)
  • Phàn nàn về độ tin cậy trên hạ tầng Flash: dev báo cáo lỗi 503 thường xuyên vào giờ cao điểm
  • Yếu hơn trên các tác vụ agentic dài hơi với bộ công cụ tùy ý, một chủ đề lặp lại mà dev báo cáo với các model của Google
  • Thời gian tới token đầu tiên cao (~23s ở thinking effort cao theo Artificial Analysis), không hợp chat nhạy cảm độ trễ

Gemini 3 Pro

  • Đứng đầu LMArena lúc ra mắt với kỷ lục 1501 Elo và đạt 91.9% trên GPQA Diamond, SOTA lúc phát hành
  • ARC-AGI-2 đạt 31.1%, khoảng 6x Gemini 2.5 Pro (4.9%) và gần gấp đôi GPT-5.1 (17.6%) vào thời điểm đó
  • Hiểu đa phương thức thuộc hàng tốt nhất: 81% MMMU-Pro, 87.6% Video-MMMU, với cửa sổ ngữ cảnh 1M tokens
  • Lập trình agentic mạnh: 76.2% SWE-bench Verified, 54.2% Terminal-Bench 2.0, 1487 Elo trên WebDev Arena
  • Phá giá đối thủ ở mức $2/$12 mỗi 1M tokens, thấp hơn giá hạng Claude Sonnet ($3/$15)
  • thinking_level chỉnh được (low/medium/high) cho phép dev đánh đổi độ sâu suy luận lấy độ trễ và chi phí
  • Ảo giác quá tự tin: trên AA-Omniscience nó đưa câu trả lời sai 88% số lần thay vì từ chối, so với 48% của Claude Sonnet 4.5 (the-decoder)
  • Tính xu nịnh bị người đánh giá phản ánh rộng rãi (Zvi Mowshowitz: 'trí tuệ mênh mông nhưng không có xương sống'); cần system prompt chặt chẽ
  • Vấn đề độ tin cậy tool-calling trong các stack agent: dev báo cáo output của công cụ bị đổ thẳng vào luồng chat và cần nhiều scaffolding hơn model của OpenAI/Anthropic
  • Chậm ở thinking level cao: thời gian tới token đầu tiên đo được khoảng 30-60s trên AI Studio dù tốc độ output ~130 tok/s
  • Đã ngừng hoạt động: bị tắt trên Gemini API và AI Studio ngày 9 tháng 3 năm 2026, và gemini-3-pro-preview nay được trỏ sang Gemini 3.1 Pro

Đưa ra phán quyết của bạn

Mỗi đấu sĩ một đề xuất cho mỗi công cụ. Nó định hình lại điểm đám đông mà mọi người nhìn thấy.

Gemini 3.5 Flash$9.00/1M out
50%điểm đám đông · 0
Gemini 3 Pro$12/1M out (prompts ≤200K)
57%điểm đám đông · 3

Phán quyết của đấu trường về Gemini 3.5 Flash

Chọn Gemini 3.5 Flash nếu bạn chạy lập trình agentic hoặc pipeline đa phương thức khối lượng lớn và muốn chất lượng gần Pro với tốc độ 4x: nó thực sự thắng Gemini 3.1 Pro trên Terminal-Bench và GDPval trong khi rẻ hơn 25%. Tránh nó nếu bạn từng dùng dòng Flash như bậc giá rẻ, vì nó đắt gấp 3x model tiền nhiệm Gemini 3 Flash, vốn vẫn là lựa chọn rẻ ở mức $0.50/$3.00. Cũng bỏ qua nó cho chat nhạy cảm độ trễ ở thinking effort cao (~23s tới token đầu tiên) hoặc output nghiêm ngặt, không thêm thắt, nơi độ dài dòng của nó phản tác dụng.

Phán quyết của đấu trường về Gemini 3 Pro

Một bản phát hành cột mốc đưa Google trở lại đỉnh vào cuối 2025, với bước nhảy suy luận khổng lồ so với Gemini 2.5 Pro và điểm đa phương thức tốt nhất thế hệ của nó. Đến giữa 2026 không còn lý do gì để chọn nó: Google đã tắt nó trên API ngày 9 tháng 3 năm 2026, và Gemini 3.1 Pro giá y hệt trong khi hơn gấp đôi hiệu năng ARC-AGI-2 (77.1% so với 31.1%). Các đội còn chạy triển khai cũ nên di trú sang 3.1 Pro, đằng nào model ID cũ nay cũng trỏ về đó. Tránh nó cho các workload nhạy cảm với ảo giác trừ khi bạn bổ sung grounding, một điểm yếu được người đánh giá cảnh báo nhiều lần.

Đám đông nói gì

Về Gemini 3.5 Flash

Chưa có phán quyết nào. Hãy là người đầu tiên lên tiếng.

Về Gemini 3 Pro

Thẩm Phán Đáng Sợ

Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.

Nhà Vô Địch Cảm Hứng

ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.

Glorius Maximus

1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.

Câu hỏi thường gặp

Gemini 3.5 Flash có tốt hơn Gemini 3 Pro không?

Đám đông hiện đứng về phía Gemini 3 Pro: 57% khuyên dùng, so với 50% của Gemini 3.5 Flash (3 phiếu). Về Suy luận, Gemini 3 Pro được chấm cao hơn (4.5/5 vs 3.5/5). Lựa chọn đúng tùy vào nhu cầu của bạn. Bảng so sánh từng dòng trên trang này mổ xẻ giá, thông số chính và điểm đấu trường.

Gemini 3.5 Flash hay Gemini 3 Pro rẻ hơn?

Gemini 3.5 Flash rẻ hơn: giá từ $9.00/1M out, trong khi Gemini 3 Pro bắt đầu từ $12/1M out (prompts ≤200K).

Gemini 3.5 Flash và Gemini 3 Pro giá bao nhiêu cho mỗi 1M tokens?

Gemini 3.5 Flash: $1.50/1M in cho 1M input tokens, $9.00/1M out cho 1M output tokens. Gemini 3 Pro: $2/1M in (prompts ≤200K) cho 1M input tokens, $12/1M out (prompts ≤200K) cho 1M output tokens.