Đấu trường · Đánh giá mô hình AI

Gemini 3.5 Flash

bởi Google

Chủ lực bậc tốc độ của Google: thắng Gemini 3.1 Pro về lập trình agentic ở mức $1.50/$9, đắt gấp 3x so với 3 Flash

Điểm đấu trường 4/5
Suy luận3.5
Lập trình4.0
Viết lách3.0
Tốc độ5.0
Đáng tiền4.5
Truy cập Gemini 3.5 Flashagent lập trìnhquy trình agentic quy mô lớnphân tích đa phương thức (video, âm thanh, PDF)suy luận nhanh trên lưu lượng API khối lượng lớn
Giá

$9.00/1M out

Bậc trả phí giá phẳng $1.50/$9.00 mỗi 1M; batch API giảm 50% ($0.75/$4.50), context caching $0.15/1M cộng $1.00/1M mỗi giờ lưu trữ, có gói miễn phí

Nhà cung cấp

Google

Cửa sổ ngữ cảnh

1M tokens (1,048,576 in / 65,536 out)

Giá input

$1.50/1M in

Giá output

$9.00/1M out

Phương thức

text, vision, audio, video, PDF in; text out

Open weights

Không

Gemini 3.5 Flash là gì?

Model suy luận đa phương thức nhanh của Google, ra mắt ngày 19 tháng 5 năm 2026 tại Google I/O. Vượt Gemini 3.1 Pro trên các benchmark agentic và lập trình (Terminal-Bench 2.1 đạt 76.2%, GDPval-AA 1656 Elo) trong khi sinh output nhanh gấp khoảng 4x các model đỉnh cao khác. Cửa sổ ngữ cảnh 1M tokens với các mức thinking effort chỉnh được.

Ưu và nhược điểm của Gemini 3.5 Flash

Ưu điểm

  • Thắng Gemini 3.1 Pro trên các benchmark agentic: 76.2% Terminal-Bench 2.1, 1656 Elo GDPval-AA (so với 1314 của 3.1 Pro), 83.6% MCP Atlas
  • Artificial Analysis Intelligence Index đạt 50 ở thinking effort cao, xếp hạng #10 trên 170 model được theo dõi
  • Sinh output rất nhanh (~185 output tokens/giây theo Artificial Analysis); Google tuyên bố output nhanh 4x các model đỉnh cao khác
  • Cửa sổ ngữ cảnh 1M tokens (1,048,576) với input đa phương thức: văn bản, hình ảnh, âm thanh, video, PDF
  • Rẻ hơn Gemini 3.1 Pro 25% ($1.50/$9 so với $2/$12) trong khi vượt trội trên các workload agent production
  • Thinking effort chỉnh được (minimal/low/medium/high) cùng batch giảm 50% và context caching $0.15/1M

Nhược điểm

  • Tăng giá 3x so với Gemini 3 Flash ($0.50/$3.00) và 5-6x so với 2.5 Flash; dev trên HN xem đây là cách Google thăm dò mức chịu giá
  • Quá hăng hái và dài dòng: dev báo cáo nó phớt lờ tiêu chí hoàn thành và thêm thắt vượt quá chỉ dẫn (được so với 'khoảnh khắc Sonnet 3.7' của Claude)
  • Phàn nàn về độ tin cậy trên hạ tầng Flash: dev báo cáo lỗi 503 thường xuyên vào giờ cao điểm
  • Yếu hơn trên các tác vụ agentic dài hơi với bộ công cụ tùy ý, một chủ đề lặp lại mà dev báo cáo với các model của Google
  • Thời gian tới token đầu tiên cao (~23s ở thinking effort cao theo Artificial Analysis), không hợp chat nhạy cảm độ trễ

Phán quyết của đấu trường

Chọn Gemini 3.5 Flash nếu bạn chạy lập trình agentic hoặc pipeline đa phương thức khối lượng lớn và muốn chất lượng gần Pro với tốc độ 4x: nó thực sự thắng Gemini 3.1 Pro trên Terminal-Bench và GDPval trong khi rẻ hơn 25%. Tránh nó nếu bạn từng dùng dòng Flash như bậc giá rẻ, vì nó đắt gấp 3x model tiền nhiệm Gemini 3 Flash, vốn vẫn là lựa chọn rẻ ở mức $0.50/$3.00. Cũng bỏ qua nó cho chat nhạy cảm độ trễ ở thinking effort cao (~23s tới token đầu tiên) hoặc output nghiêm ngặt, không thêm thắt, nơi độ dài dòng của nó phản tác dụng.

Ngón cái lên hay ngón cái xuống

Đưa ra phán quyết của bạn

Bạn sẽ khuyên dùng Gemini 3.5 Flash, hay cảnh báo đám đông tránh xa?

50%điểm đám đông · 0

Những lựa chọn thay thế Gemini 3.5 Flash hàng đầu

Tất cả lựa chọn thay thế
1
Claude Haiku 4.5

Model nhanh nhất của Anthropic: khoảng 90% năng lực lập trình của Sonnet 4.5 ở mức $1/$5 mỗi 1M tokens, ngữ cảnh 200K.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Chủ lực hạng Mythos tháng 6/2026 của Anthropic: 80.3% trên SWE-bench Pro, bỏ xa mọi model đỉnh cao khác 11 điểm

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Opus tháng 4/2026 của Anthropic: 87.6% SWE-bench Verified, ngữ cảnh 1M, vision độ phân giải cao, nay xếp sau Opus 4.8

$25/1M out57%(3)
Visit

So sánh Gemini 3.5 Flash đối đầu trực tiếp

Gemini 3.5 Flash: câu hỏi thường gặp

Gemini 3.5 Flash giá bao nhiêu cho mỗi 1M tokens?

Gemini 3.5 Flash có giá $1.50/1M in cho 1M input tokens và $9.00/1M out cho 1M output tokens. Bậc trả phí giá phẳng $1.50/$9.00 mỗi 1M; batch API giảm 50% ($0.75/$4.50), context caching $0.15/1M cộng $1.00/1M mỗi giờ lưu trữ, có gói miễn phí