Đấu trường · Đánh giá mô hình AI
Gemini 3.5 Flash
bởi Google
Chủ lực bậc tốc độ của Google: thắng Gemini 3.1 Pro về lập trình agentic ở mức $1.50/$9, đắt gấp 3x so với 3 Flash
$9.00/1M out
Bậc trả phí giá phẳng $1.50/$9.00 mỗi 1M; batch API giảm 50% ($0.75/$4.50), context caching $0.15/1M cộng $1.00/1M mỗi giờ lưu trữ, có gói miễn phí
1M tokens (1,048,576 in / 65,536 out)
$1.50/1M in
$9.00/1M out
text, vision, audio, video, PDF in; text out
Không
Gemini 3.5 Flash là gì?
Model suy luận đa phương thức nhanh của Google, ra mắt ngày 19 tháng 5 năm 2026 tại Google I/O. Vượt Gemini 3.1 Pro trên các benchmark agentic và lập trình (Terminal-Bench 2.1 đạt 76.2%, GDPval-AA 1656 Elo) trong khi sinh output nhanh gấp khoảng 4x các model đỉnh cao khác. Cửa sổ ngữ cảnh 1M tokens với các mức thinking effort chỉnh được.
Ưu và nhược điểm của Gemini 3.5 Flash
Ưu điểm
- Thắng Gemini 3.1 Pro trên các benchmark agentic: 76.2% Terminal-Bench 2.1, 1656 Elo GDPval-AA (so với 1314 của 3.1 Pro), 83.6% MCP Atlas
- Artificial Analysis Intelligence Index đạt 50 ở thinking effort cao, xếp hạng #10 trên 170 model được theo dõi
- Sinh output rất nhanh (~185 output tokens/giây theo Artificial Analysis); Google tuyên bố output nhanh 4x các model đỉnh cao khác
- Cửa sổ ngữ cảnh 1M tokens (1,048,576) với input đa phương thức: văn bản, hình ảnh, âm thanh, video, PDF
- Rẻ hơn Gemini 3.1 Pro 25% ($1.50/$9 so với $2/$12) trong khi vượt trội trên các workload agent production
- Thinking effort chỉnh được (minimal/low/medium/high) cùng batch giảm 50% và context caching $0.15/1M
Nhược điểm
- Tăng giá 3x so với Gemini 3 Flash ($0.50/$3.00) và 5-6x so với 2.5 Flash; dev trên HN xem đây là cách Google thăm dò mức chịu giá
- Quá hăng hái và dài dòng: dev báo cáo nó phớt lờ tiêu chí hoàn thành và thêm thắt vượt quá chỉ dẫn (được so với 'khoảnh khắc Sonnet 3.7' của Claude)
- Phàn nàn về độ tin cậy trên hạ tầng Flash: dev báo cáo lỗi 503 thường xuyên vào giờ cao điểm
- Yếu hơn trên các tác vụ agentic dài hơi với bộ công cụ tùy ý, một chủ đề lặp lại mà dev báo cáo với các model của Google
- Thời gian tới token đầu tiên cao (~23s ở thinking effort cao theo Artificial Analysis), không hợp chat nhạy cảm độ trễ
Phán quyết của đấu trường
Chọn Gemini 3.5 Flash nếu bạn chạy lập trình agentic hoặc pipeline đa phương thức khối lượng lớn và muốn chất lượng gần Pro với tốc độ 4x: nó thực sự thắng Gemini 3.1 Pro trên Terminal-Bench và GDPval trong khi rẻ hơn 25%. Tránh nó nếu bạn từng dùng dòng Flash như bậc giá rẻ, vì nó đắt gấp 3x model tiền nhiệm Gemini 3 Flash, vốn vẫn là lựa chọn rẻ ở mức $0.50/$3.00. Cũng bỏ qua nó cho chat nhạy cảm độ trễ ở thinking effort cao (~23s tới token đầu tiên) hoặc output nghiêm ngặt, không thêm thắt, nơi độ dài dòng của nó phản tác dụng.
Ngón cái lên hay ngón cái xuống
Đưa ra phán quyết của bạn
Bạn sẽ khuyên dùng Gemini 3.5 Flash, hay cảnh báo đám đông tránh xa?
Những lựa chọn thay thế Gemini 3.5 Flash hàng đầu
Tất cả lựa chọn thay thếModel nhanh nhất của Anthropic: khoảng 90% năng lực lập trình của Sonnet 4.5 ở mức $1/$5 mỗi 1M tokens, ngữ cảnh 200K.
Chủ lực hạng Mythos tháng 6/2026 của Anthropic: 80.3% trên SWE-bench Pro, bỏ xa mọi model đỉnh cao khác 11 điểm
Opus tháng 4/2026 của Anthropic: 87.6% SWE-bench Verified, ngữ cảnh 1M, vision độ phân giải cao, nay xếp sau Opus 4.8
So sánh Gemini 3.5 Flash đối đầu trực tiếp
Gemini 3.5 Flash: câu hỏi thường gặp
Gemini 3.5 Flash giá bao nhiêu cho mỗi 1M tokens?
Gemini 3.5 Flash có giá $1.50/1M in cho 1M input tokens và $9.00/1M out cho 1M output tokens. Bậc trả phí giá phẳng $1.50/$9.00 mỗi 1M; batch API giảm 50% ($0.75/$4.50), context caching $0.15/1M cộng $1.00/1M mỗi giờ lưu trữ, có gói miễn phí