Arena ยท Review model AI
Gemini 3.5 Flash
oleh Google
Flagship kelas cepat Google: mengalahkan Gemini 3.1 Pro pada coding agentik seharga $1.50/$9, 3x lebih mahal dari 3 Flash
$9.00/1M out
Tarif berbayar flat $1.50/$9.00 per 1M; Batch API diskon 50% ($0.75/$4.50), context caching $0.15/1M plus penyimpanan $1.00/1M per jam, free tier tersedia
1M tokens (1,048,576 in / 65,536 out)
$1.50/1M in
$9.00/1M out
text, vision, audio, video, PDF in; text out
Tidak
Apa itu Gemini 3.5 Flash?
Model reasoning multimodal cepat dari Google, dirilis 19 Mei 2026 di Google I/O. Mengungguli Gemini 3.1 Pro pada benchmark agentik dan coding (Terminal-Bench 2.1 76.2%, GDPval-AA 1656 Elo) sambil menghasilkan output kira-kira 4x lebih cepat dari model frontier lainnya. Context window 1M token dengan level thinking effort yang bisa diatur.
Kelebihan & kekurangan Gemini 3.5 Flash
Kelebihan
- Mengalahkan Gemini 3.1 Pro pada benchmark agentik: 76.2% Terminal-Bench 2.1, 1656 Elo GDPval-AA (vs 1314 untuk 3.1 Pro), 83.6% MCP Atlas
- Artificial Analysis Intelligence Index 50 pada thinking effort tinggi, peringkat #10 dari 170 model yang dipantau
- Generasi sangat cepat (sekitar 185 output tokens/detik menurut Artificial Analysis); Google mengklaim output 4x lebih cepat dari model frontier lain
- Context window 1M token (1,048,576) dengan input multimodal: teks, gambar, audio, video, PDF
- 25% lebih murah dari Gemini 3.1 Pro ($1.50/$9 vs $2/$12) sambil mengunggulinya pada beban kerja agen produksi
- Thinking effort yang bisa diatur (minimal/low/medium/high) plus diskon batch 50% dan context caching $0.15/1M
Kekurangan
- Kenaikan harga 3x dibanding Gemini 3 Flash ($0.50/$3.00) dan 5-6x dibanding 2.5 Flash; developer HN melihatnya sebagai upaya Google menguji toleransi harga
- Terlalu bersemangat dan bertele-tele: developer melaporkan ia mengabaikan kriteria penyelesaian dan menambah-nambahi di luar instruksi (dibandingkan dengan 'momen Sonnet 3.7' milik Claude)
- Keluhan keandalan pada serving Flash: developer melaporkan error 503 yang sering muncul di jam sibuk
- Lebih lemah pada tugas agentik jangka panjang dengan ketersediaan tool yang sembarang, tema berulang yang dilaporkan developer soal model Google
- Time-to-first-token tinggi (sekitar 23s pada thinking effort tinggi menurut Artificial Analysis), tidak cocok untuk chat yang sensitif latensi
Vonis arena
Pilih Gemini 3.5 Flash jika Anda menjalankan coding agentik atau pipeline multimodal bervolume tinggi dan menginginkan kualitas mendekati Pro dengan kecepatan 4x: ia benar-benar mengalahkan Gemini 3.1 Pro di Terminal-Bench dan GDPval sambil berharga 25% lebih murah. Hindari jika Anda memakai lini Flash sebagai tingkat hemat, karena harganya 3x pendahulunya Gemini 3 Flash, yang tetap menjadi opsi murah seharga $0.50/$3.00. Lewati juga untuk chat yang sensitif latensi pada thinking effort tinggi (sekitar 23s hingga token pertama) atau output ketat tanpa hiasan, di mana sifatnya yang bertele-tele justru merugikan Anda.
Jempol ke atas atau ke bawah
Jatuhkan vonis Anda
Apakah Anda akan merekomendasikan Gemini 3.5 Flash, atau memperingatkan penonton agar menjauh?
Alternatif Gemini 3.5 Flash terbaik
Semua alternatifModel tercepat Anthropic: sekitar 90% kemampuan coding Sonnet 4.5 seharga $1/$5 per 1M tokens, context 200K.
Flagship kelas Mythos dari Anthropic edisi Juni 2026: 80.3% di SWE-bench Pro, unggul 11 poin dari semua model frontier lainnya
Opus Anthropic edisi April 2026: 87.6% SWE-bench Verified, context 1M, vision resolusi tinggi, kini tertinggal dari Opus 4.8
Bandingkan Gemini 3.5 Flash head-to-head
Gemini 3.5 Flash: pertanyaan yang sering diajukan
Berapa biaya Gemini 3.5 Flash per 1M token?
Gemini 3.5 Flash berbiaya $1.50/1M in per 1M token input dan $9.00/1M out per 1M token output. Tarif berbayar flat $1.50/$9.00 per 1M; Batch API diskon 50% ($0.75/$4.50), context caching $0.15/1M plus penyimpanan $1.00/1M per jam, free tier tersedia