L'arena · recensione di modello IA

Gemini 3.5 Flash

di Google

Il flagship veloce di Google: batte Gemini 3.1 Pro sul coding agentico a $1.50/$9, 3x più caro di 3 Flash

Punteggio dell'arena 4/5
Ragionamento3.5
Coding4.0
Scrittura3.0
Velocità5.0
Rapporto qualità-prezzo4.5
Visita Gemini 3.5 Flashagenti di codingworkflow agentici su larga scalaanalisi multimodale (video, audio, PDF)ragionamento veloce su traffico API ad alto volume
Prezzo

$9.00/1M out

Tier a pagamento a tariffa piatta $1.50/$9.00 per 1M; batch API a metà prezzo ($0.75/$4.50), context caching a $0.15/1M più $1.00/1M all'ora di storage, free tier disponibile

Fornitore

Google

Finestra di contesto

1M tokens (1,048,576 in / 65,536 out)

Prezzo in input

$1.50/1M in

Prezzo in output

$9.00/1M out

Modalità

text, vision, audio, video, PDF in; text out

Open weights

No

Che cos'è Gemini 3.5 Flash?

Modello di ragionamento multimodale veloce di Google, uscito il 19 maggio 2026 al Google I/O. Supera Gemini 3.1 Pro sui benchmark agentici e di coding (Terminal-Bench 2.1 76.2%, GDPval-AA 1656 Elo) generando output circa 4x più in fretta degli altri modelli di frontiera. Finestra di contesto da 1M di tokens con livelli di thinking effort regolabili.

Gemini 3.5 Flash: pro e contro

Pro

  • Batte Gemini 3.1 Pro sui benchmark agentici: 76.2% su Terminal-Bench 2.1, 1656 Elo su GDPval-AA (contro 1314 del 3.1 Pro), 83.6% su MCP Atlas
  • Artificial Analysis Intelligence Index 50 a thinking effort alto, al 10° posto su 170 modelli tracciati
  • Generazione molto veloce (~185 output tokens/sec secondo Artificial Analysis); Google dichiara un output 4x più veloce degli altri modelli di frontiera
  • Finestra di contesto da 1M di tokens (1,048,576) con input multimodale: testo, immagini, audio, video, PDF
  • 25% più economico di Gemini 3.1 Pro ($1.50/$9 contro $2/$12) pur superandolo sui carichi agentici in produzione
  • Thinking effort regolabile (minimal/low/medium/high) più sconto batch del 50% e context caching a $0.15/1M

Contro

  • Prezzo triplicato rispetto a Gemini 3 Flash ($0.50/$3.00) e 5-6x rispetto a 2.5 Flash; su HN gli sviluppatori l'hanno letta come Google che testa la tolleranza ai prezzi
  • Iperattivo e prolisso: gli sviluppatori riportano che ignora i criteri di completamento e ricama oltre le istruzioni (paragonato al 'momento Sonnet 3.7' di Claude)
  • Lamentele di affidabilità sul serving Flash: gli sviluppatori riportano frequenti errori 503 nei periodi di picco
  • Più debole sui task agentici a lungo orizzonte con disponibilità arbitraria di tool, un tema ricorrente che gli sviluppatori segnalano con i modelli Google
  • Time-to-first-token elevato (~23s a thinking effort alto secondo Artificial Analysis), inadatto alla chat sensibile alla latenza

Il verdetto dell'arena

Scegli Gemini 3.5 Flash se usi coding agentico o pipeline multimodali ad alto volume e vuoi qualità quasi da Pro a 4x la velocità: batte davvero Gemini 3.1 Pro su Terminal-Bench e GDPval costando il 25% in meno. Evitalo se usavi la linea Flash come fascia economica, perché costa 3x il suo predecessore Gemini 3 Flash, che resta l'opzione low-cost a $0.50/$3.00. Lascialo perdere anche per la chat sensibile alla latenza a thinking effort alto (~23s al primo token) o per gli output rigidi senza fronzoli, dove la sua prolissità gioca contro di te.

Pollice su o pollice verso

Emetti il tuo verdetto

Consiglieresti Gemini 3.5 Flash, o metteresti in guardia la folla?

50%punteggio della folla · 0

Migliori alternative a Gemini 3.5 Flash

Tutte le alternative
1
Claude Haiku 4.5

Il modello più veloce di Anthropic: circa il 90% delle capacità di coding di Sonnet 4.5 a $1/$5 per 1M di tokens, contesto 200K.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Il flagship di classe Mythos di Anthropic di giugno 2026: 80.3% su SWE-bench Pro, 11 punti sopra ogni altro modello di frontiera

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

L'Opus di Anthropic di aprile 2026: 87.6% su SWE-bench Verified, contesto 1M, visione ad alta risoluzione, ormai dietro a Opus 4.8

$25/1M out57%(3)
Visit

Confronta Gemini 3.5 Flash testa a testa

Gemini 3.5 Flash: domande frequenti

Quanto costa Gemini 3.5 Flash per 1M di token?

Gemini 3.5 Flash costa $1.50/1M in per 1M di token in input e $9.00/1M out per 1M di token in output. Tier a pagamento a tariffa piatta $1.50/$9.00 per 1M; batch API a metà prezzo ($0.75/$4.50), context caching a $0.15/1M più $1.00/1M all'ora di storage, free tier disponibile