Een-op-een

Logo van Gemini 3.5 FlashvsLogo van Gemini 3 Pro

Gemini 3.5 Flash vs Gemini 3 Pro: welke AI-model wint in 2026?

Gemini 3.5 Flash ($9.00/1M out) en Gemini 3 Pro ($12/1M out (prompts ≤200K)) zijn twee van de meest gebruikte AI-modellen van 2026. Over 3 stemmen van de community leidt Gemini 3 Pro met 57% goedkeuring.

Verdict in het kort

Op Redeneren kies je Gemini 3 Pro: de arena geeft 4.5/5 tegenover 3.5/5 voor Gemini 3.5 Flash. Qua budget wint Gemini 3.5 Flash: die begint bij $9.00/1M out tegenover $12/1M out (prompts ≤200K) voor Gemini 3 Pro.

Vergelijking regel voor regel

Vanaf
$9.00/1M outBetaald tarief, vlak: $1.50/$9.00 per 1M; batch-API 50% korting ($0.75/$4.50), context caching $0.15/1M plus $1.00/1M per uur opslag, gratis versie beschikbaar
$12/1M out (prompts ≤200K)Standaardtarief: $2/$12 per 1M tokens voor prompts ≤200K, $4/$18 daarboven; batch met 50% korting. Uit dienst genomen op 9 maart 2026, opvolger Gemini 3.1 Pro behoudt identieke prijzen.
Aanbieder
Google
Google (DeepMind)
Context window
1M tokens (1,048,576 in / 65,536 out)
1M tokens (64K output)
Inputprijs
$1.50/1M in
$2/1M in (prompts ≤200K)
Outputprijs
$9.00/1M out
$12/1M out (prompts ≤200K)
Modaliteiten
text, vision, audio, video, PDF in; text out
text, image, audio, video in; text out
Open weights
Nee
Nee
Publieksscore
50%(0)
57%(3)
Arenascores (1-5)
Redeneren
3.5
4.5
Programmeren
4.0
4.5
Schrijven
3.0
3.5
Snelheid
5.0
3.5
Prijs-kwaliteit
4.5
4.0

Sterke en zwakke punten

Gemini 3.5 Flash

  • Verslaat Gemini 3.1 Pro op agentische benchmarks: 76.2% Terminal-Bench 2.1, 1656 Elo GDPval-AA (tegenover 1314 voor 3.1 Pro), 83.6% MCP Atlas
  • Artificial Analysis Intelligence Index van 50 op high thinking effort, plaats #10 van 170 gevolgde modellen
  • Zeer snelle generatie (~185 output-tokens/sec volgens Artificial Analysis); Google claimt 4x snellere output dan andere frontier-modellen
  • Context window van 1M tokens (1,048,576) met multimodale input: tekst, beeld, audio, video, PDF
  • 25% goedkoper dan Gemini 3.1 Pro ($1.50/$9 vs $2/$12) en presteert er tegelijk beter op productie-agentworkloads
  • Instelbaar thinking effort (minimal/low/medium/high) plus 50% batchkorting en context caching voor $0.15/1M
  • 3x prijsverhoging ten opzichte van Gemini 3 Flash ($0.50/$3.00) en 5-6x ten opzichte van 2.5 Flash; HN-devs zagen het als Google dat de prijstolerantie aftast
  • Overijverig en breedsprakig: devs melden dat het voltooiingscriteria negeert en verder aandikt dan de instructies (vergeleken met Claudes 'Sonnet 3.7-moment')
  • Betrouwbaarheidsklachten op de Flash-serving: developers melden frequente 503-fouten tijdens piekuren
  • Zwakker op langlopende agentische taken met willekeurige toolbeschikbaarheid, een terugkerend thema dat devs bij Google-modellen melden
  • Hoge time-to-first-token (~23s op high thinking effort volgens Artificial Analysis), slechte match voor latency-gevoelige chat

Gemini 3 Pro

  • Voerde bij lancering LMArena aan met een record van 1501 Elo en scoorde 91.9% op GPQA Diamond, state of the art bij release
  • ARC-AGI-2 op 31.1%, ruwweg 6x Gemini 2.5 Pro (4.9%) en destijds bijna het dubbele van GPT-5.1 (17.6%)
  • Multimodaal begrip van topklasse: 81% MMMU-Pro, 87.6% Video-MMMU, met een context window van 1M tokens
  • Sterk agentisch programmeren: 76.2% SWE-bench Verified, 54.2% Terminal-Bench 2.0, 1487 Elo op WebDev Arena
  • Onderbood concurrenten op prijs met $2/$12 per 1M tokens, onder de Claude Sonnet-klasse ($3/$15)
  • Instelbaar thinking_level (low/medium/high) laat developers redeneerdiepte afwegen tegen latency en kosten
  • Overmoedige hallucinaties: op AA-Omniscience gaf het in 88% van de gevallen een fout antwoord in plaats van te weigeren, tegenover 48% voor Claude Sonnet 4.5 (the-decoder)
  • Slijmgedrag breed gemeld door reviewers (Zvi Mowshowitz: 'vast intelligence with no spine'); vereist strakke system prompts
  • Betrouwbaarheidsproblemen met tool calling in agent-stacks: devs meldden tool-output die in de chatthread werd gedumpt en meer scaffolding dan bij modellen van OpenAI/Anthropic
  • Traag op high thinking level: time to first token gemeten rond 30-60s op AI Studio, ondanks ~130 tok/s outputsnelheid
  • Uit dienst: op 9 maart 2026 afgesloten op de Gemini API en AI Studio, waarbij gemini-3-pro-preview nu doorverwijst naar Gemini 3.1 Pro

Vel je verdict

Eén aanbeveling per tool per gladiator. Die verandert de publieksscore die iedereen ziet.

Gemini 3.5 Flash$9.00/1M out
50%publieksscore · 0
Gemini 3 Pro$12/1M out (prompts ≤200K)
57%publieksscore · 3

Het verdict van de arena over Gemini 3.5 Flash

Kies Gemini 3.5 Flash als je agentisch programmeren of multimodale high-volume-pipelines draait en bijna-Pro-kwaliteit wilt op 4x de snelheid: het verslaat Gemini 3.1 Pro daadwerkelijk op Terminal-Bench en GDPval en kost tegelijk 25% minder. Vermijd het als je de Flash-lijn als budgetlaag gebruikte, want het kost 3x zijn voorganger Gemini 3 Flash, die met $0.50/$3.00 de goedkope optie blijft. Sla het ook over voor latency-gevoelige chat op high thinking effort (~23s tot het eerste token) of strikte output zonder franje, waar de breedsprakigheid tegen je werkt.

Het verdict van de arena over Gemini 3 Pro

Een mijlpaal die Google eind 2025 weer bovenaan zette, met een enorme redeneersprong ten opzichte van Gemini 2.5 Pro en de beste multimodale scores van zijn generatie. Medio 2026 is er geen reden meer om het te kiezen: Google sloot het op 9 maart 2026 af op de API, en Gemini 3.1 Pro kost exact hetzelfde terwijl het de ARC-AGI-2-prestaties meer dan verdubbelt (77.1% vs 31.1%). Teams met legacy-deployments moeten migreren naar 3.1 Pro, waar het oude model-ID sowieso al naartoe wijst. Vermijd het voor hallucinatie-gevoelige workloads tenzij je grounding toevoegt, een zwakte die reviewers herhaaldelijk aankaartten.

Wat het publiek zegt

Over Gemini 3.5 Flash

Nog geen verdicten. Wees de eerste die het woord neemt.

Over Gemini 3 Pro

Rechter Gruwelijk

Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.

Kampioen van de Vibes

ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.

Glorius Maximus

1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.

Veelgestelde vragen

Is Gemini 3.5 Flash beter dan Gemini 3 Pro?

Het publiek kiest momenteel voor Gemini 3 Pro: 57% raadt het aan, tegenover 50% voor Gemini 3.5 Flash (3 stemmen). Op Redeneren scoort Gemini 3 Pro hoger (4.5/5 vs 3.5/5). De juiste keuze hangt af van je gebruiksdoel. De vergelijking op deze pagina zet prijzen, kernspecificaties en arenascores regel voor regel op een rij.

Wat is goedkoper, Gemini 3.5 Flash of Gemini 3 Pro?

Gemini 3.5 Flash is goedkoper: die begint bij $9.00/1M out, terwijl Gemini 3 Pro begint bij $12/1M out (prompts ≤200K).

Hoeveel kosten Gemini 3.5 Flash en Gemini 3 Pro per 1M tokens?

Gemini 3.5 Flash: $1.50/1M in per 1M input tokens, $9.00/1M out per 1M output tokens. Gemini 3 Pro: $2/1M in (prompts ≤200K) per 1M input tokens, $12/1M out (prompts ≤200K) per 1M output tokens.