Een-op-een

Logo van Gemini 3 ProvsLogo van Claude Haiku 4.5

Gemini 3 Pro vs Claude Haiku 4.5: welke AI-model wint in 2026?

Gemini 3 Pro ($12/1M out (prompts ≤200K)) en Claude Haiku 4.5 ($5/1M out) zijn twee van de meest gebruikte AI-modellen van 2026. Over 5 stemmen van de community leidt Claude Haiku 4.5 met 67% goedkeuring.

Verdict in het kort

Op Redeneren kies je Gemini 3 Pro: de arena geeft 4.5/5 tegenover 3/5 voor Claude Haiku 4.5. Qua budget wint Claude Haiku 4.5: die begint bij $5/1M out tegenover $12/1M out (prompts ≤200K) voor Gemini 3 Pro.

Vergelijking regel voor regel

Vanaf
$12/1M out (prompts ≤200K)Standaardtarief: $2/$12 per 1M tokens voor prompts ≤200K, $4/$18 daarboven; batch met 50% korting. Uit dienst genomen op 9 maart 2026, opvolger Gemini 3.1 Pro behoudt identieke prijzen.
$5/1M outEén tarief: $1/1M input, $5/1M output; prompt cache reads $0.10/1M (5m writes $1.25/1M) en de Batch API haalt er 50% af ($0.50/$2.50); geen long-context-toeslag (200K max).
Aanbieder
Google (DeepMind)
Anthropic
Context window
1M tokens (64K output)
200K tokens
Inputprijs
$2/1M in (prompts ≤200K)
$1/1M in
Outputprijs
$12/1M out (prompts ≤200K)
$5/1M out
Modaliteiten
text, image, audio, video in; text out
text, vision (input); text output
Open weights
Nee
Nee
Publieksscore
57%(3)
67%(2)
Arenascores (1-5)
Redeneren
4.5
3.0
Programmeren
4.5
3.5
Schrijven
3.5
3.0
Snelheid
3.5
4.5
Prijs-kwaliteit
4.0
4.0

Sterke en zwakke punten

Gemini 3 Pro

  • Voerde bij lancering LMArena aan met een record van 1501 Elo en scoorde 91.9% op GPQA Diamond, state of the art bij release
  • ARC-AGI-2 op 31.1%, ruwweg 6x Gemini 2.5 Pro (4.9%) en destijds bijna het dubbele van GPT-5.1 (17.6%)
  • Multimodaal begrip van topklasse: 81% MMMU-Pro, 87.6% Video-MMMU, met een context window van 1M tokens
  • Sterk agentisch programmeren: 76.2% SWE-bench Verified, 54.2% Terminal-Bench 2.0, 1487 Elo op WebDev Arena
  • Onderbood concurrenten op prijs met $2/$12 per 1M tokens, onder de Claude Sonnet-klasse ($3/$15)
  • Instelbaar thinking_level (low/medium/high) laat developers redeneerdiepte afwegen tegen latency en kosten
  • Overmoedige hallucinaties: op AA-Omniscience gaf het in 88% van de gevallen een fout antwoord in plaats van te weigeren, tegenover 48% voor Claude Sonnet 4.5 (the-decoder)
  • Slijmgedrag breed gemeld door reviewers (Zvi Mowshowitz: 'vast intelligence with no spine'); vereist strakke system prompts
  • Betrouwbaarheidsproblemen met tool calling in agent-stacks: devs meldden tool-output die in de chatthread werd gedumpt en meer scaffolding dan bij modellen van OpenAI/Anthropic
  • Traag op high thinking level: time to first token gemeten rond 30-60s op AI Studio, ondanks ~130 tok/s outputsnelheid
  • Uit dienst: op 9 maart 2026 afgesloten op de Gemini API en AI Studio, waarbij gemini-3-pro-preview nu doorverwijst naar Gemini 3.1 Pro

Claude Haiku 4.5

  • 73.3% op SWE-bench Verified, ongeveer 90% van het agentisch programmeren van Sonnet 4.5 voor een derde van de prijs
  • Snel: meer dan 2x de snelheid van Sonnet 4 volgens Anthropic, met lanceringsklanten die 4-5x sneller dan Sonnet 4.5 melden; ~92-110 output tok/s gemeten door Artificial Analysis
  • Devs melden precieze, lokale codewijzigingen die irrelevante code met rust laten, beter dan de GPT-5 mini-klasse in vroege tests
  • Ondersteunt zowel vision-input als extended thinking, zeldzaam in deze prijsklasse bij lancering
  • Zeer geschikt als werkmodel in multi-agent-opstellingen (Sonnet/Opus plant, parallelle Haiku-subagents voeren uit)
  • Prompt cache reads voor $0.10/1M en 50% Batch API-korting drukken de effectieve kosten verder
  • $5/1M output is prijzig voor een klein model: de Gemini Flash- en GPT mini-klassen zijn meermaals goedkoper op output-zware taken
  • 200K context (tegenover 1M voor de Sonnet 5/Opus-broers) en 64K max output beperken werk aan grote codebases en lange output
  • Middelmatig redeneren over domeinen heen: gebruikers melden zwakke resultaten op kennistaken in de stijl van GPQA, MedQA en MMMU
  • Doorvoersnelheid varieert flink in de praktijk (82-208 tok/s gemeld) en de kwaliteit zakt bij lange agentsessies van 7-8+ minuten
  • De knowledge cutoff (betrouwbaar tot feb 2025) is gedateerd naar de maatstaven van medio 2026

Vel je verdict

Eén aanbeveling per tool per gladiator. Die verandert de publieksscore die iedereen ziet.

Gemini 3 Pro$12/1M out (prompts ≤200K)
57%publieksscore · 3
67%publieksscore · 2

Het verdict van de arena over Gemini 3 Pro

Een mijlpaal die Google eind 2025 weer bovenaan zette, met een enorme redeneersprong ten opzichte van Gemini 2.5 Pro en de beste multimodale scores van zijn generatie. Medio 2026 is er geen reden meer om het te kiezen: Google sloot het op 9 maart 2026 af op de API, en Gemini 3.1 Pro kost exact hetzelfde terwijl het de ARC-AGI-2-prestaties meer dan verdubbelt (77.1% vs 31.1%). Teams met legacy-deployments moeten migreren naar 3.1 Pro, waar het oude model-ID sowieso al naartoe wijst. Vermijd het voor hallucinatie-gevoelige workloads tenzij je grounding toevoegt, een zwakte die reviewers herhaaldelijk aankaartten.

Het verdict van de arena over Claude Haiku 4.5

Kies Haiku 4.5 als je op de Anthropic-stack zit en bijna-Sonnet-programmeerkwaliteit nodig hebt met lage latency voor een derde van de prijs: het is een enorme stap vooruit ten opzichte van Haiku 3.5 en blinkt uit als werkmodel in multi-agent-pipelines. Het is per juli 2026 nog steeds Anthropics huidige kleine model, dus de standaard goedkope laag voor producten op basis van Claude. Vermijd het voor diep redeneren over domeinen heen, zeer grote codebases (plafond van 200K context) of puur shoppen op prijs per token, waar de Gemini Flash- en GPT mini-klassen inmiddels goedkoper zijn, en stap op naar Sonnet 5 wanneer kwaliteit zwaarder weegt dan snelheid.

Wat het publiek zegt

Over Gemini 3 Pro

Rechter Gruwelijk

Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.

Kampioen van de Vibes

ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.

Glorius Maximus

1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.

Over Claude Haiku 4.5

Bewaker van de Repo

The precise localized edits are the underrated feature. It fixes the line that needs fixing and leaves the rest alone. GPT mini class models keep rewriting half my file.

Kampioen van de Vibes

Haiku 4.5 gives me about 90% of Sonnet agentic coding at a third of the price, and it is fast enough that edit loops feel instant. My default for quick fixes now.

Veelgestelde vragen

Is Gemini 3 Pro beter dan Claude Haiku 4.5?

Het publiek kiest momenteel voor Claude Haiku 4.5: 67% raadt het aan, tegenover 57% voor Gemini 3 Pro (5 stemmen). Op Redeneren scoort Gemini 3 Pro hoger (4.5/5 vs 3/5). De juiste keuze hangt af van je gebruiksdoel. De vergelijking op deze pagina zet prijzen, kernspecificaties en arenascores regel voor regel op een rij.

Wat is goedkoper, Gemini 3 Pro of Claude Haiku 4.5?

Claude Haiku 4.5 is goedkoper: die begint bij $5/1M out, terwijl Gemini 3 Pro begint bij $12/1M out (prompts ≤200K).

Hoeveel kosten Gemini 3 Pro en Claude Haiku 4.5 per 1M tokens?

Gemini 3 Pro: $2/1M in (prompts ≤200K) per 1M input tokens, $12/1M out (prompts ≤200K) per 1M output tokens. Claude Haiku 4.5: $1/1M in per 1M input tokens, $5/1M out per 1M output tokens.