Die Arena · KI-Modell im Test

Gemini 3.5 Flash

von Google

Googles Flaggschiff der Tempo-Klasse: schlägt Gemini 3.1 Pro beim agentischen Coding für $1.50/$9, 3x teurer als 3 Flash

Arena-Score 4/5
Reasoning3.5
Coding4.0
Schreiben3.0
Tempo5.0
Preis-Leistung4.5
Gemini 3.5 Flash besuchenCoding-Agentsagentische Workflows im großen Maßstabmultimodale Analyse (Video, Audio, PDF)schnelles Reasoning bei API-Traffic mit hohem Volumen
Preis

$9.00/1M out

Bezahltarif pauschal $1.50/$9.00 pro 1M; Batch-API 50% günstiger ($0.75/$4.50), Context-Caching $0.15/1M plus $1.00/1M pro Stunde Speicherung, Gratis-Tarif verfügbar

Anbieter

Google

Kontextfenster

1M tokens (1,048,576 in / 65,536 out)

Input-Preis

$1.50/1M in

Output-Preis

$9.00/1M out

Modalitäten

text, vision, audio, video, PDF in; text out

Open Weights

Nein

Was ist Gemini 3.5 Flash?

Googles schnelles multimodales Reasoning-Modell, veröffentlicht am 19. Mai 2026 auf der Google I/O. Übertrifft Gemini 3.1 Pro auf agentischen und Coding-Benchmarks (Terminal-Bench 2.1 76.2%, GDPval-AA 1656 Elo) und generiert Output rund 4x schneller als andere Frontier-Modelle. 1M-Token-Kontextfenster mit einstellbaren Thinking-Effort-Stufen.

Gemini 3.5 Flash: Vor- und Nachteile

Vorteile

  • Schlägt Gemini 3.1 Pro auf agentischen Benchmarks: 76.2% Terminal-Bench 2.1, 1656 Elo GDPval-AA (gegenüber 1314 für 3.1 Pro), 83.6% MCP Atlas
  • Artificial Analysis Intelligence Index 50 bei hohem Thinking-Effort, Platz #10 von 170 erfassten Modellen
  • Sehr schnelle Generierung (~185 Output-Tokens/s laut Artificial Analysis); Google verspricht 4x schnelleren Output als andere Frontier-Modelle
  • 1M-Token-Kontextfenster (1,048,576) mit multimodaler Eingabe: Text, Bild, Audio, Video, PDF
  • 25% günstiger als Gemini 3.1 Pro ($1.50/$9 statt $2/$12) und trotzdem besser in produktiven Agent-Workloads
  • Einstellbarer Thinking-Effort (minimal/low/medium/high) plus 50% Batch-Rabatt und Context-Caching für $0.15/1M

Nachteile

  • 3x Preiserhöhung gegenüber Gemini 3 Flash ($0.50/$3.00) und 5-6x gegenüber 2.5 Flash; HN-Entwickler sahen darin Googles Test der Preisbereitschaft
  • Übereifrig und wortreich: Entwickler berichten, dass es Abschlusskriterien ignoriert und über die Anweisungen hinaus ausschmückt (verglichen mit Claudes 'Sonnet-3.7-Moment')
  • Zuverlässigkeitsbeschwerden beim Flash-Serving: Entwickler melden häufige 503-Fehler zu Stoßzeiten
  • Schwächer bei langlaufenden agentischen Aufgaben mit beliebiger Tool-Verfügbarkeit, ein wiederkehrendes Muster, das Entwickler bei Google-Modellen beobachten
  • Hohe Zeit bis zum ersten Token (~23s bei hohem Thinking-Effort laut Artificial Analysis), ungeeignet für latenzsensiblen Chat

Das Urteil der Arena

Greifen Sie zu Gemini 3.5 Flash, wenn Sie agentisches Coding oder multimodale Pipelines mit hohem Volumen betreiben und fast Pro-Qualität bei 4x Tempo wollen: Es schlägt Gemini 3.1 Pro tatsächlich auf Terminal-Bench und GDPval und kostet dabei 25% weniger. Meiden Sie es, wenn Sie die Flash-Reihe als Budget-Klasse genutzt haben, denn es kostet das 3-fache seines Vorgängers Gemini 3 Flash, der mit $0.50/$3.00 die günstige Option bleibt. Verzichten Sie ebenfalls darauf für latenzsensiblen Chat bei hohem Thinking-Effort (~23s bis zum ersten Token) oder für strikte Outputs ohne Ausschmückung, wo seine Wortfülle gegen Sie arbeitet.

Daumen hoch oder Daumen runter

Fällen Sie Ihr Urteil

Würden Sie Gemini 3.5 Flash empfehlen oder die Menge davor warnen?

50%Crowd-Score · 0

Top-Alternativen zu Gemini 3.5 Flash

Alle Alternativen
1
Claude Haiku 4.5

Anthropics schnellstes Modell: etwa 90% der Coding-Stärke von Sonnet 4.5 für $1/$5 pro 1M Tokens, 200K Kontext.

$5/1M out67%(2)
Visit
2
Claude Fable 5

Anthropics Mythos-Klasse-Flaggschiff vom Juni 2026: 80.3% auf SWE-bench Pro, 11 Punkte vor jedem anderen Frontier-Modell

$50/1M out63%(4)
Visit
3
Claude Opus 4.7

Anthropics Opus vom April 2026: 87.6% SWE-bench Verified, 1M Kontext, hochauflösende Vision, inzwischen hinter Opus 4.8

$25/1M out57%(3)
Visit

Gemini 3.5 Flash im direkten Vergleich

Gemini 3.5 Flash: häufige Fragen

Was kostet Gemini 3.5 Flash pro 1M Tokens?

Gemini 3.5 Flash kostet $1.50/1M in pro 1M Input-Tokens und $9.00/1M out pro 1M Output-Tokens. Bezahltarif pauschal $1.50/$9.00 pro 1M; Batch-API 50% günstiger ($0.75/$4.50), Context-Caching $0.15/1M plus $1.00/1M pro Stunde Speicherung, Gratis-Tarif verfügbar