Head-to-head

Logo Claude Haiku 4.5vsLogo Gemini 3 Pro

Claude Haiku 4.5 vs Gemini 3 Pro: model AI mana yang menang di 2026?

Claude Haiku 4.5 ($5/1M out) dan Gemini 3 Pro ($12/1M out (prompts ≤200K)) adalah dua model AI yang paling banyak dipakai di 2026. Dari 5 suara komunitas, Claude Haiku 4.5 memimpin dengan persetujuan 67%.

Vonis singkat

Soal Penalaran, pilih Gemini 3 Pro: arena menilainya 4.5/5 berbanding 3/5 untuk Claude Haiku 4.5. Soal budget, Claude Haiku 4.5 menang: harganya mulai dari $5/1M out berbanding $12/1M out (prompts ≤200K) untuk Gemini 3 Pro.

Perbandingan baris demi baris

Mulai
$5/1M outSatu tarif: $1/1M input, $5/1M output; pembacaan prompt cache $0.10/1M (penulisan 5m $1.25/1M) dan Batch API memangkas 50% ($0.50/$2.50); tanpa biaya tambahan long-context (maksimum 200K).
$12/1M out (prompts ≤200K)Tarif standar: $2/$12 per 1M tokens untuk prompt ≤200K, $4/$18 di atas 200K; batch diskon 50%. Dipensiunkan 9 Maret 2026, penerusnya Gemini 3.1 Pro mempertahankan harga identik.
Penyedia
Anthropic
Google (DeepMind)
Context window
200K tokens
1M tokens (64K output)
Harga input
$1/1M in
$2/1M in (prompts ≤200K)
Harga output
$5/1M out
$12/1M out (prompts ≤200K)
Modalitas
text, vision (input); text output
text, image, audio, video in; text out
Open weights
Tidak
Tidak
Skor penonton
67%(2)
57%(3)
Penilaian arena (1-5)
Penalaran
3.0
4.5
Coding
3.5
4.5
Menulis
3.0
3.5
Kecepatan
4.5
3.5
Nilai
4.0
4.0

Kekuatan dan kelemahan

Claude Haiku 4.5

  • 73.3% di SWE-bench Verified, sekitar 90% kemampuan coding agentik Sonnet 4.5 dengan sepertiga harganya
  • Cepat: lebih dari 2x kecepatan Sonnet 4 menurut Anthropic, dengan pelanggan awal melaporkan 4-5x lebih cepat dari Sonnet 4.5; sekitar 92-110 output tok/s menurut pengukuran Artificial Analysis
  • Developer melaporkan penyuntingan kode yang presisi dan terlokalisasi tanpa menyentuh kode yang tidak relevan, lebih baik dari kelas GPT-5 mini dalam pengujian awal
  • Mendukung input vision sekaligus extended thinking, langka di tingkat harga ini saat peluncuran
  • Sangat cocok sebagai model pekerja dalam setup multi-agen (Sonnet/Opus merencanakan, sub-agen Haiku paralel mengeksekusi)
  • Pembacaan prompt cache $0.10/1M dan diskon Batch API 50% memangkas biaya efektif lebih jauh
  • Output $5/1M tergolong mahal untuk model kecil: tingkat Gemini Flash dan GPT mini memotongnya berkali lipat pada tugas yang berat di output
  • Context 200K (vs 1M untuk saudaranya Sonnet 5/Opus) dan output maksimum 64K membatasi pekerjaan codebase besar dan output panjang
  • Penalaran lintas domain biasa saja: pengguna melaporkan hasil lemah pada tugas pengetahuan bergaya GPQA, MedQA, MMMU
  • Throughput sangat bervariasi di lapangan (dilaporkan 82-208 tok/s) dan kualitas menurun pada sesi agentik panjang 7-8+ menit
  • Cutoff pengetahuan (andal hingga Feb 2025) sudah usang menurut standar pertengahan 2026

Gemini 3 Pro

  • Memuncaki LMArena saat peluncuran dengan rekor 1501 Elo dan mencetak 91.9% di GPQA Diamond, state of the art saat rilis
  • ARC-AGI-2 di 31.1%, kira-kira 6x Gemini 2.5 Pro (4.9%) dan hampir dua kali lipat GPT-5.1 (17.6%) pada masanya
  • Pemahaman multimodal terbaik di kelasnya: 81% MMMU-Pro, 87.6% Video-MMMU, dengan context window 1M token
  • Coding agentik kuat: 76.2% SWE-bench Verified, 54.2% Terminal-Bench 2.0, 1487 Elo di WebDev Arena
  • Memotong harga pesaing di $2/$12 per 1M tokens, di bawah harga kelas Claude Sonnet ($3/$15)
  • thinking_level yang bisa dikonfigurasi (low/medium/high) memungkinkan developer menukar kedalaman penalaran dengan latensi dan biaya
  • Halusinasi yang terlalu percaya diri: di AA-Omniscience ia memberi jawaban salah 88% dari waktu alih-alih menolak menjawab, vs 48% untuk Claude Sonnet 4.5 (the-decoder)
  • Sifat menjilat yang banyak dilaporkan reviewer (Zvi Mowshowitz: 'kecerdasan luas tanpa tulang punggung'); butuh system prompt yang ketat
  • Masalah keandalan tool-calling di stack agen: developer melaporkan output tool tumpah ke utas chat dan butuh lebih banyak scaffolding dibanding model OpenAI/Anthropic
  • Lambat pada thinking level tinggi: time to first token terukur sekitar 30-60s di AI Studio meski kecepatan output sekitar 130 tok/s
  • Sudah dipensiunkan: dimatikan di Gemini API dan AI Studio pada 9 Maret 2026, dengan gemini-3-pro-preview kini dialiaskan ke Gemini 3.1 Pro

Jatuhkan vonis Anda

Satu rekomendasi per tool per gladiator. Suara Anda mengubah skor penonton yang dilihat semua orang.

67%skor penonton · 2
Gemini 3 Pro$12/1M out (prompts ≤200K)
57%skor penonton · 3

Vonis arena atas Claude Haiku 4.5

Pilih Haiku 4.5 jika Anda berada di stack Anthropic dan butuh kualitas coding mendekati Sonnet dengan latensi rendah dan sepertiga harganya: ini lompatan masif dari Haiku 3.5 dan unggul sebagai model pekerja dalam pipeline multi-agen. Model ini masih menjadi model kecil terkini Anthropic per Juli 2026, sehingga menjadi tingkat murah default untuk produk berbasis Claude. Hindari untuk penalaran lintas domain yang dalam, codebase sangat besar (batas context 200K), atau perbandingan murni biaya per token, di mana tingkat Gemini Flash dan GPT mini kini lebih murah, dan naiklah ke Sonnet 5 saat kualitas lebih penting daripada kecepatan.

Vonis arena atas Gemini 3 Pro

Rilis bersejarah yang mengembalikan Google ke puncak pada akhir 2025, dengan lompatan penalaran besar dari Gemini 2.5 Pro dan skor multimodal terbaik di generasinya. Per pertengahan 2026 tidak ada alasan memilihnya: Google mematikannya di API pada 9 Maret 2026, dan Gemini 3.1 Pro berharga persis sama sambil melipatgandakan lebih dari dua kali performa ARC-AGI-2 (77.1% vs 31.1%). Tim dengan deployment legacy sebaiknya bermigrasi ke 3.1 Pro, yang toh kini menjadi tujuan alias ID model lamanya. Hindari untuk beban kerja yang sensitif halusinasi kecuali Anda menambahkan grounding, kelemahan yang berulang kali ditandai reviewer.

Kata penonton

Tentang Claude Haiku 4.5

Penjaga Repo

The precise localized edits are the underrated feature. It fixes the line that needs fixing and leaves the rest alone. GPT mini class models keep rewriting half my file.

Juara Vibes

Haiku 4.5 gives me about 90% of Sonnet agentic coding at a third of the price, and it is fast enough that edit loops feel instant. My default for quick fixes now.

Tentang Gemini 3 Pro

Hakim Bengis

Confidently wrong is its worst mode. On AA-Omniscience it gave a wrong answer 88% of the time instead of declining. Add the sycophancy and you need a tight system prompt to trust it.

Juara Vibes

ARC-AGI-2 at 31% was about 6x Gemini 2.5 Pro and nearly double GPT-5.1 at the time. For visual-heavy work (81 MMMU-Pro) nothing else came close.

Glorius Maximus

1501 Elo on LMArena at launch was deserved. Multimodal is where it kills, I feed it lecture videos and dense PDFs and it just gets it. 1M context helps.

Pertanyaan yang sering diajukan

Apakah Claude Haiku 4.5 lebih baik daripada Gemini 3 Pro?

Saat ini penonton berpihak pada Claude Haiku 4.5: 67% merekomendasikannya, berbanding 57% untuk Gemini 3 Pro (5 suara). Soal Penalaran, Gemini 3 Pro dinilai lebih tinggi (4.5/5 vs 3/5). Pilihan yang tepat tergantung kebutuhan Anda. Perbandingan baris demi baris di halaman ini mengupas harga, spesifikasi utama, dan penilaian arena.

Mana yang lebih murah, Claude Haiku 4.5 atau Gemini 3 Pro?

Claude Haiku 4.5 lebih murah: harganya mulai dari $5/1M out, sementara Gemini 3 Pro mulai dari $12/1M out (prompts ≤200K).

Berapa biaya Claude Haiku 4.5 dan Gemini 3 Pro per 1M token?

Claude Haiku 4.5: $1/1M in per 1M token input, $5/1M out per 1M token output. Gemini 3 Pro: $2/1M in (prompts ≤200K) per 1M token input, $12/1M out (prompts ≤200K) per 1M token output.