Arena · Review model AI
Claude Haiku 4.5
oleh Anthropic
Model tercepat Anthropic: sekitar 90% kemampuan coding Sonnet 4.5 seharga $1/$5 per 1M tokens, context 200K.
$5/1M out
Satu tarif: $1/1M input, $5/1M output; pembacaan prompt cache $0.10/1M (penulisan 5m $1.25/1M) dan Batch API memangkas 50% ($0.50/$2.50); tanpa biaya tambahan long-context (maksimum 200K).
Anthropic
200K tokens
$1/1M in
$5/1M out
text, vision (input); text output
Tidak
Apa itu Claude Haiku 4.5?
Model Claude kecil yang berfokus pada kecepatan, dirilis 15 Oktober 2025. Mencetak 73.3% di SWE-bench Verified, kira-kira 90% performa coding agentik Sonnet 4.5 dengan sepertiga biayanya. Mendukung input vision dan extended thinking, dengan context window 200K dan output maksimum 64K.
Kelebihan & kekurangan Claude Haiku 4.5
Kelebihan
- 73.3% di SWE-bench Verified, sekitar 90% kemampuan coding agentik Sonnet 4.5 dengan sepertiga harganya
- Cepat: lebih dari 2x kecepatan Sonnet 4 menurut Anthropic, dengan pelanggan awal melaporkan 4-5x lebih cepat dari Sonnet 4.5; sekitar 92-110 output tok/s menurut pengukuran Artificial Analysis
- Developer melaporkan penyuntingan kode yang presisi dan terlokalisasi tanpa menyentuh kode yang tidak relevan, lebih baik dari kelas GPT-5 mini dalam pengujian awal
- Mendukung input vision sekaligus extended thinking, langka di tingkat harga ini saat peluncuran
- Sangat cocok sebagai model pekerja dalam setup multi-agen (Sonnet/Opus merencanakan, sub-agen Haiku paralel mengeksekusi)
- Pembacaan prompt cache $0.10/1M dan diskon Batch API 50% memangkas biaya efektif lebih jauh
Kekurangan
- Output $5/1M tergolong mahal untuk model kecil: tingkat Gemini Flash dan GPT mini memotongnya berkali lipat pada tugas yang berat di output
- Context 200K (vs 1M untuk saudaranya Sonnet 5/Opus) dan output maksimum 64K membatasi pekerjaan codebase besar dan output panjang
- Penalaran lintas domain biasa saja: pengguna melaporkan hasil lemah pada tugas pengetahuan bergaya GPQA, MedQA, MMMU
- Throughput sangat bervariasi di lapangan (dilaporkan 82-208 tok/s) dan kualitas menurun pada sesi agentik panjang 7-8+ menit
- Cutoff pengetahuan (andal hingga Feb 2025) sudah usang menurut standar pertengahan 2026
Vonis arena
Pilih Haiku 4.5 jika Anda berada di stack Anthropic dan butuh kualitas coding mendekati Sonnet dengan latensi rendah dan sepertiga harganya: ini lompatan masif dari Haiku 3.5 dan unggul sebagai model pekerja dalam pipeline multi-agen. Model ini masih menjadi model kecil terkini Anthropic per Juli 2026, sehingga menjadi tingkat murah default untuk produk berbasis Claude. Hindari untuk penalaran lintas domain yang dalam, codebase sangat besar (batas context 200K), atau perbandingan murni biaya per token, di mana tingkat Gemini Flash dan GPT mini kini lebih murah, dan naiklah ke Sonnet 5 saat kualitas lebih penting daripada kecepatan.
Jempol ke atas atau ke bawah
Jatuhkan vonis Anda
Apakah Anda akan merekomendasikan Claude Haiku 4.5, atau memperingatkan penonton agar menjauh?
Alternatif Claude Haiku 4.5 terbaik
Semua alternatifFlagship kelas Mythos dari Anthropic edisi Juni 2026: 80.3% di SWE-bench Pro, unggul 11 poin dari semua model frontier lainnya
Opus Anthropic edisi April 2026: 87.6% SWE-bench Verified, context 1M, vision resolusi tinggi, kini tertinggal dari Opus 4.8
Sonnet paling agentik dari Anthropic: kualitas mendekati Opus 4.8 untuk coding dan agen seharga $3/$15 dengan context 1M
Bandingkan Claude Haiku 4.5 head-to-head
Kata penonton
“The precise localized edits are the underrated feature. It fixes the line that needs fixing and leaves the rest alone. GPT mini class models keep rewriting half my file.”
“Haiku 4.5 gives me about 90% of Sonnet agentic coding at a third of the price, and it is fast enough that edit loops feel instant. My default for quick fixes now.”
Claude Haiku 4.5: pertanyaan yang sering diajukan
Berapa biaya Claude Haiku 4.5 per 1M token?
Claude Haiku 4.5 berbiaya $1/1M in per 1M token input dan $5/1M out per 1M token output. Satu tarif: $1/1M input, $5/1M output; pembacaan prompt cache $0.10/1M (penulisan 5m $1.25/1M) dan Batch API memangkas 50% ($0.50/$2.50); tanpa biaya tambahan long-context (maksimum 200K).