Anthropic merilis Claude Haiku 5.5 pada 7 Oktober, model kecil pertama dari generasi Claude 5 — rilis Haiku sebelumnya masih bertahan di versi 4.5. Model baru ini langsung tersedia di Claude Platform pada hari yang sama, dan sekaligus diluncurkan di AWS, Google Cloud, dan Microsoft Azure; Claude Code juga mendapatkannya dalam rilis di hari yang sama.
Anthropic memosisikannya secara sempit: tugas batch dengan throughput tinggi, dan sebagai sub-agent yang dipanggil oleh model yang lebih besar. Harga menjadi sorotan utama peluncuran ini.
Dua tingkat harga, dibagi berdasarkan panjang prompt
Haiku 5.5 membagi harganya menjadi dua tingkat berdasarkan panjang satu prompt, dengan batas di 100.000 token:
| Per juta token | Haiku 5.5 (≤100 ribu) | Haiku 5.5 (>100 ribu) | Haiku 4.5 |
|---|---|---|---|
| Input | $0,10 | $0,50 | $1,00 |
| Output | $0,50 | $2,50 | $5,00 |
| Baca cache | $0,01 | $0,05 | $0,10 |
| Tulis cache | $0,125 | $0,625 | $1,25 |
Pada tingkat prompt pendek, setiap harga per token adalah sepersepuluh dari Haiku 4.5; pada tingkat prompt panjang, setengahnya. Klaim Anthropic sendiri adalah biaya operasional keseluruhan turun rata-rata sekitar 75%.
Harga input dan output di tingkat pendek ini sama persis dengan GPT-6 Luna milik OpenAI yang diluncurkan akhir September. Model kecil dari kedua perusahaan kini berada di garis harga yang sama.
Pada hari yang sama, Anthropic juga menurunkan harga baca cache Sonnet 5.5 dari $0,20 menjadi $0,10 per juta token, dan memberikan kredit API kepada pelanggan berbayar: $100 per bulan untuk Max 5x, $200 per bulan untuk Max 20x, dan hingga $500 per bulan gabungan untuk paket Team. Developer Simon Willison mencatat di blognya bahwa kredit yang tidak terpakai dalam satu bulan tidak dibawa ke bulan berikutnya.
Benchmark dan tingkat reasoning
Haiku 5.5 dilengkapi reasoning bawaan yang tidak bisa dimatikan, tetapi bisa diatur antara low, medium, high, xhigh, dan max, dengan medium sebagai default. Dalam hasil resmi Anthropic, model ini mencetak 72,4% pada subset offline OSWorld 2.1 untuk tes operasi komputer, 39,2% pada Terminal-Bench 4.0, dan pada Humanity's Last Exam, 45,9% tanpa tools serta 57,4% dengan tools.
Beberapa pelanggan awal membagikan angka internal mereka sendiri. Box mengatakan model baru ini mencetak skor 11 poin lebih tinggi dari Haiku 4.5, dengan latensi sekitar setengahnya:
"Claude Haiku 5.5 scored 11 points higher than Haiku 4.5 at about half the latency."
(Claude Haiku 5.5 mencetak skor 11 poin lebih tinggi dari Haiku 4.5, dengan latensi sekitar setengahnya.)
Asana melaporkan latensi turun lebih dari 30%, dan HubSpot mengatakan mendapat skor tertinggi yang pernah mereka lihat di rangkaian tes ini, yaitu 92,8%. Semua angka ini berasal dari pengujian internal pelanggan sendiri, dan soal tesnya tidak dipublikasikan.
Tingkat reasoning sangat memengaruhi biaya. Simon Willison mencoba prompt yang sama, "gambar pelikan mengendarai sepeda", pada tingkat terendah dan tertinggi: tingkat low menghabiskan sekitar $0,0009 dan 7 detik, sementara tingkat max menghabiskan sekitar $0,034 dan 5 menit 9 detik — perbedaan biaya lebih dari 30 kali lipat untuk satu kali jalan.
Hitung kasar: tokenizer menggerus sebagian penurunan harga
Ada variabel di luar tabel harga yang mudah terlewat. Simon Willison menunjukkan bahwa Haiku 5.5 beralih tokenizer, sehingga teks yang sama kini terpecah menjadi sekitar 1,25 kali lebih banyak token dibandingkan Haiku 4.5.
Dengan faktor ini, hitungan kasarnya: biaya input efektif di tingkat prompt pendek setara dengan $0,125 per juta token "lama", dibandingkan $1 milik Haiku 4.5 — masih sekitar penurunan 87%, tetap signifikan. Tingkat prompt panjang terlihat kurang menarik: $0,50 dikali 1,25 menjadi $0,625, sehingga penurunannya menyusut jadi sekitar 37%.
Jika ditambah reasoning yang aktif secara default, token output akan sedikit lebih banyak dibandingkan Haiku 4.5 tanpa reasoning, besarannya tergantung tingkat dan tugas. Bagi tim yang menjalankan tugas input pendek seperti benchmark, ekstraksi, atau routing, berpindah model hampir pasti langsung menghemat biaya; untuk kasus yang sering memasukkan dokumen panjang atau konteks panjang, sebaiknya coba hitung dulu dengan trafik sendiri sebelum beralih.
Dari sisi keamanan, Anthropic mengatakan batasan Haiku 5.5 untuk permintaan terkait keamanan siber berada di antara Haiku 4.5 dan Sonnet 5.5, sementara perlindungan untuk bidang biologi setara dengan seri Sonnet 5; penelitian terkait memerlukan pengajuan kualifikasi verifikasi secara terpisah.
Sumber: halaman produk Claude Haiku 5.5 dari Anthropic, blog Simon Willison, CocoLoop, SiliconANGLE; angka harga untuk kedua tingkat, harga cache, dan perbandingan dengan Haiku 4.5 diverifikasi dari halaman harga resmi Anthropic, dan penurunan harga baca cache Sonnet 5.5 mengikuti pengumuman resmi.