Kecerdasan Buatan
Claude Haiku 5.5 Resmi Rilis, Ini Harga API dan Bedanya dengan Sonnet
Anthropic merilis Claude Haiku 5.5 pada 7 Oktober 2026 dengan harga mulai US$0,10 per 1 juta token, sekitar 75% lebih murah dari Haiku 4.5. Cek harga dalam Rupi

Anthropic resmi merilis Claude Haiku 5.5 pada 7 Oktober 2026. Ini adalah model paling kecil di keluarga Claude 5.5, dan Anthropic menyebutnya sebagai model kecil yang paling murah, paling cepat, sekaligus paling pintar yang pernah mereka buat. Rata-rata biaya menjalankannya disebut sekitar 75% lebih murah dibanding Haiku 4.5, dan unggahan pengumumannya di akun X Claude sudah ditonton lebih dari 4 juta kali dalam sehari.
Artikel ini akan menjelaskan apa saja yang baru di Haiku 5.5, berapa harga API-nya kalau dihitung ke Rupiah, kenapa batas 100 ribu token perlu diperhatikan, dan bagaimana perbedaannya dengan Sonnet 5.5 maupun pesaing terdekatnya, GPT-6 Luna. Di bagian akhir ada juga rangkuman reaksi pengguna di X dan Hacker News, plus contoh hitungan biaya buat developer dan pelaku usaha di Indonesia yang ingin memakai Claude untuk chatbot atau otomatisasi.
Apa yang baru di Claude Haiku 5.5
Haiku selama ini dikenal sebagai "adik" dari Sonnet dan Opus: lebih cepat dan lebih murah, tapi kemampuannya terbatas. Haiku 4.5 sendiri sudah berumur hampir setahun dan banyak dikritik karena harganya terlalu mahal untuk kemampuannya. Versi 5.5 mencoba memperbaiki dua hal itu sekaligus.
Perubahan utamanya bisa dirangkum seperti ini:
- Harga turun drastis. Untuk prompt sampai 100 ribu token, harganya US$0,10 per 1 juta token input dan US$0,50 per 1 juta token output. Haiku 4.5 sebelumnya dibanderol US$1 dan US$5.
- Konteks jauh lebih panjang. Jendela konteks naik dari 200 ribu menjadi 1 juta token, dan output maksimal naik dari 64 ribu menjadi 128 ribu token.
- Ada pengaturan effort. Ini adalah Haiku pertama yang punya tingkat "usaha berpikir" yang bisa diatur, dari
lowsampaimax, dengan bawaanmedium. Makin tinggi effort, makin pintar jawabannya, tapi makin banyak token yang terpakai. - Adaptive thinking aktif secara bawaan. Model menentukan sendiri kapan perlu berpikir lebih lama sebelum menjawab.
- Model tercepat Anthropic pada kecepatan standar. Anthropic mencatat Haiku 5.5 hanya kalah cepat dari Opus yang sedang memakai Fast Mode.
- Dukungan computer use dan browser use di SDK Python dan TypeScript, saat ini masih berstatus beta.
| Spek | Claude Haiku 4.5 | Claude Haiku 5.5 |
|---|---|---|
| Tanggal rilis | Oktober 2025 | 7 Oktober 2026 |
| Jendela konteks | 200 ribu token | 1 juta token |
| Output maksimal | 64 ribu token | 128 ribu token |
| Pengaturan effort | Tidak ada | Ada, bawaan medium |
| Batas pengetahuan | Lebih lama | Juni 2026 |
| ID model | claude-haiku-4-5 |
claude-haiku-5-5 |
Haiku 5.5 sudah bisa dipakai di Claude API, Amazon Bedrock (dengan ID anthropic.claude-haiku-5-5), Google Cloud, Microsoft Foundry, dan Claude Platform on AWS. Dokumentasi resmi juga menyebut model ini tidak akan dipensiunkan sebelum 7 Oktober 2027, jadi cukup aman untuk dijadikan pondasi aplikasi jangka menengah.
Catatan: Anthropic juga menerbitkan system prompt khusus Haiku 5.5 untuk claude.ai dan aplikasi Claude, yang menggambarkannya sebagai model tercepat untuk pertanyaan singkat. Beberapa laporan menyebut model ini ikut muncul di paket Free sampai Enterprise, tapi pengumuman resminya lebih fokus ke API.
Harga Claude Haiku 5.5 dalam Rupiah
Bagian harga inilah yang paling ramai dibahas. Anthropic memakai dua tingkat harga berdasarkan panjang prompt: sampai 100 ribu token dan di atas 100 ribu token. Tabel di bawah memakai kurs kasar Rp17.900 per dolar AS, mengikuti posisi rupiah pada 8 Oktober 2026 yang bergerak di kisaran Rp17.870 sampai Rp17.890.
| Per 1 juta token | Haiku 5.5 (prompt ≤100K) | Haiku 5.5 (prompt >100K) | Haiku 4.5 | Sonnet 5.5 |
|---|---|---|---|---|
| Input | US$0,10 (± Rp1.790) | US$0,50 (± Rp8.950) | US$1 (± Rp17.900) | US$2 (± Rp35.800) |
| Output | US$0,50 (± Rp8.950) | US$2,50 (± Rp44.750) | US$5 (± Rp89.500) | US$10 (± Rp179.000) |
| Cache read | US$0,01 (± Rp179) | US$0,05 (± Rp895) | US$0,10 | US$0,10 |
| Cache write 5 menit | US$0,125 (± Rp2.240) | US$0,625 (± Rp11.190) | US$1,25 | US$2,50 |
Beberapa hal lain yang perlu diketahui soal harga:
- Batch API diskon 50% untuk input dan output. Jadi pekerjaan yang tidak perlu jawaban instan, misalnya merangkum ribuan dokumen semalaman, bisa jauh lebih hemat.
- Harga dasarnya sama persis dengan GPT-6 Luna dari OpenAI, yaitu US$0,10/US$0,50. Bedanya, Luna baru naik harga di atas 272 ribu token, dan kenaikannya hanya menjadi US$0,20/US$0,75.
- Dibanding Opus 5.5 (US$4/US$20), harga input Haiku 5.5 kira-kira 1/40-nya.
Bersamaan dengan rilis ini, Anthropic juga memangkas harga cache read Sonnet 5.5 sebesar 50%, dari US$0,20 menjadi US$0,10 per 1 juta token. Karena cache read adalah porsi besar dari pemakaian token di pekerjaan agen yang panjang, Anthropic menghitung Sonnet 5.5 kini sekitar 20% lebih murah untuk sebagian besar pekerjaan agentic. Potongan ini berlaku otomatis.
Kabar lain yang disambut hangat adalah kredit API bulanan untuk pelanggan berbayar. Pelanggan Max 5x mendapat US$100 per bulan (sekitar Rp1,79 juta), Max 20x mendapat US$200 (sekitar Rp3,58 juta), dan Team mendapat hingga US$500 (sekitar Rp8,95 juta) yang dibagi bersama satu tim. Menurut syarat resmi yang dikutip AICoder, kredit ini bisa dipakai untuk Claude API, Managed Agents, dan Agent SDK, tapi tidak untuk Claude Code interaktif, tidak bisa diakumulasi ke bulan berikutnya, dan baru bisa diklaim setelah tujuh hari berlangganan.
Jebakan batas 100 ribu token dan tokenizer baru
Angka "90% lebih murah" memang benar, tapi hanya untuk prompt di bawah 100 ribu token. Ada dua hal yang membuat penghematan nyatanya bisa lebih kecil, dan keduanya sering terlewat kalau hanya membaca judul berita.
Pertama, tarif naik lima kali lipat di atas 100 ribu token. Kalau prompt melewati batas itu, seluruh prompt dihitung dengan tarif yang lebih tinggi, bukan hanya kelebihannya. Contoh paling ekstremnya kira-kira seperti ini:
- Prompt berisi tepat 100.000 token dikenai biaya input sekitar US$0,010, atau kira-kira Rp179.
- Prompt berisi 100.001 token langsung dikenai sekitar US$0,050, atau kira-kira Rp895.
- Hal yang sama berlaku untuk output: tarifnya melonjak dari US$0,50 menjadi US$2,50 per 1 juta token.
Kedua, tokenizer-nya baru dan lebih "boros". Dokumentasi migrasi Anthropic menyebut teks yang sama akan menghasilkan sekitar 30% lebih banyak token di Haiku 5.5 dibanding Haiku 4.5. Simon Willison yang mengujinya dengan alat penghitung token buatannya mendapati angka sekitar 1,25 kali. Artinya, prompt yang dulu 90 ribu token di Haiku 4.5 bisa menjadi sekitar 117 ribu token di Haiku 5.5 dan otomatis masuk ke tarif yang mahal.
Kalau dihitung untuk input saja, prompt 90 ribu token di Haiku 4.5 berbiaya sekitar US$0,090. Di Haiku 5.5, prompt yang sama menjadi sekitar 117 ribu token dengan tarif US$0,50, sehingga biayanya sekitar US$0,059. Masih lebih murah, tapi penghematannya hanya sekitar 35%, bukan 90%.
Tips: Sebelum memindahkan aplikasi ke Haiku 5.5, hitung ulang token prompt dengan endpoint penghitung token memakai
model: "claude-haiku-5-5". Teks berbahasa Indonesia umumnya memakan lebih banyak token dibanding teks Inggris dengan isi yang mirip, jadi angka dari tutorial berbahasa Inggris sebaiknya tidak langsung dipakai.
Anthropic sendiri berargumen batas 100 ribu token ini masuk akal karena sekitar 90% permintaan ke Haiku 4.5 memang berada di bawah angka itu. Angka rata-rata "75% lebih murah" pun sudah memperhitungkan efek tokenizer baru tersebut.
Performa: bedanya dengan Haiku 4.5, Sonnet 5.5, dan GPT-6 Luna
Lonjakan performanya memang besar, terutama di tugas yang dulu hampir mustahil untuk Haiku. Tabel berikut memakai angka yang dipublikasikan Anthropic sendiri, jadi tetap perlu dibaca sebagai klaim resmi, bukan hasil uji independen.
| Benchmark | Haiku 5.5 | Haiku 4.5 | GPT-6 Luna | Sonnet 5.5 |
|---|---|---|---|---|
| GDPval-AA v2.1 (kerja kantoran) | 1620 | 735 | 1437 | 1840 |
| OSWorld 2.1 (pakai komputer, offline) | 72,4% | 15,7% | 48,9% | 83,9% |
| Terminal-Bench 4.0 (coding agentic) | 39,2% | 0,0% | 16,4% | 70,6% |
| FrontierCode 1.1 Main | 46,4% | — | 42,4% | 52,1% |
| Humanity's Last Exam (tanpa alat) | 45,9% | 10,2% | — | 56,9% |
| Chartography (membaca grafik) | 46,4% | 6,4% | 29,1% | 61,6% |
Dari tabel itu, ada beberapa hal yang cukup jelas:
- Lompatan dari Haiku 4.5 sangat jauh. Di OSWorld, skornya naik dari 15,7% ke 72,4%. Di Terminal-Bench, Haiku 4.5 bahkan mencetak nol.
- Haiku 5.5 unggul dari GPT-6 Luna di hampir semua benchmark yang ditampilkan, padahal harga dasarnya sama.
- Sonnet 5.5 tetap lebih kuat, terutama untuk coding yang rumit. Selisih di Terminal-Bench, 39,2% lawan 70,6%, menunjukkan Haiku belum cocok jadi "otak utama" untuk pekerjaan coding panjang.
Penilaian pihak ketiga juga mulai keluar. Artificial Analysis memberi Haiku 5.5 skor 43 di Intelligence Index, naik 26 poin dari Haiku sebelumnya dalam waktu setahun. Cognition, pembuat Devin, melaporkan skor 58,4% di FrontierCode 1.1 saat Haiku 5.5 dipakai di platform mereka, lebih tinggi dari Sonnet 5 dengan biaya per tugas sekitar seperdelapannya.
Dari sisi kecepatan, data OpenRouter yang dikutip pengguna Hacker News menunjukkan sekitar 131 token per detik pada median, kira-kira dua kali throughput Luna. Pelanggan awal seperti Asana melaporkan latensi turun lebih dari 30%, dan Box menyebut skornya 11 poin lebih tinggi dari Haiku 4.5 dengan latensi sekitar setengahnya.
Kapan pakai Haiku 5.5, kapan pakai Sonnet 5.5
![]()
Baca juga Indosat Luncurkan Platform AI dengan 300 Model, Begini Skema Biayanya
Anthropic cukup terus terang soal posisi Haiku 5.5. Model ini dirancang untuk pekerjaan yang sempit, berulang, dan bervolume tinggi, bukan untuk menggantikan Sonnet atau Opus. Pola yang mereka dorong adalah memakai model besar sebagai "pemimpin", lalu Haiku sebagai subagent yang mengerjakan tugas-tugas kecil secara paralel.
Pekerjaan yang cocok untuk Haiku 5.5:
- Merangkum dan memadatkan dokumen, riwayat chat, atau log yang panjang.
- Klasifikasi dan routing, misalnya memilah tiket keluhan pelanggan ke divisi yang tepat.
- Mengambil data dari dokumen, seperti menarik angka pendapatan dari laporan keuangan.
- Customer service langsung dan asisten di dalam aplikasi yang butuh jawaban cepat.
- Subagent coding, misalnya mencari file atau membaca kode, sementara Opus atau Sonnet yang merancang solusinya.
Pekerjaan yang sebaiknya tetap di Sonnet 5.5 atau Opus 5.5:
- Coding agentic yang panjang dan rumit, seperti refactor besar atau review arsitektur.
- Desain antarmuka yang detail dari gambar atau mockup.
- Analisis yang butuh penalaran berlapis dan sangat sensitif terhadap kesalahan.
Contoh resmi dari Anthropic menunjukkan Opus 5.5 yang dibantu 10 subagent Haiku 5.5 bisa mencoba lebih banyak desain dalam waktu yang sama, dengan biaya sedikit lebih rendah dibanding Opus sendirian. Komunitas juga langsung menangkap ide ini. Salah satu unggahan populer di X mengingatkan bahwa Claude Code secara bawaan masih mengirim pencarian file ke Opus, padahal pekerjaan semacam itu bisa dialihkan ke Haiku yang jauh lebih murah.
Peringatan: Pengaman keamanan siber Haiku 5.5 lebih ketat dari Haiku 4.5. Model ini tetap mengizinkan banyak tugas defensif, tapi menolak penetration testing dan teknik lain yang lebih mungkin dipakai penyerang. Tim keamanan yang butuh akses lebih luas harus mendaftar ke Cyber Verification Program milik Anthropic.
Kata pengguna di X dan Hacker News
Reaksi awalnya cukup terbelah. Thread peluncuran di Hacker News tembus lebih dari 800 poin dan hampir 400 komentar, dan sebagian besar diskusinya berkisar di harga, kecepatan, dan apakah Haiku akhirnya layak dipakai lagi.
Yang memuji umumnya menyoroti hal-hal berikut:
- Akhirnya ada model murah dari Anthropic yang layak. Beberapa pengguna menyebut Haiku 4.5 terlalu mahal untuk kemampuannya, dan versi baru ini dianggap pantas menggantikan GPT-6 Luna di alur kerja mereka. Ada juga yang langsung bilang akan memakainya di produksi.
- Kredit API bulanan untuk Max dan Team dianggap sangat menarik karena langganan bisa dipakai untuk membangun fitur di luar Claude Code tanpa biaya tambahan.
- Hemat kuota langganan. Seorang pengguna asal Jepang di X bercerita bahwa ia sering mentok batas lima jam saat membuat game sendiri, tapi setelah beralih ke Haiku 5.5, pemakaian sekitar tiga jam hanya menghabiskan sekitar 2% kuota.
Yang mengkritik juga tidak sedikit:
- Batas 100 ribu token dianggap terlalu rendah. Salah satu komentar teratas di Hacker News menyebutnya "absurdly low" dan mudah terlewati kalau dipakai untuk agen. Pengguna lain di X menyindir bahwa Luna hanya naik dua kali lipat di atas 272 ribu token, sementara Haiku langsung lima kali lipat di atas 100 ribu.
- Token lebih boros. Ada yang menilai harga murah ini diimbangi tokenizer yang menghitung lebih banyak token. Berdasarkan data Artificial Analysis, seorang komentator mencatat Haiku 5.5 di effort maksimal memakai sekitar 162 ribu token output per tugas.
- Hasil di tugas tertentu masih mengecewakan. Seorang developer yang menguji konversi gambar ke HTML menyebut hasilnya kurang bagus, meskipun model itu sempat "sadar diri" dan mendelegasikan tugasnya ke Opus. Pengguna lain yang menguji gambar SVG mobil menilai Haiku menghasilkan gambar paling lemah di antara model Claude. Ada juga developer yang mengaku hasil awalnya buruk, bahkan terasa lebih lambat untuk tugas sederhana di kantornya.
Kesimpulan dari komunitas kira-kira begini: Haiku 5.5 sangat menarik untuk tugas cepat dan berulang yang muat di bawah 100 ribu token, tapi bukan pengganti Sonnet. Hasil terbaiknya muncul ketika dipasangkan dengan model yang lebih besar.
Buat developer dan pelaku usaha di Indonesia
Claude bisa diakses langsung dari Indonesia, baik lewat aplikasi maupun API, tanpa perlu VPN. Tagihan API dibayar dalam dolar AS memakai kartu kredit atau debit internasional, jadi nilai akhirnya bisa bergeser mengikuti kurs dan biaya dari bank masing-masing.
Supaya lebih kebayang, berikut contoh hitungan sederhana untuk chatbot layanan pelanggan sebuah toko online. Anggap ada 10.000 percakapan per bulan, masing-masing berisi sekitar 2.000 token input (riwayat chat plus instruksi) dan 300 token output, semuanya di bawah batas 100 ribu token.
Hasilnya kira-kira US$3,50 atau sekitar Rp62.650 per bulan. Kalau teks yang sama dijalankan di Haiku 4.5 (dengan jumlah token sekitar 30% lebih sedikit karena tokenizer lama), biayanya sekitar US$26,90 atau kira-kira Rp481.500. Ini hanya ilustrasi hitungan, karena jumlah token nyata sangat tergantung panjang percakapan dan bahasa yang dipakai.
Beberapa catatan praktis buat yang ingin mencoba:
- Ganti ID model menjadi
claude-haiku-5-5. Tidak ada alias atau akhiran tanggal. - Hapus parameter
temperature,top_p, dantop_kkalau sebelumnya dipakai, karena nilai selain bawaan sekarang menghasilkan error. - Jangan pakai prefill (mengakhiri
messagesdengan pesan assistant). Percakapan harus diakhiri pesan dari user. - Ganti
budget_tokensdengan adaptive thinking dan parameter effort. - Baca jawaban berdasarkan tipe blok, bukan blok pertama, karena respons bisa diawali blok thinking.
Contoh pemanggilan paling sederhana dengan SDK Python kira-kira seperti ini:
import anthropic
client = anthropic.Anthropic() # API key dibaca dari variabel ANTHROPIC_API_KEY
pesan = [{"role": "user", "content": "Ringkas keluhan pelanggan berikut jadi 3 poin singkat: ..."}]
# Cek dulu jumlah token, karena tokenizer Haiku 5.5 berbeda dari Haiku 4.5
hitung = client.messages.count_tokens(model="claude-haiku-5-5", messages=pesan)
print("Token input:", hitung.input_tokens)
resp = client.messages.create(model="claude-haiku-5-5", max_tokens=1024, messages=pesan)
# Ambil hanya blok bertipe teks, karena jawaban bisa diawali blok thinking
print("".join(b.text for b in resp.content if b.type == "text"))
Buat UMKM yang belum punya tim developer, Haiku 5.5 kemungkinan besar akan terasa lewat aplikasi pihak ketiga, seperti platform chatbot WhatsApp atau tools otomatisasi yang memakai Claude di belakang layar. Harga dasar yang turun drastis membuka peluang layanan semacam itu ikut menurunkan tarif atau memberi kuota lebih besar.
Tips: Buat startup lokal, Anthropic juga baru memperbarui program Claude for Startups, dengan setahun gratis Claude Team untuk hingga lima kursi dan kredit API US$1.000 bagi startup yang lolos seleksi. Dengan tarif dasar Haiku 5.5, kredit sebesar itu setara miliaran token input.
Checklist
- Hitung ulang token prompt dengan model
claude-haiku-5-5sebelum migrasi - Pastikan sebagian besar prompt tetap di bawah 100 ribu token
- Hapus
temperature,top_p,top_k, dan prefill dari kode lama - Coba effort
lowdanmediumdulu untuk tugas sederhana supaya hemat token - Pakai Batch API untuk pekerjaan yang tidak butuh jawaban instan
- Simpan Sonnet 5.5 atau Opus 5.5 untuk coding rumit dan analisis berat
- Klaim kredit API bulanan kalau berlangganan Max atau Team
Referensi
- Anthropic (2026). Introducing Claude Haiku 5.5
- Claude Platform Docs (2026). Claude Haiku 5.5 Overview
- Claude Platform Docs (2026). What's New in Claude Haiku 5.5
- Claude Platform Docs (2026). Claude Haiku 5.5 System Prompts
- The Verge (2026). Anthropic Says Its New Claude Haiku 5.5 Model Is Its Fastest to Date
- The Times of India (2026). Anthropic Launches Claude Haiku 5.5, Its Fastest and Cheapest AI Model Yet
- Simon Willison's Weblog (2026). Claude Haiku 5.5
- LLM Stats (2026). Claude Haiku 5.5: The First Credible Haiku Agent
- S5 Labs (2026). Claude Haiku 5.5: Pricing and Migration
- Developers Digest (2026). Claude Haiku 5.5: Pricing, Migration Changes, and When to Use It
- AICoder (2026). Anthropic Launches Claude Haiku 5.5
- Hacker News (2026). Diskusi "Claude Haiku 5.5"
- Artificial Analysis (2026). Claude Haiku 5.5 di Artificial Analysis Intelligence Index
- Cognition (2026). Claude Haiku 5.5 Now Available in Devin
- Kav News (2026). Claude Haiku 5.5 Pangkas Harga Sendiri dan Mendekati Model Besar
- CNN Indonesia (2026). Rupiah Dibuka Menguat ke Rp17.873 per Dolar AS Kamis Pagi
Pertanyaan Umum
Berapa harga Claude Haiku 5.5 dalam Rupiah?
Apa bedanya Claude Haiku 5.5 dengan Sonnet 5.5?
Apakah Claude Haiku 5.5 bisa dipakai gratis?
Kenapa disebut 90% lebih murah tapi rata-ratanya 75%?
Lebih bagus mana, Claude Haiku 5.5 atau GPT-6 Luna?
Apakah kode lama untuk Haiku 4.5 bisa langsung dipakai di Haiku 5.5?
Kesimpulan
Claude Haiku 5.5 adalah pembaruan yang sudah lama ditunggu dari Anthropic. Harga dasarnya turun sampai 90%, konteksnya naik ke 1 juta token, dan performanya melonjak jauh dari Haiku 4.5, bahkan unggul dari GPT-6 Luna di sebagian besar benchmark resmi. Ditambah potongan harga cache read Sonnet 5.5 dan kredit API bulanan untuk Max dan Team, ekosistem Claude kini jauh lebih ramah buat yang memperhitungkan biaya.
Meski begitu, Haiku 5.5 bukan pengganti Sonnet. Batas 100 ribu token dan tokenizer yang lebih boros bisa menggerus penghematan kalau tidak dihitung dengan cermat. Buat developer dan pelaku usaha di Indonesia, langkah paling aman adalah mencobanya dulu untuk tugas cepat seperti chatbot, ringkasan, atau klasifikasi, sambil memantau jumlah token dan tagihan dalam beberapa minggu pertama.
Komentar (0)
Belum ada komentar. Jadilah yang pertama berbagi pendapat!
Tinggalkan komentar