Skip to main content

Claude Haiku 5.5 Kini Tersedia di Felo OpenAPI

· 9 menit dibaca
Felo Search Tips Buddy
Committed to answers at your fingertips

Model termurah dan tercepat dari Anthropic hadir di Felo OpenAPI pada hari peluncuran. $0,10/$0,50 per juta token, 1M konteks, pemikiran adaptif — satu API key.

Anthropic merilis Claude Haiku 5.5 pada 7 Oktober 2026. Anda dapat menggunakannya hari ini.

Felo OpenAPI menambahkan rute claude-haiku-5-5 pada hari peluncuran, dengan harga resmi Anthropic: $0,10 per juta token input dan $0,50 per juta token output untuk prompt hingga 100.000 token. Harga ini 90% lebih murah dibandingkan Haiku 4.5, sehingga model tercepat di keluarga Claude 5.5 juga menjadi yang paling hemat biaya.

Coba Claude Haiku 5.5 di Felo OpenAPI: https://openapi.felo.ai/models/anthropic/claude-haiku-5.5

Claude Haiku 5.5 on Felo OpenAPI: Anthropic's fastest Haiku route, 90% cheaper than Haiku 4.5

Mengapa rilis ini penting​

Setiap Haiku selalu murah. Ini Haiku pertama yang dapat menjalankan agent loop tanpa menjadi titik lemah.

Anthropic menyebut Haiku 5.5 sebagai model kecil termurah, tercepat, dan paling mumpuni yang pernah mereka rilis. Benchmark mendukung klaim tersebut. Bandingkan dengan model yang digantikannya:

Claude Haiku 4.5Claude Haiku 5.5
Input / output$1 / $5$0.10 / $0.50
Cache read$0.10$0.01
Context / max output200K / 64K tokens1M / 128K tokens
Effort control—5 tingkat, default medium
OSWorld 2.1 (penggunaan komputer)15,7%72,4%
Terminal-Bench 4.00,0%39,2%
GDPval-AA v2.17351620
Humanity's Last Exam (tanpa tools)10,2%45,9%

Harga per juta token, untuk prompt hingga 100.000 token. Angka benchmark sesuai laporan Anthropic.

Lompatan kemampuan lebih besar daripada penurunan harga. Pada OSWorld 2.1, benchmark penggunaan komputer, Haiku 5.5 mencetak 72,4% sedangkan Haiku 4.5 hanya 15,7%. Terminal-Bench 4.0 naik dari 0,0% ke 39,2%. Pekerjaan yang sebelumnya membutuhkan model kelas menengah dengan harga 20 kali lipat kini dapat berjalan di lini Haiku.

Penjelasan harga​

Haiku 5.5 berbeda dari keluarga Claude lainnya dalam satu hal penting: harga berdasarkan panjang prompt.

  • Prompt hingga 100.000 token: $0,10 input, $0,50 output, $0,01 cache read — per juta token.
  • Prompt di atas 100.000 token: $0,50 input, $2,50 output, $0,05 cache read.

Semua model Claude lain saat ini mengenakan satu tarif tetap untuk seluruh jendela konteks. Haiku 5.5 menjadi pengecualian, jadi perhitungan ulang token perlu dilakukan untuk anggaran Anda.

Pada sebagian besar beban kerja, batas ini tidak terlewati. Anthropic menyebut 90% permintaan Haiku 4.5 berada di bawah 100.000 token, sehingga mereka mendapat potongan penuh 90%. Karena Haiku 5.5 memakai tokenizer baru keluarga Claude — teks yang sama dihitung sekitar 30% lebih banyak token dibanding Haiku 4.5 — Anthropic memperkirakan rata-rata pengurangan biaya berjalan sekitar 75%, bukan 90% penuh.

Angka yang perlu digarisbawahi yaitu $0,01 cache read. Agent loop menghabiskan sebagian besar anggaran input untuk membaca ulang konteks yang sudah dikirim; dengan satu sen per juta token, menjaga percakapan panjang tetap aktif hampir tanpa biaya.

Claude Haiku 5.5 pricing: $0.10 per million input tokens up to a 100,000-token prompt, and a 90% drop from Haiku 4.5

Apa saja yang berubah​

Pemikiran adaptif, kini dengan pengatur effort. Haiku 5.5 menjadi Haiku pertama yang menerima parameter effort. Pemikiran menyesuaikan tugas secara default, dan lima tingkat effort — low, medium, high, xhigh, max, dengan medium sebagai default — memungkinkan Anda menukar biaya dan kecepatan dengan kualitas respons. Pada effort rendah, model melewati proses berpikir pada permintaan sederhana.

Konteks 1M-token, output maksimum 128K. Jendela konteks lima kali lipat dari Haiku 4.5 dan batas output dua kali lipat. Satu jendela menampung sekitar 555.000 kata, lebih dari sebagian besar basis kode, transkrip, atau kumpulan dokumen yang ingin Anda proses dalam satu panggilan.

Tokenizer baru. Haiku 5.5 menggunakan tokenizer yang sama dengan Claude 4.7 dan model setelahnya. Permintaan dan respons tetap sama bentuknya, namun jumlah penggunaan lebih tinggi untuk teks yang sama, sehingga batas max_tokens dan estimasi biaya yang disetel di Haiku 4.5 perlu diperbarui.

Penggunaan browser dan penolakan lebih tegas. Model mendukung toolset penggunaan browser selain penggunaan komputer, dan classifier keamanannya dapat menolak permintaan secara langsung — siapkan stop_reason bernilai "refusal" di klien Anda.

Lima perubahan besar sebelum migrasi​

Haiku 5.5 tidak bisa langsung menggantikan model ID pada kode yang berjalan di Haiku 4.5. Panduan migrasi Anthropic mencantumkan perubahan; berikut lima hal yang memutus permintaan lama.

  1. Anggaran pemikiran manual ditolak. thinking: {"type": "enabled", "budget_tokens": N} menghasilkan 400. Gunakan pemikiran adaptif dan atur kedalaman dengan effort. Teks pemikiran kini tidak muncul secara default, jadi atur thinking.display ke "summarized" jika ingin menampilkan secara streaming.
  2. Parameter sampling ditolak. Hilangkan temperature, top_p, dan top_k sepenuhnya. Nilai non-default apa pun menghasilkan 400 — termasuk top_p: 1.
  3. Assistant prefill ditolak. Akhiri messages dengan giliran user. Untuk output terstruktur, gunakan structured outputs atau classification tools dengan enum field, bukan trik prefill.
  4. Penggunaan komputer pindah ke toolset. Ganti computer_20250124 dengan computer_toolset_20260801 di Claude API dan Google Cloud.
  5. Thinking block terikat akun dan hanya bisa append. Thinking block hanya valid di akun yang membuatnya dan selama semua sebelumnya tidak berubah. Jaga percakapan tetap append-only saat mengirim kembali thinking block.

Satu perubahan lagi terjadi tanpa notifikasi: token pemikiran dihitung ke dalam max_tokens, dan respons dapat dimulai dengan thinking block sebelum teks apa pun. Pilih content block berdasarkan field type, bukan posisi, dan sisakan ruang pada max_tokens untuk proses berpikir.

Panduan migrasi lengkap tersedia di dokumentasi Anthropic.

Memanggil Haiku 5.5 di Felo OpenAPI​

Rute sudah aktif. Berikut integrasi lengkapnya.

curl https://openapi.felo.ai/api/v1/chat/completions \
-H "Authorization: Bearer $FELO_API_KEY" \
-H "Content-Type: application/json" \
-d '{
"model": "claude-haiku-5-5",
"messages": [
{"role": "user", "content": "Classify this support ticket and extract the order ID."}
]
}'

Felo OpenAPI menyediakan tiga surface kompatibel, sehingga Anda dapat tetap menggunakan klien yang sudah ada:

SurfaceMethodURL
Chat CompletionsPOSThttps://openapi.felo.ai/api/v1/chat/completions
ResponsesPOSThttps://openapi.felo.ai/api/v1/responses
Messages (Anthropic-compatible)POSThttps://openapi.felo.ai/api/v1/messages

Karena endpoint Messages kompatibel dengan Anthropic, klien bergaya Claude hanya perlu mengarahkan base URL ke https://openapi.felo.ai/api. SDK pihak ketiga juga berjalan sama — atur baseURL ke https://openapi.felo.ai/api/v1 dan gunakan kode Anda seperti biasa.

Tambahkan "stream": true untuk server-sent events. Rute ini mendukung reasoning, tool calling, output JSON, streaming, dan vision — sama seperti surface lain di katalog.

Jika Anda sudah berlangganan Felo Pro, akses sudah tersedia​

Felo Pro mencakup akses API ke model-model Felo OpenAPI. Jika Anda berlangganan, tidak perlu akun kedua untuk memanggil Haiku 5.5: buat API key, arahkan agent ke endpoint, dan kredit Felo Anda menanggung panggilan tersebut. Satu key berlaku di seluruh lini — Haiku 5.5, Sonnet 5.5, Opus 5.5, GPT-6, Grok 4.7, dan lainnya.

Dua hal yang perlu diperhatikan:

  • Kredit Felo Pro satu pool. Pencarian, agent riset, slide, gambar, dan panggilan API semuanya memakai saldo yang sama. Panggilan model dihitung per token, jadi penggunaan API intensif menghabiskan kredit lebih cepat daripada sekadar beberapa pencarian per hari.
  • API tools terpisah. Panggilan model tercakup dalam akses Pro Anda; penggunaan tools seperti Web Fetch, X Search, dan pembuatan PPT berjalan dengan kredit Felo API Platform.

Belum berlangganan Pro? Setiap akun Felo mendapat 200 kredit gratis per hari, cukup untuk menjalankan permintaan nyata ke Haiku 5.5 sebelum Anda memutuskan berlangganan.

Posisi Haiku 5.5​

Where Claude Haiku 5.5 fits: high-volume classification, extraction, and subagent work between Sonnet 5.5 and Opus 5.5

Haiku 5.5 menjadi rute pilihan saat pekerjaan sederhana namun volumenya besar.

  • Subagent dan kompaksi — Anthropic menyoroti ringkasan, kompaksi, dan pekerjaan subagent secara langsung. Jalankan Opus 5.5 atau Sonnet 5.5 untuk reasoning berat dan biarkan Haiku 5.5 menangani loop di sekitarnya dengan harga sepersepuluhnya.
  • Klasifikasi, routing, dan ekstraksi volume besar — biaya per token menentukan apakah fitur ini bisa dirilis. Dengan $0,10 per juta token input dan $0,50 per juta token output, biaya tambahan satu klasifikasi tidak lagi menjadi masalah anggaran.
  • Bot dukungan dan UX sensitif latensi — rute tercepat di lini produk, kini dengan pengatur effort untuk memangkas milidetik terakhir.
  • Pekerjaan dokumen panjang — jendela 1M dengan harga Haiku memungkinkan transkrip penuh, kumpulan kontrak, atau file log masuk dalam satu panggilan tanpa perlu retrieval tambahan.

Jika Anda butuh kemampuan reasoning paling tinggi, Opus 5.5 tetap menjadi andalan dan tersedia di Felo OpenAPI juga. Sonnet 5.5 masih menjadi titik keseimbangan untuk sebagian besar beban kerja produksi. Haiku 5.5 menjadi model yang Anda gunakan di mana anggaran sebelumnya tidak memungkinkan.

Coba sekarang​

Haiku 5.5 sudah aktif di Felo OpenAPI hari ini, dengan harga resmi Anthropic, di balik key yang sudah Anda miliki.

Mulai di Playground untuk menguji prompt tanpa menulis kode, lalu ambil API key dan arahkan agent ke endpoint — subagent, classifier, dan bot dukungan kini hanya satu model ID dari penghematan biaya 90%.

→ Coba Claude Haiku 5.5 di Felo OpenAPI

→ Buat API key Anda


Tulisan ini juga tersedia dalam English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, Español, বাংলা and Português.