Anthropic merilis Opus 5.5 pada 22 September 2026

Claude Opus 5.5lebih banyak kerja, lebih sedikit token

Model pertama dari keluarga Claude 5.5. Kemampuannya menyamai Claude Fable 5.1 di sebagian besar pekerjaan, biaya jalannya 40% lebih rendah dari Opus 5, dan outputnya lebih dari 30% lebih cepat.

22 Sep
Rilis 2026
Model pertama keluarga Claude 5.5
4 $ / 20 $
API input / output
Per juta token, turun dari 5 $ / 25 $ di Opus 5
medium
Effort bawaan
Satu tingkat di bawah Opus 5 yang dimulai dari high
1 Jt / 128 Rb
Konteks / output maksimum
Jendela sama dengan Opus 5, pengetahuan sampai Juni 2026

Kini di Felo Search

Serahkan seluruh berkas dokumen, baru bertanya.

Claude Opus 5.5 tersedia di Felo Search untuk pekerjaan dengan input panjang: mencocokkan angka antar berkas, melacak klaim sampai ke sumbernya, dan menghasilkan jawaban yang bisa Anda teruskan ke orang lain.

Coba Opus 5.5 di Felo Search

01

Menampung seluruh konteks

Jendela konteks 1 juta token dan pengetahuan sampai Juni 2026. Percakapan panjang, satu repositori penuh, atau sekumpulan dokumen tetap berada dalam satu tugas.

02

Memeriksa angkanya, bukan hanya kesimpulannya

Dalam uji internal Anthropic, 16 dari 18 laporan lolos ambang mutu. Satu angka atau kutipan yang dikarang saja sudah cukup membuat pekerjaan itu gagal.

03

Menyebut apa yang dikerjakan dan apa yang kurang

Anthropic merombak cara model berkomunikasi: informasi terpenting ada di depan, dan laporannya menyebut dengan jelas apa yang selesai, apa yang ditemukan, dan apa yang masih terbuka.

Panduan singkat

Beralih ke Claude Opus 5.5 di Felo

Claude Opus 5.5 muncul di pemilih model bersama model unggulan lain di akun Anda.

Buka pemilih model, pilih Claude Opus 5.5, lalu mulai tugas di ruang kerja yang sama.

Yang membedakan Opus 5.5

Penurunan biaya itu sendiri adalah nilai jualnya.

Anthropic menonjolkan efisiensi, bukan skor benchmark yang lebih tinggi: lebih sedikit token per tugas, harga per token lebih rendah, dan biaya 40% lebih rendah pada beban kerja umum. Inilah yang membuat pekerjaan agen berjam-jam jadi terjangkau.

01

Menyelesaikan pekerjaan raksasa

Anthropic melaporkan seorang penguji awal mengaudit dan memperbaiki basis kode 200.000 baris dalam kurang dari tiga jam, sedangkan Opus 5 butuh lebih dari 20 jam dan memakai 2,5 kali lebih banyak token.

02

Menangkap bug sebelum digabungkan

Deloitte melaporkan bahwa pada tingkat effort terendah pun Opus 5.5 menemukan 72% bug yang diketahui dalam tinjauan kode, dibanding 56% pada Opus 5 di high, dengan lebih sedikit alarm palsu.

03

Meninggalkan laporan yang bisa dipakai

Tulisannya lebih pendek dan lebih tertata. Box melaporkan jawaban 40% lebih ringkas tanpa kehilangan akurasi, dengan sepertiga token yang dipakai Opus 5.

Pemilihan model

Bandingkan biaya satu token dengan biaya bila salah.

Harga di bawah adalah tarif API publik resmi per juta token, bukan harga langganan atau pemakaian Felo. Baris effort sama pentingnya dengan baris harga: prompt yang sama bisa jauh berbeda biayanya tergantung dari mana tiap model memulai.

Faktor keputusan
Claude Opus 5.5
Claude Fable 5.1
Claude Opus 5
GPT-6 Astra
Harga API / juta token
4 $ input / 20 $ output
10 $ input / 50 $ output
5 $ input / 25 $ output
10 $ input / 50 $ output
Baca cache / juta token
0,20 $, 0,05 kali harga input
0,25 $, 0,025 kali harga input
0,50 $, faktor standar 0,1
Berbeda menurut penyedia dan tingkat cache
Effort bawaan
medium. Penalaran adaptif selalu aktif dan tidak bisa dimatikan.
high. Penalaran adaptif selalu aktif.
high. Penalaran bisa dimatikan sampai high.
Ditentukan pemanggil di tiap permintaan
Tempat model ini layak
Coding agen jangka panjang, tinjauan kode, dan pekerjaan pengetahuan dengan harga kelas menengah.
Penalaran tersulit dan sesi agen terpanjang, ketika Opus 5.5 belum cukup meski effort dinaikkan.
Basis Opus sebelumnya. Bandingkan ketersediaan dan latensi nyatanya di trafik Anda sendiri.
Kelas unggulan OpenAI, di puncak rentang harga.

Tarif API publik dan nilai bawaan diperiksa pada 23 September 2026 terhadap pengumuman Claude Opus 5.5 dari Anthropic, halaman model Claude Platform, dan halaman GPT-6 Astra dari OpenAI. Harga per token hanya satu bagian dari total biaya tugas. Klaim efisiensi Anthropic adalah penurunan biaya 40% pada beban kerja umum, yang menggabungkan harga per token lebih rendah dengan lebih sedikit token per tugas.

Hasil yang diterbitkan Anthropic

Di mana Opus 5.5 unggul, dan di mana tidak.

Anthropic menerbitkan angkanya sendiri bersanding dengan Fable 5.1, Opus 5, GPT-6 Astra, dan GPT-5.6 Sol. Dua dari empat grafik di bawah menunjukkan akurasi terhadap biaya per tugas, bukan akurasi semata, karena itulah perbandingan yang dilakukan Anthropic.

Tabel perbandingan Claude Opus 5.5 yang diterbitkan Anthropic terhadap Fable 5.1, Opus 5, GPT-6 Astra, dan GPT-5.6 Sol

Perbandingan lengkap yang diterbitkan

Coding agen, pekerjaan pengetahuan, alur kerja bisnis, penalaran lintas disiplin, riset ilmiah, penggunaan komputer, dan pembacaan grafik pada kelima model yang diukur.

Grafik coding agen Claude Opus 5.5 yang diterbitkan Anthropic

Coding agen

Terminal-Bench 4.0, FrontierCode v1.1, dan CursorBench 4.0, digambarkan sebagai akurasi terhadap biaya per tugas.

Grafik pekerjaan pengetahuan Claude Opus 5.5 yang diterbitkan Anthropic

Pekerjaan pengetahuan

GDPval-AA v2.1 pada 44 profesi, AutomationBench, dan WANDR, benchmark pengumpulan data dari Perplexity.

Grafik penggunaan komputer dan penalaran Claude Opus 5.5 yang diterbitkan Anthropic

Penggunaan komputer dan penalaran

OSWorld 2.0, Humanity's Last Exam, dan Chartography, yang terakhir mengukur ketepatan membaca nilai dari sebuah grafik.

Grafik akurasi terhadap biaya per tugas Claude Opus 5.5 yang diterbitkan Anthropic

Akurasi terhadap biaya per tugas

Tesis utama Anthropic bukan skor lebih tinggi berapa pun biayanya, melainkan skor yang sama atau lebih baik dengan sebagian kecil biaya per percobaan.

Angka terbitan vendor. Kecuali disebut lain, Anthropic menjalankan Opus 5.5 dengan penalaran adaptif pada max effort dan menilainya dengan pengaman produksi aktif. Ketika pengaman itu turun tangan, tugas keamanan siber diselesaikan Opus 4.8 dan tugas biologi oleh Opus 5, yang kemungkinan menurunkan angka Opus 5.5 yang diterbitkan pada benchmark tersebut. Angka GPT-6 Astra dan GPT-5.6 Sol adalah yang dilaporkan OpenAI. Selisih benchmark antar vendor adalah petunjuk lemah soal perbedaan nyata, seperti yang Anthropic sendiri katakan soal angka-angka ini.

Jika Anda sudah menjalankan Opus 5

Empat perubahan yang merusak kode yang ada.

Anthropic mencantumkan empat perubahan yang tidak kompatibel untuk integrasi yang sudah berjalan di Claude Opus 5, plus perubahan kelima yang mengubah bentuk respons tanpa membuat permintaan gagal. Perlu dibaca sebelum menukar ID model, karena tiga di antaranya mengembalikan galat 400 alih-alih menurun diam-diam.

01

Penalaran tidak bisa lagi dimatikan

Di Opus 5 penalaran bisa dimatikan pada high ke bawah. Di Opus 5.5 selalu aktif, dan baik penonaktifan maupun anggaran token manual mengembalikan galat 400. Effort jadi satu-satunya kendali, dan nilai bawaannya berubah dari high ke medium.

thinking: {"type": "disabled"} -> 400 invalid_request_error

02

Pemakaian alat secara paksa ditolak

tool_choice yang diatur ke "any" atau ke nama alat tertentu mengembalikan galat 400, termasuk di endpoint penghitungan token. Gunakan auto bersama pemakaian alat yang ketat atau output terstruktur, dan sebutkan di prompt kapan alat itu berlaku.

tool_choice: {"type": "tool", "name": "..."} -> 400 invalid_request_error

03

Blok penalaran terikat pada modelnya

Setiap blok penalaran mencatat model yang menghasilkannya. Opus 5.5 membaca blok dari Opus 5 dan model Opus, Sonnet, serta Haiku sebelumnya, tetapi tidak dari Fable atau Mythos. Jika router memindahkan percakapan ke model lain, giliran berikutnya berjalan tanpa penalaran sebelumnya.

Opus 5.5 -> Fable 5.1 / Mythos 5.1 mempertahankan penalaran; model lain membuangnya

04

Alat penggunaan komputer lama hilang

Di Claude API dan Google Cloud, alat computer_20251124 mengembalikan galat 400. Deklarasikan toolset computer_toolset_20260801, hapus header beta, dan sesuaikan loop agen untuk blok member tool_use. Di Amazon Bedrock alat lama masih berfungsi.

computer_20251124 -> computer_toolset_20260801

Effort kini satu-satunya kendali penalaran

Karena penalaran tidak bisa dimatikan, yang disetel adalah effort. Opus 5.5 mendukung kelima tingkat dan mulai dari medium, satu tingkat di bawah Opus 5. Anjuran Anthropic adalah mengulang penyapuan pada evaluasi Anda sendiri, bukan membawa setelan lama, dan menyiapkan max_tokens yang longgar di tingkat tinggi, sebab token penalaran dihitung ke batas itu meski teks penalarannya tidak dikembalikan.

Tingkat
Bawaan
Anjuran pemakaian dari Anthropic
low
Tidak
Tingkat paling hemat dengan sedikit penurunan kemampuan. Anthropic menyarankannya untuk tugas sederhana dan subagen.
medium
Ya
Nilai bawaan Opus 5.5. Menurut Anthropic, hasilnya menyamai atau melebihi Opus 5 pada high di evaluasi coding dan pekerjaan pengetahuan.
high
Tidak
Nilai bawaan sebagian besar model Claude lain. Penalaran kompleks dan masalah coding yang sulit.
xhigh
Tidak
Pekerjaan agen dan coding jangka panjang di atas 30 menit dengan anggaran token dalam jutaan.
max
Tidak
Penalaran terdalam yang tersedia tanpa batas pengeluaran token. Sisakan untuk pekerjaan yang kenaikan mutunya sudah Anda ukur.

Effort adalah sinyal perilaku, bukan anggaran token yang kaku: pada tingkat rendah model tetap berpikir untuk masalah yang benar-benar sulit, hanya lebih sedikit daripada di tingkat tinggi. Anthropic juga mencatat bahwa pada tingkat yang sama Opus 5.5 cenderung berpikir lebih banyak per giliran daripada Opus 5, terutama di xhigh dan max, jadi setelan yang dibawa dari Opus 5 akan menghasilkan giliran yang lebih panjang dan lebih mahal.

Tempat yang cocok

Pekerjaan yang terlalu panjang untuk diawasi.

Opus 5.5 layak dipakai ketika sebuah tugas berjalan berjam-jam, mencakup lebih banyak berkas daripada yang bisa dipegang satu orang, atau menghasilkan sesuatu yang harus diperiksa orang lain. Ini kasus yang digambarkan Anthropic dan penguji awalnya, bukan prompt obrolan biasa.

Migrasi dan audit seluruh repositori

Membawa perubahan menembus repositori besar sampai tesnya lulus, bukan berhenti di tambalan pertama yang terlihat masuk akal. Anthropic melaporkan migrasi 680.000 baris selesai dalam kurang dari sehari oleh seorang penguji.

Tinjauan kode yang menemukan bug sebenarnya

Column, penguji yang dikutip Anthropic, melaporkan menemukan bug dengan memeriksa dokumentasi eksternal untuk integrasi pihak ketiga yang beberapa commit sebelumnya dimodelkan secara keliru.

Analisis keuangan dan dokumen

Membangun model lalu ringkasan satu halaman, dengan catatan kaveatnya tetap utuh. Anthropic melaporkan analisis merger selesai dalam 63 menit dibanding 93 menit di Opus 5, dengan biaya separuh.

Tim agen berjalan lama

Model mendelegasikan ke subagen dan menyesuaikan tempo dengan anggaran waktu. Anjuran Anthropic adalah memberi arsitektur multiagen sinyal waktu berjalan agar memparalelkan alih-alih menyerialkan.

Uji dengan tugas yang berjalan lama

01

Bawa konteks yang sebenarnya

Sertakan repositori, dokumen, dan persyaratan yang harus diperhitungkan jawaban yang berguna. Jendela 1 juta token ada untuk ini.

02

Sebutkan syarat selesai

Katakan apa yang harus benar agar pekerjaan dianggap tuntas. Anjuran Anthropic untuk sesi tanpa pengawasan adalah menyimpan bagian-bagian tugas dalam daftar periksa yang diperbarui model.

03

Bandingkan hasil akhirnya

Jalankan tugas yang sama di Opus 5.5, Opus 5, dan Fable 5.1 di Felo. Bandingkan bukan hanya jawabannya, tetapi juga tes, kaveat, dan pemakaian token.

Pilih Claude Opus 5.5 begitu muncul di pemilih model akun Anda.

Coba Opus 5.5 di Felo

Pertanyaan umum tentang Claude Opus 5.5

Claude Opus 5.5 adalah model Anthropic untuk coding agen jangka panjang dan pekerjaan pengetahuan, dirilis 22 September 2026 sebagai model pertama keluarga Claude 5.5. Menurut Anthropic kemampuannya menyamai Claude Fable 5.1 di sebagian besar pekerjaan dengan biaya jalan 40% lebih rendah dari Claude Opus 5.

Jalankan tugas panjang dengan harga lebih rendah.

Letakkan Claude Opus 5.5 bersanding dengan model unggulan lain di Felo, lalu uji pada pekerjaan yang Anda tunda karena butuh berjam-jam.

Coba Opus 5.5 di Felo

Mulai dari Felo AI Search dan pilih modelnya di tempat yang tersedia.