Anthropic merilis Opus 5 pada 24 Juli 2026

Claude Opus 5untuk pekerjaan yang tahan uji

Sejak peluncuran, pengguna Felo PRO dapat mencoba Claude Opus 5 gratis selama 7 hari.

Anthropic Claude Opus 5 official illustration framed in Felo blue
Sumber visual: Anthropic; Felo hanya menambahkan bingkai tanpa mengubah elemen asli.

Kini di Felo Search

Ajukan pertanyaan yang lebih sulit. Dapatkan jawaban pencarian yang dapat dipertanggungjawabkan.

Claude Opus 5 kini tersedia di Felo Search untuk pertanyaan yang memerlukan penyelidikan lebih dalam, sintesis sumber yang lebih kuat, dan jawaban akhir yang diperiksa terhadap bukti.

Coba Opus 5 di Felo Search

01

Telusuri pertanyaan sebenarnya

Uraikan batasan di balik permintaan yang ambigu, bukan berhenti pada penafsiran pertama yang tampak masuk akal.

02

Timbang bukti yang saling bertentangan

Satukan sumber dan klaim yang bersaing dalam satu penyelidikan, lalu identifikasi bagian tempat bukti selaras maupun tidak.

03

Kembali dengan lebih sedikit hal yang belum tuntas

Gunakan jawaban sebagai awal yang siap untuk keputusan, sambil tetap memperlihatkan penalaran, catatan, dan pertanyaan terbuka.

Panduan cepat

Beralih ke Claude Opus 5 di Felo

Buka pemilih model, pilih Claude Opus 5, lalu mulai tugas di ruang kerja yang sama.

24 Jul

rilis 2026

Model Opus terbaru Anthropic

$5 / $25

input / output API

Per 1 juta token, harga dasar sama dengan Opus 4.8

~2,5x

kecepatan Fast mode

Tersedia pada 2x harga dasar di platform Anthropic

Verifikasi + revisi

Pekerjaan jangka panjang

Perencanaan, penggunaan alat, pemeriksaan, dan iterasi

Perbedaan Opus

Jangan berhenti pada hal pertama yang berhasil.

Anthropic menempatkan Opus 5 untuk pekerjaan yang membutuhkan penilaian berkelanjutan: kenali masalah dasarnya, validasi hasilnya, dan tinjau kembali bila bukti tidak cukup kuat.

01

Lacak masalah yang mendasari

Untuk bug sulit dan tugas ambigu, mulailah dari bukti, batasan, dan akar masalah sebenarnya, bukan tambalan permukaan.

02

Periksa pekerjaan sebelum serah terima

Gunakan model yang dapat memeriksa keluarannya sendiri, menguji asumsi, dan menangkap masalah sebelum orang lain menemukannya nanti.

03

Jaga alur antar revisi

Bawa kode, bahan sumber, hasil alat, dan batasan baru ke dalam satu tugas yang lebih panjang, tanpa mereduksi pekerjaan menjadi prompt terputus-putus.

Pemilihan model

Bandingkan biaya token dengan biaya ketika salah.

Harga di bawah adalah tarif API publik resmi, bukan harga langganan atau penggunaan Felo. Tarif ini memperjelas pertukaran tanpa berpura-pura bahwa uji latensi vendor yang tidak terkait dapat dibandingkan langsung.

Faktor keputusan
Claude Opus 5
GPT-5.6 Sol
Kimi K3
Claude Opus 4.8
Harga API / 1 juta token
$5 input / $25 output
$5 input / $0,50 cached / $30 output
$3 input / $0,30 cached / $15 output
$5 input / $25 output
Kecepatan dan kapasitas
Kecepatan standar, atau Fast mode sekitar 2,5x lebih cepat dengan 2x harga dasar.
OpenAI menyebut Sol Fast; jendela konteks 1,05M token.
Konteks 1.048.576 token; throughput berbeda menurut tingkat batas akun.
Tolok ukur Opus sebelumnya. Bandingkan ketersediaan dan latensi langsung dalam alur kerja Anda.
Paling cocok untuk
Pekerjaan jangka panjang berdampak besar yang perlu verifikasi dan iterasi cermat.
Pekerjaan profesional kompleks dengan respons flagship cepat dan jendela konteks sangat besar.
Coding jangka panjang dan kerja pengetahuan menyeluruh dengan harga token publik lebih rendah.
Alur kerja Opus yang ada ketika kesinambungan lebih penting daripada segera berpindah.
Pilih saat
Tugas harus selesai, diperiksa, dan dapat dipertanggungjawabkan, bukan sekadar dibuat draf.
Anda menginginkan tingkat flagship OpenAI dan profil kecepatan/konteksnya sesuai tugas.
Anda perlu konteks 1M token dan ingin mengendalikan biaya melalui caching serta effort reasoning.
Anda mengevaluasi migrasi terkontrol dari baseline generasi sebelumnya.

Harga API publik resmi diperiksa pada 25 Juli 2026. Biaya tugas total juga tergantung panjang output, input cached, pengaturan effort, panggilan alat, percobaan ulang, dan tinjauan manusia.

Grafik benchmark resmi

Yang ditunjukkan grafik biaya versus kinerja Anthropic

Grafik resmi ini memetakan kinerja model terhadap biaya evaluasi yang dilaporkan pada tingkat effort berbeda. Ini konteks berguna untuk keputusan biaya, tetapi merupakan hasil yang diterbitkan vendor, bukan pengujian independen Felo.

Ikhtisar kemampuan benchmark resmi Claude Opus 5 dari Anthropic yang membandingkan Opus 5, Fable 5, Opus 4.8, dan GPT-5.6 Sol pada coding, kerja pengetahuan, pencarian, penggunaan komputer, alur bisnis, kesehatan, dan biologi

Ikhtisar kemampuan resmi lintas keluarga benchmark

Matriks lintas tugas Anthropic membandingkan hasil yang dipublikasikan untuk Opus 5, Fable 5, Opus 4.8, dan GPT-5.6 Sol pada coding, kerja pengetahuan, pencarian, penggunaan komputer, alur bisnis, dan lainnya.

Grafik resmi Anthropic untuk coding agentic menurut tingkat effort yang membandingkan Opus 5, Fable 5, Opus 4.8, dan GPT-5.6 Sol berdasarkan biaya per tugas

Coding agentic menurut tingkat effort

Artificial Analysis Coding Agent Index: grafik resmi membandingkan skor dengan biaya per tugas yang dilaporkan di seluruh pengaturan effort yang tersedia.

Grafik resmi Anthropic untuk penggunaan komputer agentic menurut tingkat effort yang membandingkan Opus 5, Fable 5, Opus 4.8, dan GPT-5.6 Sol berdasarkan biaya per tugas

Penggunaan komputer agentic menurut tingkat effort

OSWorld 2.0: grafik resmi membandingkan kinerja penggunaan komputer dengan biaya per tugas yang dilaporkan di seluruh pengaturan effort.

Grafik resmi Anthropic untuk tugas pengetahuan dunia nyata menurut tingkat effort yang membandingkan Opus 5, Fable 5, Opus 4.8, dan GPT-5.6 Sol berdasarkan biaya benchmark

Tugas pengetahuan dunia nyata menurut tingkat effort

GDPval-AA v2: grafik resmi membandingkan skor Elo dengan biaya benchmark penuh yang dilaporkan di seluruh pengaturan effort.

Grafik resmi Anthropic untuk pencarian agentic DeepSearchQA menurut tingkat effort yang membandingkan Opus 5, Fable 5, dan Opus 4.8 berdasarkan biaya per tugas

Pencarian agentic menurut tingkat effort

DeepSearchQA: grafik resmi membandingkan tingkat kelulusan tugas pencarian dengan biaya per tugas yang dilaporkan di seluruh pengaturan effort yang tersedia.

Grafik dan label benchmark berasal dari pengumuman Claude Opus 5 Anthropic. Felo hanya menambahkan bingkai presentasi luar; isi grafik dipertahankan sebagaimana diterbitkan.

Titik awal yang lebih baik

Berikan Opus 5 pekerjaan yang layak mendapat putaran kedua.

Model ini bernilai ketika verifikasi mengubah hasil. Ini bukan prompt chat umum, melainkan pekerjaan beberapa langkah saat ketergantungan yang terlewat, klaim tanpa dukungan, atau edge case yang belum diuji akan memakan waktu kemudian.

Kode produksi dan QA

Selidiki regresi, reproduksi, periksa kode di sekitarnya, terapkan perbaikan terarah, lalu uji jalur yang sering luput dari patch cepat.

Analisis keuangan dan dokumen

Rekonsiliasi tabel, uji asumsi, bandingkan dokumen sumber, dan buat rekomendasi dengan bukti serta catatan tetap utuh.

Riset yang perlu diteliti ketat

Baca sumber yang bersaing, ungkap pertanyaan terbuka, timbang bukti, dan bedakan jawaban percaya diri dari jawaban yang benar-benar didukung.

Tugas agent jangka panjang

Gunakan alat, pertahankan batasan tugas, pulih dari hasil parsial, dan teruskan penugasan besar dengan titik pemeriksaan yang disengaja.

Coba tugas yang memiliki konsekuensi

01

Bawa konteks sebenarnya

Tambahkan kode, dokumen, persyaratan, dan bukti yang harus diperhitungkan oleh jawaban berguna.

02

Minta rencana verifikasi

Tentukan apa yang harus diperiksa sebelum pekerjaan dianggap selesai, bukan hanya apa yang harus dibuat.

03

Bandingkan artefak akhir

Gunakan tugas yang sama pada model-model terkemuka di Felo. Tinjau bukan hanya jawabannya, tetapi juga pengujian, catatan, dan pertimbangan di baliknya.

Pilih Claude Opus 5 saat tersedia di pemilih model langsung akun Anda.

Buka Felo LLM Playground

FAQ Claude Opus 5

Claude Opus 5 adalah model tingkat Opus dari Anthropic yang dirilis pada 24 Juli 2026. Anthropic memosisikannya untuk agent jangka panjang, rekayasa perangkat lunak kompleks, kerja pengetahuan profesional, dan tugas yang mendapat manfaat dari verifikasi serta iterasi cermat.

Gunakan model yang memeriksa pekerjaan.

Letakkan Claude Opus 5 di samping model terkemuka lain dalam Felo, lalu uji pada tugas saat jawaban pertama yang masuk akal belum cukup.

Coba Opus 5 di Felo

Mulai di Felo AI Search dan pilih model saat tersedia.