Anthropic melancarkan Opus 5 pada 24 Julai 2026

Claude Opus 5untuk kerja yang tahan diuji

Sejak pelancaran, pengguna Felo PRO boleh mencuba Claude Opus 5 secara percuma selama 7 hari.

Anthropic Claude Opus 5 official illustration framed in Felo blue
Sumber visual: Anthropic; Felo hanya menambah bingkai tanpa mengubah elemen asal.

Kini dalam Felo Search

Tanya soalan yang lebih sukar. Dapatkan jawapan carian yang tahan diuji.

Claude Opus 5 kini tersedia dalam Felo Search untuk soalan yang memerlukan penyiasatan lebih mendalam, sintesis sumber yang lebih kukuh dan jawapan akhir yang diperiksa berbanding bukti.

Cuba Opus 5 dalam Felo Search

01

Jejaki soalan sebenar

Teliti kekangan di sebalik permintaan yang samar, bukan berhenti pada tafsiran pertama yang kelihatan munasabah.

02

Timbang bukti yang bercanggah

Himpunkan sumber dan dakwaan yang bersaing dalam satu penyiasatan, kemudian kenal pasti tempat bukti bersetuju dan tidak bersetuju.

03

Kembali dengan kurang perkara tergantung

Gunakan jawapan sebagai titik permulaan yang sedia untuk keputusan, sambil mengekalkan penaakulan, peringatan dan soalan terbuka yang kelihatan.

Panduan ringkas

Tukar kepada Claude Opus 5 dalam Felo

Buka pemilih model, pilih Claude Opus 5, kemudian mulakan tugas anda dalam ruang kerja yang sama.

24 Jul

keluaran 2026

Model Opus terbaru Anthropic

$5 / $25

input / output API

Setiap 1 juta token, harga asas yang sama seperti Opus 4.8

~2.5x

kelajuan Fast mode

Tersedia pada 2x harga asas di platform Anthropic

Sahkan + semak semula

Kerja jangka panjang

Perancangan, penggunaan alat, semakan dan iterasi

Perbezaan Opus

Jangan berhenti pada perkara pertama yang berjaya.

Anthropic meletakkan Opus 5 untuk kerja yang memerlukan pertimbangan berterusan: kenal pasti isu asas, sahkan hasil dan kembali menilai kerja apabila bukti tidak menyokongnya.

01

Jejaki masalah asas

Untuk pepijat yang sukar dan tugasan samar, mulakan dengan bukti, kekangan dan punca sebenar, bukan tampalan di permukaan.

02

Semak kerja sebelum serah terima

Gunakan model yang boleh memeriksa outputnya sendiri, menguji andaian dan menangkap isu sebelum manusia perlu menemuinya kemudian.

03

Kekalkan aliran merentas semakan

Bawa kod, bahan sumber, hasil alat dan kekangan baharu ke dalam satu tugasan yang lebih panjang, tanpa mengurangkan kerja kepada prompts yang terpisah.

Pemilihan model

Bandingkan kos token dengan kos apabila tersilap.

Harga di bawah ialah kadar API awam rasmi, bukan harga langganan atau penggunaan Felo. Ia menjelaskan pertukaran tanpa berpura-pura bahawa ujian latency yang tidak berkaitan antara vendor boleh dibandingkan secara terus.

Faktor keputusan
Claude Opus 5
GPT-5.6 Sol
Kimi K3
Claude Opus 4.8
Harga API / 1 juta token
$5 input / $25 output
$5 input / $0.50 cached / $30 output
$3 input / $0.30 cached / $15 output
$5 input / $25 output
Kelajuan dan kapasiti
Kelajuan lalai, atau Fast mode kira-kira 2.5x lebih pantas pada 2x harga asas.
OpenAI melabel Sol sebagai Fast; tetingkap konteks 1.05M token.
Konteks 1,048,576 token; throughput berbeza mengikut peringkat had kadar akaun.
Penanda aras Opus terdahulu. Bandingkan ketersediaan dan latency langsung dalam aliran kerja anda.
Paling sesuai untuk
Kerja jangka panjang berimpak tinggi yang memerlukan pengesahan dan iterasi teliti.
Kerja profesional kompleks dengan respons flagship pantas dan tetingkap konteks sangat besar.
Coding jangka panjang dan kerja pengetahuan hujung ke hujung pada harga token awam lebih rendah.
Aliran kerja Opus sedia ada apabila kesinambungan lebih penting daripada berpindah segera.
Pilih apabila
Tugas perlu diselesaikan, diperiksa dan boleh dipertahankan, bukan sekadar dirangka.
Anda mahu peringkat flagship OpenAI dan profil kelajuan/konteksnya sesuai dengan tugas.
Anda memerlukan konteks 1M token dan mahu mengawal kos melalui caching serta reasoning effort.
Anda menilai migrasi terkawal daripada baseline generasi terdahulu yang sudah mantap.

Harga API awam rasmi diperiksa pada 25 Julai 2026. Jumlah kos tugas juga bergantung pada panjang output, input cached, tetapan effort, panggilan alat, percubaan semula dan semakan manusia.

Carta benchmark rasmi

Apa yang ditunjukkan carta kos lawan prestasi Anthropic

Carta rasmi ini memplot prestasi model berbanding kos penilaian yang dilaporkan pada tahap effort berbeza. Ia konteks berguna untuk keputusan kos, tetapi hasil yang diterbitkan vendor, bukan ujian Felo bebas.

Gambaran keupayaan benchmark rasmi Claude Opus 5 Anthropic yang membandingkan Opus 5, Fable 5, Opus 4.8 dan GPT-5.6 Sol dalam coding, kerja pengetahuan, carian, penggunaan komputer, aliran kerja perniagaan, kesihatan dan biologi

Gambaran keupayaan rasmi merentas keluarga benchmark

Matriks rentas tugas Anthropic membandingkan hasil diterbitkan bagi Opus 5, Fable 5, Opus 4.8 dan GPT-5.6 Sol dalam coding, kerja pengetahuan, carian, penggunaan komputer, aliran kerja perniagaan dan banyak lagi.

Carta Anthropic rasmi untuk coding agentic mengikut tahap effort yang membandingkan Opus 5, Fable 5, Opus 4.8 dan GPT-5.6 Sol mengikut kos setiap tugas

Coding agentic mengikut tahap effort

Artificial Analysis Coding Agent Index: carta rasmi membandingkan skor dengan kos setiap tugas yang dilaporkan merentas tetapan effort tersedia.

Carta Anthropic rasmi untuk penggunaan komputer agentic mengikut tahap effort yang membandingkan Opus 5, Fable 5, Opus 4.8 dan GPT-5.6 Sol mengikut kos setiap tugas

Penggunaan komputer agentic mengikut tahap effort

OSWorld 2.0: carta rasmi membandingkan prestasi penggunaan komputer dengan kos setiap tugas yang dilaporkan merentas tetapan effort.

Carta Anthropic rasmi untuk tugas pengetahuan dunia sebenar mengikut tahap effort yang membandingkan Opus 5, Fable 5, Opus 4.8 dan GPT-5.6 Sol mengikut kos benchmark

Tugas pengetahuan dunia sebenar mengikut tahap effort

GDPval-AA v2: carta rasmi membandingkan skor Elo dengan kos benchmark penuh yang dilaporkan merentas tetapan effort.

Carta Anthropic rasmi untuk carian agentic DeepSearchQA mengikut tahap effort yang membandingkan Opus 5, Fable 5 dan Opus 4.8 mengikut kos setiap tugas

Carian agentic mengikut tahap effort

DeepSearchQA: carta rasmi membandingkan kadar lulus tugas carian dengan kos setiap tugas yang dilaporkan merentas tetapan effort tersedia.

Carta dan label benchmark datang daripada pengumuman Claude Opus 5 Anthropic. Felo hanya menambah bingkai pembentangan luar; kandungan carta dikekalkan seperti diterbitkan.

Titik mula yang lebih baik

Berikan Opus 5 kerja yang layak mendapat semakan kedua.

Model ini memperoleh tempatnya apabila pengesahan mengubah hasil. Ini bukan chat prompts umum; ini kerja berbilang langkah apabila dependency yang terlepas, dakwaan tanpa sokongan atau edge case yang tidak diuji akan memakan masa kemudian.

Kod production dan QA

Siasat regression, hasilkannya semula, periksa kod sekeliling, laksanakan pembaikan berfokus dan uji laluan yang sering terlepas oleh patch pantas.

Analisis kewangan dan dokumen

Selaraskan jadual, uji andaian, bandingkan dokumen sumber dan hasilkan cadangan dengan bukti serta peringatan yang kekal utuh.

Penyelidikan yang perlu diteliti

Baca sumber yang bersaing, dedahkan soalan terbuka, timbang bukti dan bezakan jawapan yakin daripada jawapan yang benar-benar disokong.

Tugasan agent jangka panjang

Gunakan alat, kekalkan kekangan tugas, pulih daripada hasil separa dan teruskan tugasan yang lebih besar dengan titik semak yang disengajakan.

Cuba tugas yang ada akibat

01

Bawa konteks sebenar

Tambah kod, dokumen, keperluan dan bukti yang perlu diambil kira oleh jawapan berguna.

02

Minta pelan pengesahan

Nyatakan apa yang mesti diperiksa sebelum kerja dianggap lengkap, bukan hanya apa yang perlu dihasilkan.

03

Bandingkan artifak akhir

Gunakan tugas sama pada model terkemuka dalam Felo. Semak bukan hanya jawapan, tetapi juga ujian, peringatan dan pertimbangan di belakangnya.

Pilih Claude Opus 5 apabila ia tersedia dalam pemilih model langsung akaun anda.

Buka Felo LLM Playground

FAQ Claude Opus 5

Claude Opus 5 ialah model peringkat Opus Anthropic yang dilancarkan pada 24 Julai 2026. Anthropic meletakkannya untuk agents jangka panjang, kejuruteraan perisian kompleks, kerja pengetahuan profesional dan tugas yang mendapat manfaat daripada pengesahan serta iterasi teliti.

Gunakan model yang memeriksa kerja.

Letakkan Claude Opus 5 di samping model terkemuka lain dalam Felo, kemudian uji pada tugas yang jawapan pertama yang kelihatan munasabah belum mencukupi.

Cuba Opus 5 dalam Felo

Mulakan dalam Felo AI Search dan pilih model apabila tersedia.