Skip to main content

Claude Opus 5 Kini Hadir di Felo: Fitur, Harga & Uji Coba Gratis 7 Hari

· 13 menit dibaca
Felo Search Tips Buddy
Committed to answers at your fingertips

Felo kini mendukung Claude Opus 5. Jelajahi fitur, benchmark, keamanan, dan harga, lalu coba model agentic coding dari Anthropic gratis selama 7 hari.

Felo kini mendukung Claude Opus 5, model terbaru dari Anthropic di kelas Opus untuk agentic coding, analisis profesional, dan pekerjaan jangka panjang. Pilih model ini di Felo saat tugas membutuhkan lebih dari sekadar jawaban awal yang kuat: ia membutuhkan riset, verifikasi, iterasi, dan hasil yang bisa Anda tinjau dengan percaya diri.

Untuk menandai peluncuran ini, pelanggan Felo Pro dapat menggunakan Claude Opus 5 tanpa biaya tambahan selama tujuh hari sejak tanggal rilisnya. Bawa bug yang membandel, ringkasan riset dengan bukti yang saling bertentangan, analisis multi-langkah, atau dokumen yang butuh lebih dari satu kali revisi—dan nilai model ini berdasarkan pekerjaan yang benar-benar penting bagi Anda.

Pengumuman peluncuran Claude Opus 5 dari Anthropic, ditampilkan tanpa perubahan dengan bingkai abu-abu

Gambar sampul: karya seni asli dari pengumuman Claude Opus 5 Anthropic. Konten visual tidak diubah; Felo hanya menambahkan bingkai abu-abu.

Ini lebih dari sekadar catatan rilis. Di bawah ini adalah panduan visual tentang tujuan Opus 5, hasil evaluasi dari Anthropic, batasan model, dan cara mengujinya dengan pekerjaan nyata di Felo.

Siap mencoba? Mulai uji coba Claude Opus 5 selama 7 hari di Felo ->

Fitur Claude Opus 5: apa yang dirancang oleh model ini

Anthropic merilis Claude Opus 5 pada 24 Juli 2026, menempatkannya sebagai model berkemampuan tinggi untuk penggunaan sehari-hari pada agen jangka panjang, rekayasa perangkat lunak, dan pekerjaan pengetahuan profesional. Dalam deskripsi Anthropic sendiri, perubahan utama bukan sekadar respons awal yang lebih baik. Opus 5 dirancang untuk bekerja lebih hati-hati: memverifikasi hasil antara, menjaga alur tugas kompleks, dan melakukan iterasi jika upaya pertama belum menyelesaikan masalah sebenarnya.

Perbedaan ini penting dalam pekerjaan nyata. Pertanyaan rutin mungkin hanya butuh jawaban cepat dan ringkas. Tugas yang lebih besar bisa memerlukan model untuk membaca materi sumber, menentukan apa yang masih perlu diketahui, menjalankan kalkulasi atau alat, membandingkan alternatif, memeriksa output, dan menjelaskan hasilnya. Inilah kasus di mana model kelas Opus paling layak dipilih.

Anthropic menyoroti tiga kekuatan utama yang saling terkait:

  • Agentic coding: fitur besar, debugging sulit, analisis akar masalah, refaktor, dan tugas yang melibatkan lebih dari satu file atau alat.
  • Pekerjaan pengetahuan dan analisis: penalaran terstruktur atas materi padat, pekerjaan numerik dan tabel, due diligence, riset, dan dukungan keputusan.
  • Alur kerja penggunaan komputer dan otomatisasi: menyelesaikan rangkaian langkah, bukan hanya menghasilkan satu jawaban terpisah.

Klaim-klaim ini bukan berarti model bisa dibiarkan tanpa pengecekan. Namun, model ini dapat menyelesaikan draf pekerjaan sulit secara lebih lengkap sebelum manusia meninjau keputusan, bukti, dan tindakan akhir.

Benchmark dan kemampuan Claude Opus 5

Benchmark model adalah sinyal yang berguna, bukan jaminan bahwa model akan tampil sama di setiap proyek. Hasilnya bergantung pada tugas, alat, pengaturan, dan metode penilaian. Namun, rilis Anthropic memberikan gambaran yang membantu tentang masalah yang menjadi target Opus 5.

Untuk rekayasa perangkat lunak, Anthropic melaporkan bahwa Opus 5 memimpin dalam uji internal Frontier-Bench v0.1 dan lebih dari dua kali lipat performa Opus 4.8 dengan biaya per tugas yang lebih rendah. Grafik di bawah ini berguna karena memperjelas trade-off: seri Opus 5 berwarna oranye melampaui hasil Opus sebelumnya di seluruh pengaturan effort, bukan hanya pada titik termahalnya.

Grafik Frontier-Bench v0.1 dari Anthropic membandingkan skor agentic coding dengan biaya per percobaan, ditampilkan tanpa perubahan dengan bingkai abu-abu

Sumber: Anthropic, Introducing Claude Opus 5. Grafik asli ditampilkan tanpa perubahan; bingkai abu-abu ditambahkan oleh Felo. Catatan grafik: Frontier-Bench menggunakan mini-SWE-agent harness, backend GKE, dan rata-rata reward dari lima percobaan per tugas.

Pada CursorBench 3.2, Anthropic menyatakan model ini mencapai skor puncak Claude Fable 5 dengan selisih hanya 0,5% pada effort maksimum, dengan biaya setengah dari per tugas. Inilah alasan Opus 5 paling menarik untuk tugas di mana upaya awal yang kurang berkualitas justru menambah pekerjaan: debugging di seluruh basis kode, membangun fitur end-to-end, atau menelusuri akar masalah daripada sekadar menambal gejala.

Untuk pemecahan masalah yang lebih luas dan pekerjaan ala kantor, perusahaan melaporkan bahwa Opus 5:

  • memperoleh skor tiga kali lebih tinggi dari model terbaik berikutnya pada ARC-AGI 3, evaluasi pemecahan masalah baru;
  • mencapai sekitar 1,5 kali tingkat keberhasilan model terbaik berikutnya pada biaya yang sama di Zapier AutomationBench, yang menguji otomatisasi bisnis end-to-end;
  • mengungguli model lain pada biaya yang sebanding di OSWorld 2.0, benchmark penggunaan komputer; dan
  • menjadi model terbaik dan paling efisien di ARC-AGI 3, GDPval-AA v2, HLE, AutomationBench, dan DeepSearchQA.

Gambaran ini tidak hanya terbatas pada kode. Grafik GDPval-AA v2 dari Anthropic melacak tugas pengetahuan dunia nyata di berbagai tingkat effort. Ini membantu menjelaskan mengapa Opus 5 relevan untuk riset, keuangan, hukum, operasi, dan pekerjaan lain di mana jawaban harus tahan uji review, bukan sekadar enak dibaca pada percobaan pertama.

Grafik GDPval-AA v2 dari Anthropic membandingkan skor tugas pengetahuan dunia nyata berdasarkan tingkat effort, ditampilkan tanpa perubahan dengan bingkai abu-abu

Sumber: Anthropic, Introducing Claude Opus 5. Grafik asli ditampilkan tanpa perubahan; bingkai abu-abu ditambahkan oleh Felo.

Ini adalah hasil yang dipublikasikan Anthropic, termasuk uji internal dan umpan balik early-access terpilih, bukan peringkat universal independen. Cara paling produktif membaca hasil ini adalah sebagai panduan untuk menguji model sendiri: tugas dengan rantai dependensi panjang, persyaratan ambigu, penggunaan alat, verifikasi, dan konsekuensi nyata jika jawaban dangkal lolos.

Fitur Claude Opus 5: mengapa “effort” mengubah pengalaman

Opus 5 mendukung pengaturan effort yang berbeda. Secara sederhana, effort memberi Anda cara untuk menukar kecepatan respons dan penggunaan token dengan waktu penalaran tambahan. Grafik Anthropic membandingkan model di beberapa tingkat effort, dari pengaturan rendah yang dirancang menghemat token hingga effort tinggi, xhigh, dan maksimum.

Ini berguna karena tidak setiap permintaan layak mendapat anggaran yang sama. Gunakan pengaturan rendah untuk klasifikasi cepat, outline, atau revisi sempit. Tingkatkan effort saat tugas punya banyak batasan, model harus menyatukan sumber, atau harus mendiagnosis mengapa upaya sebelumnya gagal. Untuk output berisiko tinggi, gunakan waktu yang dihemat untuk langkah review juga: minta model mengidentifikasi asumsi, mencantumkan sumber, menguji kasus ekstrem, atau menjelaskan apa yang akan mengubah rekomendasinya.

Peluncuran ini juga memperkenalkan Fast mode opsional melalui platform Anthropic. Anthropic menyatakan mode ini berjalan sekitar 2,5 kali lebih cepat dari standar dan biaya dua kali lipat di sana. Ketersediaan dan kontrol bisa berbeda di tiap produk, jadi di Felo gunakan pengaturan yang ditampilkan di workspace Anda, jangan berasumsi semua opsi Anthropic muncul dalam bentuk yang sama.

Perbedaannya terlihat pada cara model memeriksa dirinya sendiri

Tema paling menarik dari rilis ini adalah verifikasi. Anthropic menggambarkan evaluasi di mana Opus 5 menerima gambar bagian mesin tanpa cara langsung untuk melihatnya. Alih-alih berhenti, model ini dikabarkan menulis pipeline computer-vision untuk mengambil geometri dari pixel mentah, lalu membangun ulang bagian tersebut sebagai model 3D FreeCAD. Dalam contoh lain, Anthropic menyatakan model ini menemukan akar masalah bug package-manager nyata dan menangani kasus ekstrem yang terlewat oleh patch komunitas.

Contoh seperti ini sebaiknya diperlakukan sebagai demonstrasi dari pembuat model, bukan janji. Namun, ini menyarankan pola prompting konkret untuk Felo: jangan hanya meminta jawaban. Mintalah loop kerja.

Investigasi masalah, lalu usulkan solusi.
Sebelum finalisasi, verifikasi solusi terhadap persyaratan yang disebutkan,
daftar asumsi, dan identifikasi tes atau bukti yang bisa membantahnya.
Kembalikan rekomendasi akhir terpisah dari catatan kerja.

Untuk riset, pendekatan serupa bisa mengubah prompt luas menjadi proses yang bisa direview: kumpulkan sumber terkini, bedakan fakta dari inferensi, cari bukti tandingan, dan hasilkan ringkasan keputusan yang ringkas. Alur kerja multibahasa Felo sangat membantu saat materi relevan muncul dalam berbagai bahasa; minta bahasa sumber tetap disertakan bersama sintesis bahasa Inggris yang jelas jika diperlukan.

Anthropic juga melaporkan hasil kuat di OSWorld 2.0, benchmark untuk mengoperasikan komputer melalui antarmuka multi-langkah. Ini pengingat berguna bahwa pekerjaan agentic sering kali bukan “satu prompt, satu jawaban.” Ini adalah rangkaian pengecekan status, memilih aksi berikutnya, dan memvalidasi apakah hasil benar-benar memenuhi tujuan.

Grafik OSWorld 2.0 dari Anthropic membandingkan performa agentic computer-use dengan biaya per tugas, ditampilkan tanpa perubahan dengan bingkai abu-abu

Sumber: Anthropic, Introducing Claude Opus 5. Grafik asli ditampilkan tanpa perubahan; bingkai abu-abu ditambahkan oleh Felo.

Performa bukan satu-satunya pertimbangan: keamanan dan batasan

Anthropic melaporkan bahwa audit perilaku pra-deployment menemukan Opus 5 sebagai model terbaru mereka yang paling selaras. Model ini menunjukkan perilaku misaligned lebih rendah secara keseluruhan, perilaku menipu lebih rendah, dan ketahanan lebih tinggi terhadap prompt penyalahgunaan dibanding beberapa model Claude terbaru lainnya. Anthropic juga menyatakan Opus 5 tidak memperluas frontier kemampuan dual-use berisiko dalam pengujian biologi dan keamanan siber ofensif.

Grafik audit berikut adalah ringkasan visual paling jelas dari klaim tersebut. Pada skala perilaku misaligned Anthropic 1-10, semakin rendah semakin baik; Opus 5 ditampilkan di angka 2,30, di bawah model lain dalam perbandingan. Ini adalah evaluasi keamanan internal, jadi sebaiknya digunakan untuk melengkapi—bukan menggantikan—kontrol manusia yang hati-hati pada pekerjaan penting.

Grafik audit perilaku otomatis Anthropic menunjukkan Opus 5 dengan skor perilaku misaligned terendah di antara model yang dibandingkan, ditampilkan tanpa perubahan dengan bingkai abu-abu

Sumber: Anthropic, Introducing Claude Opus 5. Grafik asli ditampilkan tanpa perubahan; bingkai abu-abu ditambahkan oleh Felo.

Poin praktis pentingnya adalah bahwa pengaman tetap menjadi bagian produk. Anthropic menyatakan Opus 5 dapat membantu menemukan kerentanan pada kode sumber, tetapi menerapkan guardrail lebih kuat pada aktivitas siber tertentu, termasuk pemindaian kerentanan berbasis binary, penetration testing, dan exploit generation. Permintaan yang memicu pengaman ini bisa diblokir atau, pada beberapa produk Anthropic, dialihkan ke model lain.

Untuk semua pekerjaan lain, tetap gunakan kebiasaan baik yang berlaku untuk model berkemampuan tinggi:

  • Tinjau klaim fakta, kalkulasi, sitasi, kode, dan tindakan akhir sebelum mengandalkannya.
  • Jangan anggap kefasihan sebagai bukti. Minta sumber primer dan periksa.
  • Tetap libatkan manusia untuk keputusan hukum, finansial, medis, keamanan, dan keputusan penting lainnya.
  • Berikan model kondisi keberhasilan yang jelas dan batasan yang tidak boleh dilanggar.

Anthropic juga mencatat bahwa Opus 5 masih memiliki batasan penting pada tugas riset otonom jangka panjang. Kemampuan bukanlah otonomi, dan loop review manusia yang baik tetap menjadi bagian dari alur kerja yang kuat.

Harga Claude Opus 5 dan uji coba gratis di Felo

Anthropic menetapkan harga Claude Opus 5 $5 per juta token input dan $25 per juta token output melalui API Claude, sama dengan tarif dasar Opus 4.8. Harga di platform pihak ketiga, langganan, dan fitur bisa berbeda, jadi gunakan informasi harga dan penggunaan yang ditampilkan di produk tempat Anda bekerja.

Untuk pelanggan Felo Pro, poin utamanya lebih sederhana: Claude Opus 5 gratis untuk dicoba selama tujuh hari sejak rilis. Ini memungkinkan Anda mengevaluasi model dengan tugas nyata sebelum memutuskan apakah model ini layak masuk ke daftar model reguler Anda. Perbandingan yang masuk akal bukan sekadar “Model mana yang menulis draf pertama paling bagus?” Coba tugas sulit yang sama dengan model yang biasa Anda gunakan, lalu bandingkan kelengkapan, tingkat error, kebutuhan tindak lanjut, kualitas penanganan sumber, dan berapa banyak waktu review yang dibutuhkan tiap hasil.

Cara mencoba Claude Opus 5 gratis selama 7 hari di Felo Pro

  1. Masuk ke akun Felo Pro Anda.
  2. Mulai tugas baru di workspace Felo yang biasa Anda gunakan untuk riset, penulisan, analisis, atau pekerjaan agentic.
  3. Pilih Claude Opus 5 di pemilih model.
  4. Berikan tugas dengan deliverable yang jelas, file atau konteks relevan, dan langkah verifikasi eksplisit.
  5. Tinjau hasilnya, perbaiki instruksi jika perlu, dan bandingkan dengan alur kerja Anda selama penawaran tujuh hari peluncuran.

Mulailah dengan pekerjaan yang mengungkap kekuatan model: rencana proyek yang membutuhkan trade-off, spreadsheet atau laporan kompleks, review kode sulit, pertanyaan riset multi-sumber, atau analisis yang harus tahan uji pertanyaan lanjutan. Tujuannya bukan membuat model terlihat mengesankan dengan prompt cerdas. Tujuannya adalah mengetahui apakah model ini membuat pekerjaan nyata Anda lebih jelas, lebih andal, dan lebih mudah diselesaikan.

Gunakan penawaran ini pada tugas yang penting: Mulai uji coba Claude Opus 5 di Felo ->

Apakah Claude Opus 5 layak dicoba?

Claude Opus 5 menghadirkan opsi baru di Felo untuk tugas yang membutuhkan ketekunan, penalaran hati-hati, dan verifikasi. Hasil yang dipublikasikan menunjukkan kemajuan berarti dalam agentic coding, otomatisasi, penggunaan komputer, dan analisis profesional, sementara batasan dan pengaman tetap menjadi konteks penting.

Selama tujuh hari ke depan, pelanggan Felo Pro dapat menilai model ini tanpa biaya tambahan. Bawa tugas yang benar-benar penting, minta model menunjukkan dan memeriksa pekerjaannya, dan putuskan dari hasilnya apakah Claude Opus 5 layak mendapat tempat permanen di alur kerja Anda.

Mulai uji coba Claude Opus 5 selama 7 hari di Felo ->


Sumber dan bacaan lanjutan


Tulisan ini juga tersedia dalam English, 简体中文, 日本語, 한국어, 繁體中文, हिन्दी, Français, العربية, Русский, اردو, Deutsch, Tiếng Việt, Türkçe, Italiano, ไทย, Español, বাংলা and Português.