Claude Opus 5: Model AI Terkuat Anthropic untuk Pekerjaan Sehari-hari

Anthropic meluncurkan Claude Opus 5 pada 24 Juli 2026, model yang dirancang untuk digunakan setiap hari dengan performa mendekati Claude Fable 5 namun dengan harga setengahnya. Ini bukan sekadar pembaruan kecil, Opus 5 mencatat rekor baru pada sejumlah benchmark bergengsi dan menjadi model default di Claude Max.
Performa yang Jauh Melampaui Pendahulunya
Pada benchmark Frontier-Bench v0.1, Opus 5 mengungguli semua model lain dan mencatat skor lebih dari dua kali lipat Opus 4.8 dengan biaya per tugas yang lebih rendah. Di CursorBench 3.2, Opus 5 pada pengaturan usaha maksimal berada dalam selisih 0,5% dari skor puncak Fable 5, tetapi dengan biaya hanya setengahnya.
Untuk tugas-tugas di luar pemrograman, hasilnya sama mengesankan:
- ARC-AGI 3: Skor Opus 5 tiga kali lebih tinggi dari model terbaik berikutnya di kategori ini, sebuah evaluasi yang mengukur kemampuan memecahkan masalah baru.
- Zapier AutomationBench: Tingkat kelulusan Opus 5 sekitar 1,5 kali lebih tinggi dari model terbaik lainnya untuk biaya per tugas yang sama. Bahkan pada pengaturan usaha terendah, Opus 5 menyelesaikan lebih banyak tugas dibanding model manapun.
- OSWorld 2.0: Opus 5 melampaui hasil terbaik Fable 5 pada benchmark penggunaan komputer ini, dengan biaya hanya sepertiga lebih sedikit.
Di bidang riset ilmiah, Opus 5 menunjukkan peningkatan pada seluruh evaluasi life sciences. Peningkatan paling menonjol terjadi pada tugas kimia organik, dengan skor 10,2 poin persentase lebih tinggi dari Opus 4.8 pada benchmark internal Anthropic.
Kemampuan Agentic yang Lebih Matang

Yang membedakan Opus 5 bukan hanya angka benchmark, tetapi bagaimana model ini bekerja secara mandiri pada tugas-tugas kompleks. Anthropic membagikan beberapa contoh nyata dari pengujian:
Pada satu tugas Frontier-Bench, Opus 5 diminta menulis kode untuk merekonstruksi gambar suku cadang mesin sebagai model 3D FreeCAD, tanpa diberi cara langsung untuk melihat gambar tersebut. Alih-alih menyerah, Opus 5 menulis pipeline computer vision sendiri untuk mengekstrak geometri dari piksel mentah, lalu merekonstruksi suku cadang secara lengkap. Tidak ada model pesaing yang bisa menyelesaikan tugas ini bahkan setelah lima percobaan.
Contoh lain: ketika diberi bug nyata dalam package manager open-source populer, Opus 5 menemukan akar masalahnya dan memperbaiki edge case yang terlewat oleh patch komunitas. Model pesaing hanya memperbaiki gejala permukaannya saja.
Feedback dari pengguna early-access juga konsisten: Opus 5 dinilai lebih teliti, lebih mampu mempertahankan posisinya ketika ada rancangan yang kurang tepat, dan lebih efisien dalam penggunaan token. Satu firma perdagangan bahkan menyebut Opus 5 mencapai akurasi 9 poin persentase lebih tinggi dengan sepertiga lebih sedikit giliran dan tool calls, serta 60% lebih sedikit waktu dibanding Opus 4.8.
Keamanan dan Alignment
Opus 5 adalah model Anthropic yang paling aligned hingga saat ini. Dalam audit perilaku otomatis internal, Opus 5 mencetak 2,3 pada keseluruhan perilaku yang tidak selaras, angka terendah di antara model-model terbaru Anthropic. Model ini lebih patuh pada Claude's Constitution, menunjukkan tingkat perilaku menipu yang lebih rendah, dan paling sulit untuk diperdaya agar melakukan penyalahgunaan.
Dari sisi keamanan, Opus 5 tidak memajukan frontier pada kemampuan dual-use yang berisiko. Meskipun kemampuannya di bidang keamanan siber meningkat secara alami seiring peningkatan kapabilitas umum, model ini masih tertinggal jauh dari Mythos 5 dalam hal eksploitasi kerentanan. Anthropic juga mempertahankan safeguard untuk biologi, dengan Opus 5 menggantikan Opus 4.8 sebagai model yang tersedia secara umum untuk permintaan yang diblokir pada Fable 5.
Harga dan Ketersediaan
Claude Opus 5 tersedia sekarang di semua platform dengan harga $5 per juta input token dan $25 per juta output token, sama dengan harga Opus 4.8. Model ini juga tersedia dalam Fast mode yang berjalan sekitar 2,5 kali kecepatan default dengan harga dua kali harga dasar.
Bersamaan dengan peluncuran ini, Anthropic merilis dua fitur baru dalam beta:
- Mid-conversation tool changes: Developer kini bisa mengubah tool yang digunakan Claude di tengah percakapan tanpa membatalkan prompt cache.
- Automatic fallbacks: Permintaan yang ditandai oleh safety classifier pada Opus 5 atau Fable 5 dapat secara otomatis diarahkan ke model lain, sehingga request selalu mendapat respons dari model terbaik yang tersedia.
Kenapa Ini Relevan
Bagi pebisnis dan profesional di Indonesia yang sudah menggunakan atau mempertimbangkan AI dalam operasional sehari-hari, Opus 5 menghadirkan proposisi yang konkret: performa kelas atas dengan biaya yang lebih terjangkau. Kemampuannya dalam analisis data, pekerjaan hukum, riset keuangan, hingga tugas agentic jangka panjang, semuanya terdokumentasi langsung dari pengguna nyata dalam pengujian awal. Ditambah dengan tingkat alignment tertinggi yang pernah dicapai Anthropic, ini adalah sinyal bahwa model AI generasi ini semakin siap untuk diintegrasikan ke dalam workflow produksi yang membutuhkan keandalan dan konsistensi tinggi.