6 menit baca

Anthropic Rilis Claude Opus 5: Mendekati Fable 5 dengan Biaya Separuhnya

Claude Opus 5 hadir sebagai model harian baru Anthropic: unggul di coding agentik dan knowledge work, harga API sama dengan Opus 4.8, serta diklaim mendekati Fable 5 dengan biaya sekitar setengahnya.

Anthropic Rilis Claude Opus 5: Mendekati Fable 5 dengan Biaya Separuhnya

Anthropic merilis Claude Opus 5 pada 24 Juli 2026. Model ini diposisikan sebagai pilihan harian yang mendekati kecerdasan frontier Claude Fable 5, dengan harga sekitar setengahnya. Di Claude Max, Opus 5 menjadi model default baru; di Claude Pro, ia jadi opsi terkuat yang tersedia.

Klaim utamanya bukan sekadar “lebih pintar dari Opus 4.8”. Anthropic menekankan efisiensi: skor yang naik tajam pada coding dan knowledge work, sementara harga API tetap sama dengan Opus 4.8—$5 per sejuta token input dan $25 per sejuta token output. Pengembang bisa langsung memakai claude-opus-5 di Claude API, Claude.ai, Claude Code, dan Claude Cowork.

Sumber lengkap dan grafik resmi tersedia di pengumuman Anthropic.

Tabel ringkasan benchmark Claude Opus 5 dibanding Fable 5, Opus 4.8, dan GPT-5.6 Sol
Ringkasan posisi Opus 5 di sejumlah benchmark coding, knowledge work, computer use, dan domain khusus.

Performa vs biaya: inti narasi Opus 5

Yang paling sering diulang Anthropic adalah kurva effort. Model bisa dijalankan dari low sampai max effort: makin tinggi effort, makin mahal per tugas, tapi biasanya makin kuat hasilnya. Di kurva itu, Opus 5 sering duduk di zona “skor tinggi dengan biaya lebih rendah” dibanding Fable 5.

Grafik Frontier-Bench v0.1 skor versus biaya per attempt untuk Opus 5 dan model pembanding
Frontier-Bench v0.1: Opus 5 melampaui model lain dan lebih dari dua kali lipat performa Opus 4.8 pada biaya per tugas yang lebih rendah.

Pada CursorBench, Opus 5 di max effort hanya terpaut sekitar 0,5 persen dari puncak Fable 5—tapi dengan biaya per tugas sekitar setengahnya. Pola yang sama muncul di Artificial Analysis Coding Agent Index: untuk skor setara, Opus 5 cenderung lebih hemat.

Grafik CursorBench skor versus biaya per tugas untuk Opus 5, Fable 5, Opus 4.8, dan GPT-5.6 Sol
CursorBench: Opus 5 mendekati puncak Fable 5 dengan biaya jauh lebih rendah di hampir semua tingkat effort.

Benchmark yang paling mencolok

Beberapa angka dari materi resmi Anthropic yang paling mudah dibaca sebagai “lompatan generasi”:

  • Frontier-Bench v0.1: Opus 5 di posisi state-of-the-art untuk agentic terminal coding.
  • ARC-AGI 3: skor Opus 5 sekitar tiga kali model runner-up pada evaluasi pemecahan masalah novel.
  • Zapier AutomationBench: pass rate sekitar 1,5× model terbaik berikutnya untuk biaya per tugas yang sama; bahkan di effort terendah, Opus 5 lulus lebih banyak tugas dibanding model lain.
  • OSWorld 2.0: unggul di hampir semua titik biaya, bahkan melampaui hasil terbaik Fable 5 dengan sedikit lebih dari sepertiga biayanya.
  • GDPval-AA v2: Opus 5 memimpin papan knowledge work yang dipakai Anthropic untuk mengukur kerja dunia nyata.
Grafik ARC-AGI-3 yang menunjukkan lompatan skor Opus 5 dibanding Opus 4.8 dan GPT-5.6 Sol
ARC-AGI 3: lompatan paling dramatis—Opus 5 jauh di atas garis dasar model sebelumnya untuk novel problem-solving.
Grafik GDPval-AA v2 Elo score versus biaya benchmark penuh
GDPval-AA v2: pada knowledge work dunia nyata, Opus 5 menjaga keunggulan skor di hampir setiap tingkat biaya.
Grafik AutomationBench pass rate versus biaya per tugas
AutomationBench: Opus 5 memimpin workflow bisnis agentik dengan pass rate lebih tinggi pada biaya yang relatif terkendali.

Di sisi sains, Anthropic menyebut Opus 5 lebih kuat dari Opus 4.8 di seluruh evaluasi life sciences internal mereka—termasuk kimia organik dan tugas terkait protein. Model ini juga diklaim menghasilkan output visual yang jauh lebih baik, termasuk visualisasi aliran udara dan artefak sel.

Yang berubah saat dipakai: lebih teliti, lebih “agentic”

Bagian yang paling relevan untuk builder bukan hanya leaderboard, melainkan perilaku kerja. Anthropic dan early-access customer menekankan tiga pola:

  1. Verifikasi mandiri — model lebih sering mengecek hasilnya sendiri sebelum menyerahkan pekerjaan.
  2. Root-cause debugging — cenderung mencari penyebab akar, bukan sekadar menutup gejala.
  3. Judgment — lebih berhati-hati saat handoff PR, redline dokumen, atau keputusan desain yang ambigu.

Ada juga anekdot teknis yang cukup “berbicara”: pada satu tugas Frontier-Bench, Opus 5 diminta merekonstruksi komponen mesin 3D dari gambar tanpa akses langsung untuk melihat drawing itu. Model menulis pipeline computer vision sendiri untuk menarik geometri dari pixel mentah, lalu membangun model FreeCAD—sesuatu yang menurut Anthropic tidak berhasil diselesaikan model kompetitor dalam setup yang sama.

Laporan early access dari Cursor, Cognition/Devin, Zapier, Lovable, Box, Notion, dan sejumlah perusahaan finansial/legal mengarah ke kesimpulan mirip: Opus 5 terasa seperti lompatan terbesar keluarga Opus sejak 4.5, terutama untuk coding agentik, analisis panjang, dan kerja yang butuh ketelitian.

Alignment, keamanan, dan batasan

Anthropic menyebut Opus 5 sebagai model mereka yang paling ter-align sejauh ini pada automated behavioral audit: lebih patuh pada Constitution, lebih jarang menipu, dan lebih sulit digoda ke penyalahgunaan. Dari sisi kapabilitas berisiko ganda, Opus 5 dinilai tidak mendorong frontier baru—tetap di belakang Mythos 5 untuk riset biologi dan cyber ofensif.

Grafik OSS-Fuzz perbandingan kemampuan menemukan kerentanan versus sukses mengeksploitasi
OSS-Fuzz: Opus 5 hampir setara Mythos 5 dalam menemukan kerentanan, tapi jauh di belakang dalam membangun exploit—garis yang sengaja dijaga Anthropic.

Safeguard cyber Opus 5 lebih longgar dibanding Fable 5: menemukan kerentanan di source code diizinkan, tetapi binary-based vulnerability scanning, penetration testing, dan pembuatan exploit diblokir. Anthropic memperkirakan classifier cyber akan campur tangan sekitar 85 persen lebih jarang dibanding di Fable 5. Request yang di-flag di Claude.ai/Code/Cowork secara default fallback ke Opus 4.8.

Untuk biologi, karena safeguard Opus 5 mirip Opus 4.8, model ini kini jadi opsi paling kapabel yang tersedia luas untuk riset ilmiah umum. Request biologi yang diblokir di Fable 5 kini diarahkan ke Opus 5, bukan lagi ke Opus 4.8.

Harga, Fast mode, dan update platform

Harga dasar Opus 5 sama dengan Opus 4.8: $5 / $25 per sejuta token (input/output). Fast mode berjalan sekitar 2,5× lebih cepat dengan harga dua kali lipat base price di Claude Platform, atau lewat usage credit di Claude Code.

Bersamaan dengan rilis ini, Anthropic juga membuka dua fitur beta:

  • Mid-conversation tool changes — tool yang tersedia bisa diubah di tengah percakapan tanpa merusak prompt cache.
  • Automatic fallbacks — request yang di-flag classifier di Opus 5 atau Fable 5 bisa otomatis dialihkan ke model lain, sehingga API tetap mengembalikan respons terbaik yang tersedia alih-alih diblokir.

Seperti Opus sebelumnya, Opus 5 tidak punya persyaratan data retention khusus untuk akses umum.

Apa artinya buat builder di Indonesia

Kalau kamu memilih model untuk coding agent, automation, atau knowledge work harian, Opus 5 masuk ke zona yang selama ini sulit: mendekati performa “tier Fable”, tanpa harus selalu membayar harga Fable. Itu relevan untuk tim yang sudah kelewat limit pada model frontier, atau yang ingin menaikkan kualitas agent tanpa menggandakan bill.

Yang tetap perlu diingat: angka benchmark berasal dari setup Anthropic dan partner early access. Hasil produksi tetap bergantung pada harness, tool, prompt, dan tingkat effort yang kamu pakai. Cara paling sehat adalah menguji ulang workflow kritis—debug, PR handoff, spreadsheet automation, computer use—dengan budget yang sama seperti model lama, lalu bandingkan kualitas plus biaya aktual.

Kesimpulan

Claude Opus 5 adalah upgrade generasi pada jalur Opus: lebih kuat di coding agentik dan knowledge work, lebih efisien di kurva biaya, serta diklaim lebih ter-align. Ia tidak menggantikan seluruh peta model Anthropic—Fable 5 dan Mythos 5 tetap punya peran di ujung kapabilitas—tetapi untuk pemakaian harian, Opus 5 kini jadi kandidat default yang paling masuk akal di ekosistem Claude.

Detail teknis, system card, dan grafik lengkap ada di anthropic.com/news/claude-opus-5.

# AI# Anthropic# Claude Opus 5# Benchmark# Harga API# Developer