SAN FRANCISCO, JOURNALARTA.COM – Anthropic secara mengejutkan merilis Claude Opus 5.5 pada Selasa, 22 September 2026. Model terbaru ini langsung menduduki peringkat teratas di berbagai benchmark AI, khususnya dalam kemampuan coding, dan dibanderol dengan harga yang jauh lebih kompetitif.
Rilis ini merupakan langkah signifikan bagi Anthropic, menyusul seruan CEO Dario Amodei untuk ‘memperlambat laju pengembangan AI demi keamanan’. Namun, hasil yang dicapai Opus 5.5 justru menunjukkan lompatan performa yang menempatkannya sebagai pemimpin baru di pasar.
Performa Fable 5.1 dengan Harga Opus
Claude Opus 5.5 hadir dengan performa setara dengan model Fable 5.1, namun dengan skema harga yang jauh lebih terjangkau, mirip dengan lini Opus sebelumnya. Model ini telah tersedia melalui API ID claude-opus-5-5 di platform Anthropic, AWS Bedrock, Google Vertex AI, dan Azure.
Anthropic memangkas harga input hingga 40%. Harga input turun menjadi $4 per 1 juta token, dari sebelumnya $5 di Opus 5. Harga output juga disesuaikan menjadi $20 per 1 juta token dari $25. Penurunan paling drastis terlihat pada biaya cache read yang anjlok 60% menjadi $0.20 per 1 juta token. Penurunan ini krusial untuk aplikasi coding berbasis agen yang memerlukan pembacaan ulang konteks berulang kali.
Selain lebih hemat, Opus 5.5 juga menawarkan kecepatan output 30% lebih cepat dibandingkan Opus 5. Untuk pekerjaan standar, efisiensi biayanya mencapai 40% lebih murah pada pengaturan default. Pengguna Pro, Max, dan Team akan menikmati peningkatan batas penggunaan 5 jam serta fitur reset batas laju yang dapat disimpan.
Benchmark Unggul, Kalahkan GPT-6 Astra
Data benchmark menunjukkan dominasi Claude Opus 5.5 di beberapa metrik kunci:
- Artificial Analysis Intelligence Index: Mencapai skor 58, menempatkannya di peringkat 1 dunia. Skor ini melampaui Fable 5.1 (53) dan GPT-6 Astra (53) sebanyak 5 poin.
- Terminal-Bench 4.0 (agentic coding): Meraih 66.4%, jauh di atas Fable 5.1 yang hanya 55.8%.
- Migrasi Kode: Mampu memigrasi 680.000 baris kode dalam waktu kurang dari satu hari, sebuah tugas yang diklaim tester internal biasanya membutuhkan berminggu-minggu. Dalam uji migrasi HAProxy C ke Rust, Opus 5.5 menyelesaikan pekerjaan dalam 9.5 jam dengan biaya 51% lebih murah dari Fable 5.1 yang butuh 12 jam, dan kedua hasil ini lulus hampir semua tes regresi.
Meski unggul, Opus 5.5 memiliki satu kekurangan signifikan: konsumsi token yang boros. Dalam uji GDPval-AA (44 pekerjaan profesional), meskipun mencapai skor tertinggi, Opus 5.5 menghabiskan 119.000 token per tugas, jauh lebih banyak dibandingkan GPT-6 Astra yang hanya 17.000 token. Ini berarti, meskipun harga per token lebih murah, total biaya untuk tugas-tugas panjang bisa setara dengan model kompetitor.
Fitur Keamanan Terketat
Anthropic menegaskan bahwa Opus 5.5 adalah model dengan skor keamanan terbaik yang pernah mereka rilis. Dinyatakan bahwa probabilitas upaya bypass berkurang 85%, dan dalam 2.000 skenario audit, model ini menunjukkan paling sedikit tindakan yang sulit dibatalkan.
Untuk tugas-tugas siber berbahaya, sistem secara otomatis mengarahkan ke Opus 4.8. Sementara itu, untuk konteks biologi, diterapkan batas kelas Fable yang dikombinasikan dengan Verifikasi Ilmu Hayati bagi organisasi terverifikasi. Selain itu, ada fitur watermarking untuk mematuhi EU AI Act dan mencegah ‘distillation thinking’. Model ini telah diuji secara eksternal oleh METR dan Frontier Design sebelum diluncurkan ke publik.
| Model | Intelligence Index | Terminal-Bench | Harga Input (per 1 juta token) |
|---|---|---|---|
| Opus 5.5 | 58 (No.1) | 66.4% | $4 |
| Fable 5.1 | 53 | 55.8% | Lebih mahal |
| GPT-6 Astra | 53 | ~57% | – |
| Opus 5 | ~50 | – | $5 |
Dengan semua pembaruan ini, Claude Opus 5.5 menjadi pilihan menarik bagi pengembang yang membutuhkan kecerdasan setara Fable tetapi dengan anggaran Opus. Bagi tim yang mengerjakan coding berbasis agen, migrasi codebase besar, atau pekerjaan pengetahuan yang intensif, model ini merupakan opsi paling berharga di September 2026.

📝 Tinggalkan Komentar
Komentar sebagai . Ditinjau admin sebelum tampil.