Pada benchmark coding, Opus 5.5 mencatatkan skor 66,4% di Terminal Bench 4.0, 54,4% di FrontierCode v1.1, dan 67,7% di HLE with tools (naik 10,5 poin di atas GPT-6 Astra). Bahkan, di OSWorld 2.0, model ini meraih 81,8%.
Aplikasi Claude.ai Kini 3x Lebih Cepat
Tidak hanya model AI-nya, aplikasi Claude.ai juga mendapatkan perombakan besar, menjadikannya 3,1 kali lebih cepat secara rata-rata. Tim Anthropic menghabiskan dua minggu pada bulan Agustus 2026, dengan 3.000 perubahan melalui Slack dan 150 thread paralel, dibantu oleh model riset Claude sendiri untuk mengidentifikasi bottleneck, membuat benchmark, dan melakukan deployment.
Peningkatan kecepatan ini terlihat pada berbagai aspek:
- Waktu muat halaman web berkurang dari 3,1 detik menjadi 0,55 detik.
- Membuka percakapan dari 1,56 detik menjadi 0,65 detik.
- Memulai obrolan desktop dari 460 milidetik menjadi 224 milidetik.
- Sesi cloud dari 2,6 detik menjadi 0,73 detik.
Salah satu perbaikan signifikan adalah penghapusan jeda 1 detik akibat syntax highlighting em dash (—), dengan menghindari penggunaan regex V8 UTF-16 yang lambat. Proses rollout dilakukan dengan 200 feature flag tanpa insiden pelanggan.
Fitur Baru Terintegrasi: Docs, Slides, dan Design
Mulai minggu ini, secara bertahap untuk pengguna Pro dan Max, Claude memperkenalkan fitur baru yang mengintegrasikan pembuatan dokumen, presentasi, dan desain visual dalam satu percakapan. Claude Docs dan Claude Slides (Beta) memungkinkan pengguna membuat dokumen dan presentasi yang dapat diekspor ke Google Docs, Word, PowerPoint, atau PDF. Claude Design juga kini terintegrasi langsung ke antarmuka utama, menghilangkan kebutuhan untuk beralih antara berbagai alat. Ini mirip dengan fungsi ChatGPT Work yang diperkenalkan Juli 2026.
Fitur-fitur baru ini menargetkan pasar enterprise, di mana 80% bisnis Anthropic berasal dari perusahaan-perusahaan besar seperti Salesforce, Databricks, Goldman Sachs, dan Novo Nordisk, bersaing langsung dengan OpenAI.
Kekurangan: Konsumsi Token yang Boros
Meskipun memiliki banyak keunggulan, Claude Opus 5.5 juga memiliki kekurangan. Model ini cenderung boros token, dengan rata-rata 119.000 token per tugas. Bandingkan dengan GPT-6 Astra xhigh yang hanya membutuhkan 17.000 token untuk tugas serupa. Artinya, meskipun harga per token Opus 5.5 lebih murah, biaya riil untuk tugas-tugas yang panjang bisa tetap tinggi.
Untuk mencoba Claude Opus 5.5 dan Sonnet 5.5, pengguna dapat mengunjungi claude.ai, masuk, dan memilih model yang diinginkan dari dropdown. Bagi pengembang, API tersedia dengan harga $4/$20 per juta token untuk Opus 5.5 dan $2/$10 per juta token untuk Sonnet 5.5. Versi Haiku 5.5 untuk volume tinggi dan cepat dijadwalkan akan rilis minggu depan. Lydia Hallie, seorang Staff Engineer, berkomentar di X pada 22 September 2026, “Opus 5.5 sudah tiba! Rasanya seperti Fable, tapi ~30% lebih cepat dan ~40% lebih murah per tugas dibanding Opus 5.”

📝 Tinggalkan Komentar
Komentar sebagai . Ditinjau admin sebelum tampil.