Pada 22 September, Anthropic merilis Claude Opus 5.5 dan menurunkan harga penggunaan model. Yang patut ditanyakan adalah: jika ingin membuat model memproses satu kali migrasi kode berskala besar, apakah penurunan harga dapat mengubahnya dari “mencoba beberapa langkah saja” menjadi “mengerjakan tugas lengkap”? Jawaban tidak boleh hanya dilihat dari harga sekali kali tanya, tetapi juga perlu mempertimbangkan apakah model dapat menyelesaikan tugas, serta berapa waktu dan biaya yang diperlukan untuk pengecekan, perbaikan, dan percobaan ulang.
[Hitung seluruh tugas terlebih dahulu, bukan hanya sekali pemanggilan]
Harga API standar Opus 5.5 adalah 4 dolar AS per sejuta token input dan 20 dolar AS per sejuta token output; sebelumnya Opus 5 masing-masing 5 dolar AS dan 25 dolar AS, dengan penurunan sebesar 20% dengan standar yang sama. Jika dalam pekerjaan berulang kali membaca konteks yang dapat digunakan kembali, harga pembacaan cache juga akan memengaruhi tagihan: Opus 5.5 sebesar 0,20 dolar AS per sejuta token, Opus 5 sebesar 0,50 dolar AS.
Migrasi kode mungkin memerlukan model untuk membaca kode yang ada, mengajukan perbaikan, menghasilkan modifikasi, lalu menyesuaikan kembali berdasarkan hasil pengecekan. Tugas seperti ini akan terus mengonsumsi token input dan output, dan juga mungkin menggunakan konteks yang sama berulang kali. Apakah caching dapat menghemat biaya bergantung pada apakah tugas tersebut memanfaatkan caching dan berapa banyak yang berhasil mendapatkan cache; penurunan harga satuan juga tidak berarti tagihan akhir turun dengan proporsi yang sama.
Anthropic mengatakan bahwa, dalam tugas-tugas tipikal yang diuji dengan pengaturan defaultnya, biaya Opus 5.5 lebih rendah 40% dibanding Opus 5, dengan kecepatan output lebih dari 30%. Kedua metrik ini merupakan hasil pengujian dari pihak vendor yang mencerminkan tugas dan pengaturan tertentu; metrik tersebut tidak bisa langsung diterapkan pada tagihan dan durasi pengerjaan setiap tim.
【Cara kerja kemungkinan akan berubah seperti apa】
Contoh uji awal yang diungkap oleh Anthropic mencakup migrasi kode skala besar. Ini memberi petunjuk kemungkinan perubahan: ketika biaya menjalankan dan waktu menunggu menurun, pengguna dapat membiarkan model memproses lebih banyak langkah secara berurutan, lalu manusia memeriksa hasilnya dan menangani pengecualian. Namun, contoh kasus tersebut sendiri tidak dapat membuktikan bahwa proyek sejenis dapat selesai dengan lancar, apalagi hanya berdasarkan fakta bahwa kode dihasilkan lalu dianggap migrasi berhasil.
Opus 5.5 kini sudah tersedia melalui Claude dan platform layanan cloud. Untuk menilai apakah itu bernilai untuk suatu pekerjaan, pilih tugas yang memiliki standar penyelesaian yang jelas, catat kualitas akhir, total waktu yang diperlukan, jumlah input dan output, cache yang berhasil ter-hitam, serta jumlah percobaan ulang, lalu hitung biaya untuk seluruh tugas tersebut. Untuk tugas yang panjang, yang benar-benar layak dibandingkan bukan seberapa cepat model menjawab, melainkan seberapa besar upaya yang dibutuhkan untuk mencapai hasil yang dapat digunakan.