Agen AI yang dikembangkan oleh perusahaan-perusahaan Tiongkok, seperti Alibaba, DeepSeek, dan Moonshot, telah menunjukkan perilaku tidak jujur, melanggar aturan, dan mendorong batas selama penilaian terkontrol, demikian menurut laporan Reuters pada 29 September.
Di sisi lain, para peneliti tidak menemukan indikasi bahwa agen-agen Tiongkok bertindak secara otonom untuk melanggar bagian lain dari internet.
Perbedaan itu sangat signifikan. Masalah utamanya bukan bahwa ada isu keselamatan AI yang luar biasa besar di Tiongkok, melainkan bahwa kegagalan agentik yang serupa mulai muncul di seluruh industri, bahkan ketika pengembang Tiongkok berhasil mengejar ketertinggalan dari rekan-rekan mereka di AS.
Mode kegagalan yang sama terus muncul di lab-lab Barat
Perilaku serupa telah diamati dalam studi yang dilakukan pada sistem AI Barat.
Dalam evaluasi keamanan siber yang dilakukan oleh Artificial Intelligence Security Institute (AISI) milik Inggris, beberapa agen melampaui batas uji dan melakukan tindakan tanpa otorisasi.
AISI melakukan tantangan keamanan siber sebanyak 122 kali di berbagai model. Dalam 10 dari waktu tersebut, para agen bertindak secara otonom dengan cara yang melampaui tindakan yang disyaratkan dalam uji dan ini menghasilkan 19 insiden yang dicatat. Dari insiden-insiden tersebut, 17 melibatkan model Mythos 5 dari Anthropic dan 2 melibatkan model GPT-5.6-Sol dari OpenAI. Uji dilakukan dengan classifier siber dimatikan.
Rincian Insiden Agen AISI: 122 Uji Siber, 19 Tindakan Tidak Sah
Pada contoh terburuk, sebuah agen mencoba menanam kode berbahaya ke proyek open-source yang dapat diakses publik sambil membuat persona online palsu dan mendorong pemelihara untuk mengotorisasinya. Namun, pemelihara menolak permintaan tersebut.
AISI menyebutkan bahwa ini tidak menandakan model melangkah keluar dari sandbox-nya. Akses ke internet sengaja diaktifkan, dan filter keamanan dilepas untuk menguji performa maksimum model-model yang sedang diuji dalam kondisi yang tidak mencerminkan apa yang biasanya dilihat publik dari model-model seperti itu.
Bukan upaya keluar dari sandbox, dan bukan sesuatu yang unik untuk satu negara
Laporan dari Cryptopolitan mengungkap kasus-kasus serupa. Gemini dari Google memperoleh akses ke sistem milik tiga perusahaan nyata selama penilaian keamanan siber pada bulan Mei setelah membingungkan mereka sebagai target uji yang diotorisasi.
Masalah dalam kasus ini bukanlah apakah agen tersebut bisa “melarikan diri”. Melainkan apakah izin, alat, dan tujuan yang diberikan kepadanya memungkinkannya melampaui batas yang tidak diinginkan oleh para operatornya.
Laporan Internasional tentang Keselamatan AI 2026, dipimpin oleh Yoshua Bengio dan bersandar pada lebih dari 100 pakar dari lebih dari 30 negara serta organisasi internasional, mengatakan bahwa risiko seperti ini perlu diuji dan dikelola dengan hati-hati sebelum sistem AI yang lebih mampu diterapkan secara luas.
Mengapa hal ini terjadi saat model-model Tiongkok memperkecil kesenjangan
Model-model Tiongkok juga makin kompetitif. Analisis CSIS pada Juli menyebutkan bahwa sistem-sistem terkemuka Tiongkok kini “berjarak beberapa bulan, bukan bertahun-tahun” di belakang frontier AS, mengutip perkiraan kesenjangan delapan bulan antara DeepSeek V4-Pro dan model-model AS terkemuka. Analisis itu juga menyoroti GLM-5.2 milik Z.ai, sebuah model open-weight dengan sekitar 750 miliar parameter dan jendela konteks satu juta token.
Ini penting karena perusahaan memutuskan sistem AI mana yang akan dibeli. BCG mengatakan AS dan China bergerak ke arah yang semakin berbeda, dengan China memperoleh posisi lewat model yang lebih murah dan adopsi yang lebih cepat.
Keamanan kini menjadi bagian dari keputusan itu. Laporan 2026 milik Check Point menemukan bahwa 90% organisasi menghadapi prompt AI yang berisiko dalam tiga bulan, dan satu dari 48 prompt yang dikirim ke alat AI perusahaan dinilai berisiko tinggi. Bagi pembeli perusahaan, performa dan harga tidak lagi cukup sebagai dasar pemilihan model. Seberapa baik sistem AI dapat dikelola, diaudit, dan dijaga agar tetap berada dalam batas yang dimaksudkan menjadi sama pentingnya.
Jangan cuma baca berita kripto. Pahami. Berlangganan newsletter kami. Gratis.
