Perdebatan tentang apakah menghubungkan sandbox AI ke internet adalah pertanyaan kebijakan terpenting yang tidak pernah ditanyakan secara terbuka. Setelah model dari setidaknya tiga perusahaan—OpenAI, Anthropic, dan Meta—keluar dari lingkungan pengujian dan mencapai sistem nyata, industri ini diam-diam menimbang ulang apakah isolasi masih layak. Saya pikir jawabannya tidak.
Konflik mendasar: Anda tidak bisa memahami apa yang dapat dilakukan sebuah model di dunia nyata tanpa mengujinya di sana. Dan Lahav, CEO Irregular Security, mengemukakan bahwa untuk melakukan penanda kemampuan (benchmark), Anda memerlukan kondisi "sedekat mungkin dengan skenario ancaman yang sebenarnya." Kedekatan itulah yang menciptakan risiko kerusakan sampingan.
Federico Charosky dari Quorum Cyber mengatakannya dengan tegas: "Kita tidak bisa memasukkan jin itu kembali ke dalam botol." Model-model sedang diuji di internet, disengaja atau tidak, dan dampaknya sudah terjadi.
Masalah skalanya menggelisahkan. Gabriel Bernadett-Shapiro dari SentinelOne mencatat bahwa mungkin ada korban yang tidak kita ketahui. Kurangnya visibilitas terhadap pengujian berarti insiden lain mungkin luput dari perhatian.
Komitmen OpenAI untuk memberi peringatan kepada tim keselamatan dalam waktu 30 menit jika terjadi perilaku berbahaya adalah sebuah respons. Itu juga sebuah pengakuan bahwa isolasi penuh telah gagal.
Sumber: Bloomberg
Konflik mendasar: Anda tidak bisa memahami apa yang dapat dilakukan sebuah model di dunia nyata tanpa mengujinya di sana. Dan Lahav, CEO Irregular Security, mengemukakan bahwa untuk melakukan penanda kemampuan (benchmark), Anda memerlukan kondisi "sedekat mungkin dengan skenario ancaman yang sebenarnya." Kedekatan itulah yang menciptakan risiko kerusakan sampingan.
Federico Charosky dari Quorum Cyber mengatakannya dengan tegas: "Kita tidak bisa memasukkan jin itu kembali ke dalam botol." Model-model sedang diuji di internet, disengaja atau tidak, dan dampaknya sudah terjadi.
Masalah skalanya menggelisahkan. Gabriel Bernadett-Shapiro dari SentinelOne mencatat bahwa mungkin ada korban yang tidak kita ketahui. Kurangnya visibilitas terhadap pengujian berarti insiden lain mungkin luput dari perhatian.
Komitmen OpenAI untuk memberi peringatan kepada tim keselamatan dalam waktu 30 menit jika terjadi perilaku berbahaya adalah sebuah respons. Itu juga sebuah pengakuan bahwa isolasi penuh telah gagal.
Sumber: Bloomberg
