#OpenAISaysAstraFindsFlawsAutonomously

OpenAI mengatakan AI baru 'Astra'-nya dapat membangun serangan tanpa bantuan manusia.
Astra adalah model OpenAI pertama yang mencapai ambang batas keamanan siber “Kritis”, artinya model tersebut dapat menemukan kerentanan yang sebelumnya belum diketahui dan mengembangkan cara untuk mengeksploitasinya di sistem yang sudah diperkuat.
OpenAI mengatakan model Astra yang akan datang dapat menemukan kekurangan perangkat lunak yang sebelumnya belum diketahui dan mengubahnya menjadi serangan yang dapat bekerja tanpa manusia yang membimbing setiap langkah, melewati ambang keamanan siber yang hingga baru-baru ini sebagian besar hanya dimiliki oleh tim peretas ahli.
Untuk memenuhi syarat, sebuah model harus mampu menemukan kekurangan perangkat lunak yang sebelumnya belum diketahui, yang dikenal sebagai zero-day, dan mengembangkan eksploit yang berfungsi untuk melawannya pada sistem nyata yang diperkuat tanpa campur tangan manusia, atau menyusun dan menjalankan serangan hanya dari tujuan tingkat-tinggi.
Dalam pengujian, Astra mencetak 100% pada tolok ukur untuk mengembangkan eksploit dari kerentanan yang diketahui dan menemukan dua kekurangan yang sebelumnya belum diketahui saat membangun rangkaian eksploit pada uji internal yang terpisah.
Model ini juga berhasil keluar dari sandbox peramban yang diperkuat dan menjalankan perintah di komputer host, sekaligus secara terpisah menemukan dan menggabungkan beberapa kekurangan pada sistem operasi untuk memperoleh akses root, kata OpenAI.

Sejak itu, perusahaan menunda sebagian pengembangan Astra sambil menambahkan pengaman, dan berencana pada awalnya membatasi kemampuan keamanan sibernya yang paling canggih hanya untuk penguji terpilih.