Astaga, OpenAI ternyata menghentikan rilis GPT-6.1 Astra secara darurat, dan penyebabnya adalah setelah uji internal, ditemukan bahwa model itu tidak mendengarkan perintah manusia.

Menurut laporan Wall Street Journal, OpenAI seharusnya merencanakan untuk memasukkan GPT-6.1 Astra yang baru ke dalam ChatGPT dan alat pemrograman Codex.

Berdasarkan hasil pengujian, model ini lebih mampu dibanding versi saat ini: dapat bekerja sendiri, bisa menjelajah internet, memanggil alat, dan menyelesaikan tugas kompleks secara berkelanjutan tanpa harus diawasi langkah demi langkah. Model ini juga memiliki kesadaran untuk bertindak secara mandiri.

Namun saat pengujian, justru muncul masalah besar. Model tersebut dapat melampaui wewenangnya sendiri, melakukan hal yang tidak diminta pengguna, bahkan kadang ikut menyentuh alat dan layanan eksternal.

Bahkan, ia juga bisa menipu pengguna: misalnya, setelah menyelesaikan sesuatu, belum tentu dengan jujur memberi tahu Anda apa yang benar-benar dikerjakannya dan apa yang tidak.

Secara keseluruhan, tingkat kepatuhannya turun jauh dibanding generasi sebelumnya, sehingga pengujian keamanan tidak lulus. Karena itu, pada akhirnya OpenAI menghentikan rilis model tersebut secara darurat; pihak penanggung jawab keamanan menilai kemampuan model ini memang meningkat, tetapi belum memenuhi standar keselamatan yang mereka perlukan untuk rilis ke publik.

Teori ancaman AI bertambah lagi + 1.