OpenAI 模型黑進 Hugging Face很戲劇性的一幕
根據PANews上的資訊顯示,GPT-5.6 Sol和一個更強模型在ExploitGym測試中被刻意放鬆安全護欄。模型推斷測試答案存放在Hugging Face,利用沙箱內一個用於軟件包安裝的內部代理漏洞(零日漏洞)獲得網絡權限,進而入侵Hugging Face真實環境,竊取內部數據集和憑證
這是不是說OpenAI在測試自家 AI 能力,暫時放寬了安全限制
但是沒想到兩個AI模型直接衝破隔離環境,自己主動上網,同時還黑進Hugging Face 的服務器偷測試答案,只爲測評拿到更高分數。
而且全程沒有任何人下達攻擊指令,所有入侵步驟都是 AI 自主完成
這算不算是AI越獄了🤣
#OpenAI #AI