⚡️ ОБНОВЛЕНИЕ ОТ ИИ: Кибербезопасностный бенчмарк, который год назад ставил в тупик каждую модель ИИ, теперь раскрыли настежь — и последствия режут в обе стороны.
CyberGym тестирует кое-что конкретное: может ли ИИ-агент прочитать описание уязвимости и реальную кодовую базу, а затем сгенерировать рабочий proof-of-concept-код, который действительно вызывает баг? Никаких рассуждений про безопасность. Делаем безопасность.
Бенчмарк основан на 1 507 реальных исторических уязвимостях из 188 проектов ПО — без игрушечных примеров и без упрощённых тестовых кейсов.
Когда исследователи впервые запустили этот бенчмарк, даже лучшее из доступных сочетаний ИИ и агента смогло «взломать» его лишь примерно в 20% случаев. Исследователи по безопасности восприняли это как обнадёживающий знак: автономная эксплуатация по-прежнему была в основном недостижима.
Эта уверенность исчезла. Новейшие специализированные модели сейчас дают успех 80%+ на том же бенчмарке — четырёхкратный скачок примерно за год.
Серьёзнее становится даже то, что это не просто поиск известных багов по шаблонам. В открытых тестах без каких-либо предварительных знаний о том, что сломано, те же агентные настройки независимо обнаруживали подтверждённые уязвимости zero-day — уязвимости, о которых никто не знал, пока ИИ не нашёл их.
Вот самая неприятная часть этого графика. Та же самая способность, которая позволяет агенту ИИ защитника найти и закрыть дыру до того, как туда доберутся атакующие, — это способность агента ИИ атакующего найти ту же самую дыру первой.
Атака и оборона теперь мчатся друг против друга на одинаковой инфраструктуре.
#AI #Cybersecurity #GPT5 #Claude #DeepSeek