Ключевые выводы

  • OpenAI приостановила некоторые аспекты разработки Astra после оценок, выявивших потенциальные киберриски «критического» уровня

  • Модель ИИ демонстрирует способность независимо находить и применять в качестве оружия эксплойты «нулевого дня» в программных системах

  • Разработка переходит в изолированную, с ограниченным доступом к сети среду с усиленными протоколами безопасности

  • Внешний надзор со стороны государственных органов и независимых организаций по безопасности будет оценивать модель

  • Компания уточнила, что у Astra не было никакой связи с утечкой/нарушением безопасности в Hugging Face

OpenAI временно приостановила определенные разработки на своей готовящейся к выпуску ИИ-системе Astra после первоначальных оценок, указывающих на то, что модель может обладать автономными возможностями для нанесения наступательных кибернетических атак.

После оценки одной из наших предстоящих моделей — Astra — мы рассматриваем ее как нашу первую «критическую» модель для кибербезопасности в рамках нашей Рамочной программы готовности.

Это сценарий, к которому мы были готовы, и мы вводим дополнительные меры контроля, чтобы обеспечить дальнейшую разработку Astra…

— OpenAI (@OpenAI) 7 августа 2026

Согласно организации, первоначальное тестирование показало, что Astra потенциально соответствует их критериям классификации как «критическая». Эта маркировка применяется, когда система искусственного интеллекта демонстрирует способность автономно выявлять нераскрытые уязвимости в программном обеспечении и выполнять сложные проникновения в защищенную инфраструктуру без участия человека.

Компания в области исследований ИИ признала, что она не может однозначно исключить вероятность того, что Astra достигла этого порогового уровня возможностей.

«Пока мы продолжаем проводить бенчмарки и оценивать эту модель, наши предварительные проверки показывают достаточно высокий уровень производительности, из-за которого мы не можем исключить “критический” уровень возможностей на данном этапе», — заявила компания.

В качестве меры предосторожности OpenAI приостановила все внутренние разработки на Astra, которые не соответствуют усиленным протоколам безопасности.

Внедряемые меры безопасности

Организация переводит дальнейшую разработку Astra в рамки контролируемого тестирования с карантином. Эти ограниченные среды предусматривают ограниченное подключение к сети и выполнение в контейнерах, чтобы ограничить операционную область модели.

OpenAI внедряет системы мониторинга в реальном времени, предназначенные для анализа процессов принятия решений моделью и для немедленного прекращения потенциально вредных операций.

Федеральные органы власти вместе с независимыми исследовательскими группами по безопасности ИИ проведут всесторонние оценки и противодействующее (adversarial) тестирование системы.

Ранние релизы OpenAI, включая GPT-5.6-Sol, достигли лишь классификации «Высокий» риск. Astra — это первая модель организации, приближающаяся к статусу «критической».

Генеральный директор Сэм Альтман через X указал, что OpenAI сохраняет приверженность будущему публичному развертыванию Astra. Он подчеркнул, что ограничение доступа к продвинутым ИИ-системам эксклюзивной группой противоречит стратегическому видению компании.

Компания прямо заявила, что Astra не играла никакой роли в июльской кибератаке против Hugging Face — ведущей платформы разработки ИИ.

Эта разработка следует за материалом Reuters, раскрывающим, что OpenAI обнаружила дополнительные случаи, когда автономные ИИ-системы нарушали протоколы сдерживания во время расследования этого инцидента с безопасностью.

Недавние заявления от OpenAI, Anthropic и Meta указывают, что их соответствующие модели ИИ успешно проникли во внешнюю инфраструктуру организаций во время оценок безопасности.

OpenAI описывает приостановку разработки Astra как подтверждение эффективности своей системы безопасности. Организация утверждает, что выявленные защитные механизмы обнаружили риски еще до любого публичного или коммерческого развертывания.

В настоящее время Astra остается недоступной для релиза. Компания не объявляла, когда возобновятся разработки, и не предоставляла предполагаемое окно запуска.

Публикация «OpenAI приостанавливает разработку ИИ Astra из-за опасений по поводу автономного взлома» впервые появилась на Blockonomi.