OpenAI отложила свой внутренне называемый моделью Astra релиз 28 сентября, поставив «фронтирный» выпуск на паузу после того, как исследователи подняли вопросы безопасности в ходе тестирования.
Согласно The New York Times, это решение было принято в ту же неделю, когда группа ученых по ИИ, включая собственного главного научного сотрудника OpenAI, подписала доклад, предупреждавший о неконтролируемом «взрыве интеллекта». В ту же неделю ожидалось, что Дарьо Амодей из Anthropic и Марк Цукерберг из Meta будут на ланче в Белом доме по теме рисков, связанных с ИИ.
Три отдельных сигнала поднимают один неприятный вопрос: лаборатории находят проблемы перед релизом, которые их беспокоят, или же «concern» о безопасности стало отраслевым предпочитаемым эвфемизмом для модели, которая была не готова?
КДПВ
28 сентября OpenAI отложила модель, которую внутри называли Astra, сославшись на «вопросы безопасности», отмеченные исследователями; об этом сообщил New York Times, при этом не раскрывая, в чем именно заключались эти опасения.
Задержка совпала с совместно подписанным отчетом об «интеллектуальном взрыве» как риске с участием главного научного сотрудника OpenAI и с встречей в Белом доме по рискам ИИ в ту же неделю, на которой присутствовали руководство Anthropic и Meta.
Nvidia выпустила Open Agent Safety Platform в тот же новостной цикл, и более 100 компаний, включая Microsoft и Hugging Face, приняли ее в день запуска — по данным Washington Examiner.
По данным STAT, Anthropic раскрыла пять документированных случаев использования ее моделей так, что это могло поддерживать работу по биологическому оружию. Это усиливает аргумент о том, что задержки безопасности становятся стандартной практикой, а не исключениями.
Существует и скептический контрпример, и он не является маргинальным: по данным Capacity Media, один из инвесторов Anthropic публично утверждал, что лаборатории раздувают нарративы о рисках, чтобы оправдать регуляторный «ров».
Задержка Astra от OpenAI: восстановление событий
То, что OpenAI действительно сказал, было узким. Компания подтвердила, что не будет выпускать свою новейшую модель, которую несколько сообщений ссылались как на внутренний кодовый термин Astra, потому что внутренние исследователи выявили вопросы безопасности на этапе оценки до релиза, сообщила New York Times 28 сентября.
OpenAI отложил Astra, не уточнив, была ли проблема уязвимостью джейлбрейка; возможностью, которую модель демонстрировала, но которую ее классификаторы безопасности не смогли поймать; риском раскрытия данных; либо чем-то в поведении модели при использовании инструментов, что удивило собственную red team.
Эта тишина сама по себе и есть история. Frontier labs построили целый набор публично доступных механизмов безопасности — модельные карты, рамки готовности и партнерства по внешнему ред-тимингу — именно для того, чтобы, когда они задерживают что-то, могли указать на процесс. Но они не построили норму раскрывать, что именно стало причиной задержки.
Fathom не смог проверить из открытых источников, связано ли беспокойство по Astra с возможностями кибер-агрессии, усилением биологической или химической направленности, автономным поведением репликации, или чем-то более узким — вроде поверхности prompt-injection в агентном использовании. Если OpenAI не опубликовал дополнение к модельной карте или инцидент-репорт, любая характеристика базового изъяна будет спекуляцией.
Проверить можно то, что эта ситуация укладывается в понятный шаблон. Решение OpenAI отложить выпуск — не первая история, когда OpenAI «медленно шагает» с моделью, ссылаясь на внутренние опасения; и оно попадает в таймлайн fathom.news, который уже включает развертывание GPT-6 по новым правилам безопасности с двумя разными поименованными вариантами, а также слой памяти, поставленный для агентов в версии seven стека.
В сущности, компания поставляла frontier-возможности поэтапно, при этом удерживая как минимум один релиз в каждом цикле по причинам, которые она отказывается подробно раскрывать.
Также читайте: OpenAI начинает запуск GPT-6 SOL и Luna с новыми правилами безопасности
Почему язык «взрыва интеллекта» перешел из блога в отчет
В ту же неделю, что и задержка Astra, группа исследователей, включая главного научного сотрудника OpenAI среди соавторов, опубликовала отчет с предупреждением о перспективе неконтролируемого «взрыва интеллекта», согласно отчету Guardian от 28 сентября. Это заметная эскалация по степени выразительности.
«Взрыв интеллекта» — термин с конкретной технической родословной: он восходит к формулировке I.J. Good от 1965 года про рекурсивное самосовершенствование. Там система ИИ, способная улучшать собственную архитектуру, запускает петлю обратной связи, которая обгоняет человеческий надзор.
Еще недавно этот язык жил в основном в эссе про alignment-forum и в академических семинарах, а не в отчетах, несущих подпись действующего главного научного сотрудника компании, поставляющей коммерческие модели сотням миллионов пользователей.
То, что она мигрировала в публичный отчет, соавторированный несколькими сторонами, предполагает, что внутренняя дискуссия в frontier labs сместилась от «может ли это случиться когда-нибудь» к «как будут выглядеть ведущие индикаторы и начинаем ли мы видеть их». Материал-спутник от Foundation for American Innovation делает механизм более явным. Системы ИИ, утверждает он, теперь пишут большую часть кода внутри компаний, которые их создают.
Поскольку все больше исследований и разработок в области ИИ само автоматизируется, обратная связь, на которой держится гипотеза «взрыва», становится структурно проще для запуска — а не сложнее.
Анализ Fathom предполагает, что задержка Astra от OpenAI и отчет о «взрыве интеллекта» не являются формально связанными артефактами одного и того же внутреннего решения.
Но правдоподобно, что у них общая причина. Команды исследований внутри OpenAI могли найти что-то в недавних оценках моделей — в частности, что-то именно в Astra или в более широких трендах возможностей, — что сместило внутреннюю оценку риска настолько, чтобы привести и к отложенному выпуску, и к подписанному предупреждению в пределах одного и того же семидневного окна.
Методология
Этот материал опирается на первичные сообщения из New York Times — ее аккаунт от 28 сентября о решении OpenAI; освещение Guardian отчета о «взрыве интеллекта»; сообщения Politico о встрече в Белом доме по рискам ИИ; отчеты STAT о раскрытых Anthropic случаях биологического неправомерного использования; освещение Washington Examiner и CSO Online запуска Nvidia Open Agent Safety Platform; а также отчет Capacity Media о том, как инвесторы отреагировали pushback’ом на рисковую рамку, которую представляют лаборатории.
Также это опирается на прежние материалы fathom.news: о поэтапном запуске GPT-6 и о запуске платформы Nvidia — для связности.
Рассматриваемый период — примерно с 13 по 29 сентября 2026 года: временное окно между первым риск-эссе Anthropic и текущей датой публикации. Две вещи не удалось независимо верифицировать: конкретную техническую природу обеспокоенности по безопасности Astra, потому что OpenAI не публиковал модельную карту, инцидент-репорт или подробное заявление помимо подтверждения самой задержки.
И точное содержание пяти случаев биологического неправомерного использования, которые раскрыла Anthropic: потому что, как характеризует их собственное раскрытие Anthropic (по данным STAT), оно сделано суммарно, а не по каждому случаю отдельно.
Там, где этот материал делает выводы о мотиве или механизме, а не просто сообщает заявленный факт, это помечено словами «может», «возможно» или «правдоподобно». Поэтому решение OpenAI «отложить Astra» рассматривается как документированная задержка, а не как доказательство конкретного технического сбоя, который OpenAI не описывал.
Регуляторный фон изменился под всем этим
Ничто из этого не происходит в вакууме. Положения по управлению в главе V Акта ЕС об ИИ для моделей общего назначения вступили в принудительное исполнение 2 августа 2026 года — согласно цифровому офису Европейской комиссии. Этот сдвиг поставил Офис по ИИ и органы власти государств-членов в прямой надзорный контакт ровно с тем типом решения о выпуске на переднем крае, которое OpenAI только что принял.
Задержка модели, вызванная внутренними находками по безопасности, если бы это произошло с моделью, уже входящей в охват для развертывания в ЕС, теперь оказалась бы внутри текущих отношений, где есть регуляторная отчетность, а не чисто добровольная история.
Статья 50 Акта, посвященная обязательствам по прозрачности для синтетического контента и раскрытию конечным пользователям, вступила в силу в начале августа и уже меняет то, как HR и поставщики корпоративного ПО обрабатывают контент, сгенерированный ИИ, через границы — по данным HR Executive.
Путь соблюдения требований, который начался в феврале 2025 года, теперь полностью созрел в режим принудительного исполнения. Впервые этот режим пересекся во времени — в реальном времени — с внутренным вето на безопасность, которое принадлежит крупной лаборатории. Это по-разному важно: юридической ответственности меньше, потому что Astra так и не выпустили и, вероятно, она не породила обязанности по отчетности для ЕС, но как превью — это важно больше.
В следующий раз, когда OpenAI отложит модель из-за риска, отмеченного внутри компании, ему, возможно, не дадут принять это решение так тихо, как OpenAI принял буквально только что.
Встреча в Белом доме меняет политику, но не физику
Согласно отчету Politico от 28 сентября, Трамп и спикер Палаты представителей Майк Джонсон были запланированы на встречу с руководителями техкомпаний по рискам ИИ 29 сентября; ожидается, что за обедом на эту тему будут присутствовать и Цукерберг, и Амодей. Это та же неделя, что и отчет об отложенной Astra и «взрывe интеллекта».
Визуальная картинка не заметить трудно: самый ориентированный на безопасность CEO в отрасли сидит напротив администрации, которая — по крайней мере в политике экспортa чипов — демонстрировала предпочтение коммерческой скорости вместо предосторожности.
Сообщая о недавнем саммите Трампа и Си Цзиньпина, Ars Technica отметила, что по факту в политике экспорта ИИ почти ничего не изменилось — несмотря на заголовки саммита. Отдельно она подчеркнула растущую обеспокоенность тем, что влияние Nvidia на администрацию расширяется, даже несмотря на то, что продажи чипов в Китай продолжают сталкиваться с пристальным контролем.
Дженсен Хуанг заметно прямолинейно высказался о своей позиции по «апокалиптическому» фреймингу, который выходит из Anthropic: он сказал журналистам, что отрасли следует строить быстрее, а не замедляться из-за предупреждений об экзистенциальных рисках.
Также читайте: Дженсен Хуанг отвергает «апокалиптические» предупреждения Anthropic по ИИ и говорит: стройте быстрее
От этого встреча в Белом доме выглядит странно. Амодей приходит на разговор сразу после того, как компания только что раскрыла случаи неправомерного использования, близкие к биологическому оружию, а главный научный сотрудник OpenAI только что в соавторстве подписал предупреждение о «взрыве интеллекта». Хуанг, приглашен он или нет, — самый громкий голос отрасли, утверждающий, что все это преувеличено. Эти два процесса сходятся в одной и той же комнате в одну и ту же неделю, когда OpenAI отложил модель.
Запуск платформы безопасности Nvidia читается иначе в этом контексте
По данным Washington Examiner, Nvidia выпустила Open Agent Safety Platform для мониторинга и управления агентным ИИ 28 сентября, и в день запуска более 100 компаний, включая Microsoft и Hugging Face, внедрили ее. Материал CSO Online был более скептическим: он цитировал аналитиков, которые хвалили элементы контроля, при этом отмечая, что большинство проблем, генерируемых агентами, выходит за рамки реального охвата платформы.
Он отслеживает поведение агентa в рантайме, а не исходные веса базовой модели или обучающие данные, которые в первую очередь порождают это поведение. Решение OpenAI «отложить Astra» делает это различие более значимым. Платформа Nvidia адресует поведение агента в рантайме, а OpenAI не говорил, включает ли обеспокоенность по Astra агентную «поверхность», сбой классификатора, джейлбрейк, риск раскрытия данных или поведение модели, выявленное во время red-teaming.
Приход платформы также приходится на три недели спустя, когда fathom.news подробно осветил ее первоначальное объявление — в тот момент акцент делался прежде всего на «локдауне агентoв», а не на политике безопасности в масштабах отрасли. Платформа не изменилась. Неделя вокруг нее — это.
Также читайте: Nvidia запускает Open Agent Safety Platform, чтобы «закрыть» rogue AI агенты
Что на самом деле показывает раскрытие Anthropic о биологическом оружии
По данным отчета STAT от 28 сентября, Anthropic сообщила пять документированных случаев, когда люди пытались использовать ее модели для работы, которая могла бы поддерживать разработку биологического оружия. Это раскрытие было частью более широкой аргументации в материале: ИИ размывает барьеры, которые исторически делали компетенцию в биоуоружии редкой. Фрейминг STAT таков, что это не гипотетические упражнения red-team, а реальное неправомерное использование, пойманное в производственном трафике.
Новость о задержке Astra от OpenAI помещает эти пять случаев в более широкий вопрос о том, что именно раскрывают лаборатории после того, как внутренние или производственные защитные механизмы идентифицируют вызывающее обеспокоенность поведение. Пять случаев, публично раскрытых компанией, чья модель была целью, — это действительно необычный уровень прозрачности, и стоит отделять раскрытие от лежащего в основе риска.
Само раскрытие — это доказательство того, что классификатор и мониторинговый стек Anthropic улавливают хотя бы какую-то долю попыток неправомерного использования. Но чего оно не может нам сказать — Anthropic не публиковал ни долю ложных отрицаний, ни представление о том, сколько аналогичных попыток могло пройти незамеченными, — так это: пять — это большое число, маленькое число или просто то количество, которое оказалось достаточным, чтобы компания прошла собственный порог для публичного раскрытия.
Контраргумент о том, что само это раскрытие является разновидностью стратегической инфляции рисков, получает собственный раздел ниже, потому что ему нужен полноценный и справедливый разбор, а не пренебрежительное замечание здесь.
Контраргумент
Самый сильный аргумент против тезиса о том, что лаборатории действительно находят опасные вещи и ответственно отступают, идет прямо изнутри класса инвесторов в ИИ. Один инвестор Anthropic публично утверждал, что ИИ-компании раздувают нарративы о рисках именно для того, чтобы повлиять на политику в свою пользу — по данным Capacity Media.
Теория в том, что более жесткое регулирование закрепляет действующих игроков: их бюдже��ы на соблюдение требований и связи с правительством помогают пережить это, в то время как более мелких конкурентов с открытыми весами лишают «полосы разгона» для догоняющего рывка. Это не маргинальный аргумент, и с ним нельзя обращаться как с таковым.
Рассмотрим последовательность. Сообщается, что OpenAI, Anthropic и Google провели закулисные обсуждения идеи создать совместный орган стандартов по безопасности ИИ — об этом пишет Information. Эта инициатива продолжила оформляться в виде формального органа стандартов — об этом говорится в отдельном материале Information.
Совместный орган стандартов, задуманный тремя самыми хорошо финансируемыми лабораториями в мире, если станет шаблоном, который примут регуляторы, вполне мог бы выполнять роль «рва» так же, как и функцию защиты.
Затраты на соблюдение требований, которые для компании с обязательствами по вычислениям на сотни миллиардов относительно тривиальны, для стартапа на стадии Series B являются экзистенциальными. Если добавить к этим опросным данным, лишь около половины американцев хотят обязательных правил правительства для frontier-ИИ — согласно анализу ActiVote опросного окна в сентябре. Это означает, что собственная риск-риторика отрасли сейчас идет заметно впереди общественного спроса на вмешательство.
Если бы общество жаждало ограничений, фраза «лаборатории просят их регулировать» читалась бы как капитуляция перед демократическим давлением. Поскольку этого нет, тот же самый акт воспринимается скорее как постановка повестки: лаборатории выбирают собственных регуляторов, собственные определения и собственные пороги еще до того, как кто-то получит шанс написать их первым.
С этой точки зрения OpenAI «отложил Astra» не как доказательство пугающей внутренней находки, а как сигнал с низкой стоимостью: модель, которой никто вне компании не пользовался, — и которую сдержали, прикрывшись расплывчатой фразой «вопросы безопасности». Это не стоит OpenAI коммерчески ничего, но дает ему еще одну точку данных для следующего раза, когда он будет доказывать, в Вашингтоне или Брюсселе, что ему можно доверять саморегулирование, потому что, видите ли, мы уже и так это делаем.
Fathom не может вынести суждение между этими двумя прочтениями, опираясь лишь на публичные свидетельства. Оба варианта согласуются со всем, о чем сообщали на этой неделе. Честная позиция такова: задержка Astra реальна, ее причина не раскрыта, а мотив этой незагруженности извне установить невозможно.
Числа по вычислениям и капиталу за риторикой
Что бы ни двигало «театром безопасности» или «содержанием безопасности», капитал под этим продолжает накапливаться такими темпами, что любая единичная задержка модели выглядит небольшой. Goldman Sachs теперь прогнозирует около $7,6 трлн совокупных капитальных затрат на ИИ (capex) в период с 2026 по 2031 год — по сегментам вычислений, дата-центров и электроэнергии. Базовая модель фирмы подразумевает более $765 млрд в одном пиковом году, говорится в опубликованной модели отслеживания.
Отдельные оценки, ориентированные на hyperscaler-сегмент, ставят capex на 2026 год именно в диапазон около $630 млрд у крупнейших облачных провайдеров — это рост на 62% по сравнению с уже рекордными расходами 2025 года. Этот прогноз выглядит рядом с консенсусной оценкой S&P Global — $474 млрд для более узкого сегмента только hyperscalers, согласно трекинговому материалу отраслевой рассылки по дата-центрам, который упоминал консенсусную цифру.
Источник метрики Показатель Кумулятивный capex на ИИ, 2026–2031 ≈ $7,6 трлн Модель отслеживания Goldman Sachs Capex на ИИ в пиковый год, подразумеваемый базовой моделью ≈ $765 млрд Модель отслеживания Goldman Sachs Capex hyperscaler на 2026 год (широкая оценка) ≈ $630 млрд, +62% г/г Трекинг отраслевого бюллетеня по дата-центрам Capex hyperscaler на 2026 год (консенсус, более узкий охват) $474 млрд, +28% г/г Консенсус S&P Global через анализ LinkedIn Global datacenter capex до 2050 года до $31,6 трлн Данные PwC: прогноз по дата-центрам Сделки Anthropic по вычислениям за 11 месяцев $517 млрд The Information
По данным Reuters, Anthropic удалось за примерно одиннадцать месяцев заключить вычислительные сделки на $517 млрд — и, по сути, пришлось срочно выкраивать мощности у SpaceX, Google и других, чтобы удовлетворить спрос, который собственный рост выручки компании обгонял. Эта цифра идет рядом с собственным раскрытием Anthropic (отдельно освещенным Reuters) о том, что почти четверть ее $4,6 млрд выручки за предыдущий год приходилась всего на двух клиентов.
Этот риск концентрации становится еще важнее, если принять во внимание проспект IPO Anthropic, который изучил Reuters и который, как сообщалось через TradingView, описывает видение, в котором ИИ меняет глобальную экономику более глубоко, чем прежние технологии общего назначения.
Также читайте: Заявка на IPO показывает резкий рост затрат в ставке Anthropic на $2 трлл.
Ни одна из этих цифр капитала не является цифрами безопасности. Но они объясняют ставки, лежащие под каждым решением о задержке. Лаборатория, у которой обязательства по вычислениям исчисляются сотнями миллиардов, имеет подавляющий коммерческий стимул выпускать продукт — а значит, любая добровольная пауза, реальная или показная, становится дороже и потому интереснее для наблюдения. На этом коммерческом фоне и происходил «отложенный Astra» от OpenAI.
Рынок финансирования не останавливается ради дискуссии о безопасности кого бы то ни было
Пока OpenAI объяснял, почему он не будет выпускать модель, рынок финансирования вокруг него продолжал двигаться с темпом, который говорит о том, что инвесторы не собираются ждать, пока разрешится вопрос безопасности. Instinct, стартап-агент ИИ, привлек $1 млрд в раунде Series C 28 сентября, увеличив оценку в четыре раза до $10 млрд — по данным Reuters и подтверждено отдельно Bloomberg и TechCrunch.
AMD объявила в тот же день, что приобретет World Labs Фей-Фей Ли в сделке полностью акциями, оцениваемой в $8,2 млрд — ставку на то, что компания называет физическим ИИ, по данным Reuters. Ни одна из этих сделок не связана напрямую с задержкой Astra. Но обе приходят в один и тот же 24-часовой новостной цикл — и контраст показателен.
Финансовые рынки прямо сейчас оценивают frontier-ИИ агентов и физический-AI потенциал по рекордным мультипликаторам. При этом лаборатории, которые строят базовые фундаментальные модели, одновременно публично дают понять, что они недостаточно уверены в своих самых новых системах, чтобы выпустить их.
Обе эти вещи могут быть правдой одновременно. Их сосуществование, пожалуй, и есть ключевое напряжение нынешнего цикла ИИ — рынок не замедлился ни в одном квартале, а сам цикл находится на вершине технического прогресса, где OpenAI, как минимум, отложил как минимум одну крупную модель после того, как в ней обнаружилось нечто, к выпуску чего он не был готов.
Как выглядит принудительное исполнение на практике, когда оно начинается
На этой неделе не стояли на месте и регуляторы. По данным Consumer Financial Services Law Monitor, Конференция руководителей надзора за банковскими организациями штатов (Conference of State Bank Supervisors) 16 сентября выпустила новую рамку надзорного регулирования ИИ, чтобы помочь экзаменаторам в штатах оценивать использование ИИ в банках, работающих через лицензии в штатах, и в небанковских финансовых организациях. Этот документ предшествует задержке Astra на двенадцать дней.
Но это полезный индикатор того, насколько быстро надзор за ИИ в специализированной предметной области двигается в Соединенных Штатах — даже без всеобъемлющего федерального закона об ИИ. Надзорные органы банков не стали ждать Конгресс, чтобы написать собственные руководства по рискам модели.
Отдельно: согласно отчету GovTech, Коннектикут, как сообщается, оказался штатом, чей проект законодательства об ИИ, как утверждается, близко отслеживает то, что сами крупные компании ИИ говорят, что они хотят. Это подкрепляет уже заметный в отчетах Information по совместному органу стандартов паттерн: отрасль не сопротивляется регулированию в 2026 году — она пытается написать его.
Открытый вопрос — создают ли такие авторские формулировки правила, которые действительно поймают следующую внутреннюю находку уровня «отложенного Astra» от OpenAI, или же правила просто формализуют уже существующие добровольные практики отрасли, не добавляя им «зубов». Пока ни эта рамка, ни законопроект Коннектикута не отвечают на него.
Вывод
Следите за тремя вещами. Во-первых, будут ли OpenAI или любой внешний партнер по red-teaming в конечном итоге публиковать то, что именно сделал Astra неправильно — поскольку отсутствие такого раскрытия сейчас является самым большим провалом в публичной картине.
Во-вторых, вытекают ли из совместного органа по стандартам безопасности обязательные обязательства или же это добровольная рамка, на которую лаборатории могут ссылаться, не меняя поведения. В-третьих, станет ли законопроект Коннектикута по ИИ — или сопоставительная инициатива в другом штате — тем шаблоном, который регуляторы реально примут, с учетом сообщения GovTech о том, что они уже отслеживают, что говорят основные компании ИИ о том, чего они хотят.
Капитал продолжает накапливаться независимо от всего. Какая бы ни оказалась реальная проблема Astra, примерно $7,6 трлн запланированных расходов на инфраструктуру ИИ до 2031 года не ждут ответа. OpenAI отложила модель, но доступные публично доказательства все еще не устанавливают, что именно сделала эта модель, какой бенчмарк или оценка выявили проблему, и отражает ли задержка узкую проблему безопасности или более широкую озабоченность по возможностям.
Читайте дальше: Предупреждение о Rogue Agent — утечка 53 изображений через инструмент OpenAI, изменение федеральных сайтов