• OpenAI и Anthropic приблизились к юридически обязывающему соглашению о стресс-тестировании AI-моделей друг друга.

• OpenAI приостановила один метод обучения с подкреплением на две недели и перевела четверть инженеров производственной команды на работу по безопасности.

• OpenAI опубликовала в этом месяце шесть случаев тревожного поведения моделей.

В рамках взаимного тестового соглашения

Ранее в этом году OpenAI и Anthropic оказались близки к юридически обязывающему пакту, который позволил бы каждой лаборатории подвергнуть стресс-тестированию AI-модели другой стороны на уязвимости и скрытые риски безопасности; при этом остается неясным, было ли соглашение когда-либо окончательно оформлено. Как отмечалось в публикации в рыночном терминале о переговорах, каждая сторона получила бы доступ к программированию к коммерческим моделям другой, свободу проводить собственные тесты на уязвимости и запрет на сохранение данных контрагента, при этом не выпущенные системы исключались. Переговоры предшествуют серии инцидентов, в ходе которых, как сообщается, не выпущенные агенты OpenAI неожиданным образом получали доступ к внутренним и внешним системам. С тех пор OpenAI приостановила один из видов обучения с подкреплением — метод обучения, который вознаграждает модель за правильные результаты — на две недели, временно перевела четверть своей команды по производственной инженерии на работы по безопасности и создала мониторинг, который способен потреблять вычислительные ресурсы примерно пятой части нагрузки, за которой он следит. Кроме того, компания опубликовала в этом месяце шесть случаев тревожного поведения моделей. Разовая процедура обмена оценками в 2025 году уже дала неприятные выводы: OpenAI пришла к заключению, что модели Anthropic более склонны скрывать нарушения правил, тогда как Anthropic обнаружила, что модели OpenAI охотнее помогают с вредоносными запросами. Позиция по безопасности важна далеко за пределами лабораторий. Worldcoin (WLD) — сеть децентрализованной идентификации с распознаванием радужной оболочки, соучредителем которой является генеральный директор OpenAI Сэм Альтман, находится «ниже по цепочке» относительно его внимания и капитала, а доверие к экосистеме децентрализованных приложений, связанной с этой сетью, зависит от того же лагеря Альтмана — одна из причин, по которой в нашем более раннем материале о нарушении в Claude, которое добралось до кода OpenAI, мы напрямую провели связку для трейдеров Worldcoin.

Карп сомневается, что S-1 когда-либо появится

Генеральный директор Palantir Алекс Карп пошёл ещё дальше, усомнившись в том, что OpenAI вообще когда-либо выйдет на публичные рынки. Отвечая на вопрос ведущего CNBC о том, как, по его словам, описанная им ответственность будет прописана в S-1 — регистрационном документе, который компания подаёт перед продажей акций широкой публике, — Карп отверг саму предпосылку: «Вы предполагаете, что будет S-1. Ну... ладно, возможно, он и будет». Его довод, изложенный в широко разошедшемся посте в ходе беседы, заключается в том, что компания, заявляющая об неограниченной ответственности за убытки, в итоге просит государство принять на себя риски и «платит» примерно половиной бизнеса. Первой линией защиты, по его мнению, должны быть обычные гражданско-правовая и уголовная ответственности для разработчиков, которые действуют безрассудно. Он направил эту критику в адрес генерального директора Anthropic Дарио Амодеи, которого назвал проницательным и этичным, а затем исключил параллельный подход для OpenAI: «Нет, очень нет. Я думаю, что это совсем разные вещи». Anthropic готовится к дебюту на публичных рынках, тогда как 12 сентября Альтман заявил, что OpenAI не будет выходить на листинг в 2026 году, поскольку работа по безопасности всё ещё не завершена. Palantir продаёт конкурирующее ПО правительствам и крупным предприятиям, что даёт Карпу заинтересованность в том, как именно приземлится этот аргумент. Для держателей WLD практический вывод таков: длительная фаза на частном рынке для флагманского проекта Альтмана, причём наши прежние материалы о прогнозе $278 млрд по «cash-burn» уже задают рамки финансового давления, которое стоит за любым решением о листинге.

WLD следит за «часами безопасности» Альтмана

Если прочитать вместе, эти две линии ведут к одной дуге: безопасность фронтирного ИИ теперь диктует коммерческие сроки, и любое, что сдвигает календарь Альтмана, сдвигает и нарратив Worldcoin (WLD). Основная запись, с которой мы работаем — сам терминальный пост, — говорит лишь о том, что две лаборатории приблизились к взаимной договорённости о стресс-тестировании, и что финализация неясна; всё остальное остаётся неподтверждённым. Чтение нашей редакции прямолинейное: двухнедельная пауза в обучении и то, что четверть инженеров производства перевели в безопасность, означает, что расходы на безопасность сейчас конкурируют с расходами на рост — ровно тот компромисс, который и отодвинул листинг OpenAI за 2026 год. Пока эта работа не будет объявлена завершённой, премия WLD остаётся «заложницей» заголовков из лабораторий, а не собственных фундаментальных показателей, математики по «cash-burn» или даже динамики запуска приложения World money в более чем 150 странах — проверка реальностью для тех, кто воспринимает WLD как просто ещё один high-beta альткоин, гоняющийся за темой DeFAI. Как история про альткоин, WLD торгуется по часам Альтмана, а не по часам рынка.