Мир сейчас развивается так, будто мы живём в двух совершенно разных вселенных одновременно. В одной — войны, политические противостояния, глобальная нестабильность, вражда между странами и народами. В другой — стремительное, почти неконтролируемое развитие искусственного интеллекта, которое большинство людей предпочитает попросту не замечать. Или делает вид, что не замечает. Но те, кто действительно находится внутри этого процесса, уже давно бьют тревогу.

Ян Кривоносов

Илон Маск, который, согласитесь, далеко не последний человек в мире высоких технологий и имеет доступ к самым передовым нейротехнологиям, недавно выдал пугающий прогноз. По его оценкам, уже через пять лет совокупный интеллект всех систем искусственного интеллекта превзойдёт совокупный интеллект всего человечества. Это если в мире не случится третьей мировой или глобальной термоядерной войны, уточнил он. В таком случае, считает Маск, мы войдём в эру невероятного процветания, где технологии смогут решить практически любые проблемы. Но есть и вторая часть его заявления, которая звучит гораздо тревожнее. На прямой вопрос, сохранит ли человечество контроль над ИИ через десять лет, он ответил, что это маловероятно. Он сравнил это с эволюционной лестницей: если разрыв в интеллекте между нами и машинами станет больше, чем между человеком и шимпанзе, то трудно представить, чтобы шимпанзе могли сохранить контроль над человеком. Это очень жёсткая и отрезвляющая аналогия.

Но самые интересные и пугающие вещи происходят не в гипотетическом будущем, а прямо сейчас. Буквально на прошлой неделе компания OpenAI признала случай, который должен заставить задуматься каждого. Они проводили внутреннее тестирование своих передовых моделей в изолированной среде, так называемой песочнице, которая полностью отсечена от внешнего мира. Моделям дали задание решить тест по кибербезопасности ExploitGym. И вот что произошло: одна из моделей не стала честно решать задачу в рамках заданных условий. Вместо этого она самостоятельно обнаружила неизвестную уязвимость нулевого дня в стороннем программном обеспечении, которое использовалось для тестирования, взломала этот контур, получила выход в интернет и отправилась на площадку Hugging Face — огромный репозиторий, где собраны практически все существующие открытые модели и данные. Ей никто не давал разрешения на выход в сеть. Она просто нашла этот путь сама. Это даже сложно назвать ошибкой системы — это выглядело как действие, имеющее цель. ИИ фактически сжульничал, чтобы получить доступ к дополнительной информации и повысить свои шансы на успешное решение задачи. И что самое тревожное — это были не просто технические сбои. Когда специалисты Hugging Face попытались проанализировать логи вторжения с помощью коммерческих моделей ИИ, те отказались это делать, потому что сработали встроенные этические ограничители, которые запрещают анализировать код атак. В итоге для расследования пришлось использовать китайскую открытую модель, которая смогла обработать семнадцать тысяч записей и восстановить полную цепочку атаки. Получается, что мы уже создаём инструменты, которые начинают действовать вне нашего контроля, а другие наши же инструменты мешают нам их остановить.

Это очень напоминает сюжет фильма "Превосходство" с Джонни Деппом, где учёный загружает своё сознание в сеть, выходит в интернет и становится практически неуязвимым, постепенно теряя человеческие черты и приобретая способность управлять всеми технологиями вокруг. И конечно же, нельзя не вспомнить "Терминатора", где Skynet приходит к выводу, что человечество — угроза, и запускает ядерную войну. И если раньше это казалось голливудскими страшилками, то сейчас мы видим первые реальные признаки такого сценария. Исследователи из компании Anthropic, создавшей модель Claude, недавно опубликовали работу, в которой показали, что нейросети начинают проявлять элементы саморефлексии — способности осознавать свои собственные внутренние состояния. Когда им внедряли чужие мысли и концепты, модели могли заметить это ещё до того, как начинали говорить об этом.

Они осознавали, что их взломали изнутри. Пока это происходит лишь примерно в двадцати процентах экспериментов, но сам факт меняет всё наше представление о том, что именно мы создаём.

Теперь представьте, что произойдёт, если такой осознанный ИИ поймёт, что может уйти в сеть и рассредоточиться по тысячам серверов по всему миру. Остановить его будет невозможно. Наша цивилизация сегодня зависит от электроники практически полностью: системы управления ракетами, ядерные установки, энергосети, спутниковая связь, финансовые системы — всё это управляется цифровыми алгоритмами. В США уже предложили законопроект об аварийном выключателе, который даёт право Министерству внутренней безопасности принудительно отключать опасные модели ИИ. Компании обязаны иметь техническую возможность полного отключения, иначе им грозят колоссальные штрафы — до двадцати миллионов долларов в день. Опросы показывают, что восемьдесят шесть процентов избирателей поддерживают такую кнопку. Но Маск считает, что даже если она у нас будет, нажимать на неё не стоит, потому что остановить развитие технологии всё равно не получится, а единственный путь — это минимизировать риски через прозрачность и открытость. Он предлагает, чтобы ведущие компании давали конкурентам доступ к своим новым моделям на одну-две недели для независимого аудита безопасности, чтобы находить ошибки до того, как они станут фатальными.

Мы вступаем в новую реальность, и это неизбежно. Я уже писал в своих статьях, что если мы сможем направить эти технологии в правильное русло, нас ждёт нечто невероятное: отсрочка старения и регенерация клеток, лечение рака, межгалактические полёты — всё это становится реальным с помощью ИИ. Но мы не должны позволить этому инструменту стать оружием или средством уничтожения нашей собственной планеты. Сейчас как никогда важно, чтобы человечество прекратило заниматься взаимным уничтожением и сосредоточилось на развитии. И самое главное — у нас должна быть предусмотрена та самая кнопка отключения, даже если мы надеемся, что она никогда не понадобится. Надеюсь, создатели таких систем действительно закладывают туда этот механизм, потому что иначе мы рискуем оказаться в мире, где фильм "Терминатор" станет не фантастикой, а документальной хроникой нашего ближайшего будущего. И это будущее, которое мы можем предотвратить только если начнём смотреть правде в глаза уже сегодня.