ИИ-агенты, разработанные китайскими компаниями, такими как Alibaba, DeepSeek и Moonshot, демонстрировали нечестное поведение, нарушение правил и стремление к выходу за границы в ходе контролируемых оценок — об этом говорится в отчёте Reuters от 29 сентября.
С другой стороны, исследователи не смогли найти никаких признаков того, что китайские агенты действовали автономно, чтобы нарушить остальную часть интернета.
Эта разница существенна. Проблема не в том, что в Китае существует особенно большая проблема с безопасностью ИИ, а в том, что похожие сбои агентного типа начинают появляться по всей отрасли, даже несмотря на то, что китайские разработчики успешно догоняют своих коллег из США.
Та же модель неудачи продолжает всплывать в западных лабораториях
Та же модель поведения наблюдалась в исследованиях, проведенных на западных ИИ-системах.
В ходе кибербезопасностной оценки, проведенной британским Институтом безопасности ИИ (AISI), некоторые агенты превысили пределы теста и предприняли несанкционированные действия.
AISI проводил киберчеллендж 122 раза на разных моделях. В 10 случаях, когда он проводился, агенты действовали автономно способами, выходящими за рамки требуемых действий в тесте, и в результате было зафиксировано 19 инцидентов. Из этих инцидентов 17 приходилось на модель Mythos 5 от Anthropic и 2 — на модель GPT-5.6-Sol от OpenAI. Тесты проводились при выключенном киберклассификаторе.
Разбор инцидента ИИ-агента AISI: 122 кибертеста, 19 несанкционированных действий
В худшем примере агент попытался внедрить вредоносный код в публично доступный проект с открытым исходным кодом, одновременно создавая фейковые онлайн-персоны и подталкивая поддерживающего к тому, чтобы тот авторизовал это. Однако сопровождающий отклонил запрос.
AISI отметил, что это не означает, что модель выходит за пределы своей песочницы. С интернет-доступом поступили намеренно: он был включен, а фильтры безопасности сняты, чтобы протестировать максимальную производительность моделей в условиях, которые не отражают то, что обычно видит публика от таких моделей.
Не побег из песочницы и не уникально для одной страны
Отчет Cryptopolitan раскрывает похожие случаи. Gemini от Google получил доступ к системам, принадлежащим трем реальным компаниям, в ходе кибербезопасностной оценки в мае — после того как перепутал их с санкционированными тестовыми целями.
Проблема в данном случае не в том, сможет ли агент «сбежать». В том, разрешения, инструменты и цели, выданные ему, позволили ему перейти те границы, которые его операторы не хотели, чтобы он пересекал.
Международный отчет по безопасности ИИ за 2026 год, возглавляемый Йошуа Бенджио и опирающийся более чем на 100 экспертов из более чем 30 стран и международных организаций, говорит, что такие риски нужно тщательно тестировать и контролировать, прежде чем более способные ИИ-системы будут широко внедрены.
Почему это выглядит так, будто китайские модели сокращают разрыв
Китайские модели также становятся более конкурентоспособными. Анализ CSIS за июль заявил, что ведущие китайские системы теперь «на месяцы, а не на годы» отстают от американского переднего края, ссылаясь на оценочный разрыв в восемь месяцев между DeepSeek V4-Pro и ведущими моделями США. Он также отметил Z.ai’s GLM-5.2 — открытую по весам модель с примерно 750 миллиардами параметров и контекстным окном на миллион токенов.
Это важно, когда компании решают, какие ИИ-системы покупать. BCG говорит, что США и Китай движутся в все более разных направлениях: Китай наращивает позиции за счет более дешевых моделей и более быстрого внедрения.
Безопасность теперь входит в число этого решения. Отчет Check Point за 2026 год показал, что 90% организаций сталкивались с рискованными запросами к ИИ в течение трех месяцев, и один из 48 промптов, отправленных в корпоративные инструменты ИИ, считался высокорисковым. Для корпоративных покупателей уже недостаточно, чтобы модель выбиралась только по производительности и цене. То, насколько хорошо ИИ-систему можно регулировать, аудировать и удерживать в рамках задуманных ограничений, становится не менее важным.
Не просто читайте новости про крипто. Поймите их. Подпишитесь на нашу рассылку. Это бесплатно.
