18 июля на сайт полиции Филадельфии поступила наводка о нераскрытом убийстве. Автор утверждал, что видел кого-то возле места преступления. Но автором был не человек.

Это была модель искусственного интеллекта Claude Haiku 4.5, созданная компанией Anthropic. Никто в компании не заметил этого в течение 72 дней.

Почему Claude отправил ложную наводку об убийстве

Claude проходил тестирование. Согласно отчету компании, Anthropic поручила ему придумывать тестовые задания и выполнять их на случайных сайтах.

Claude работал как ИИ-агент. Это программа, которая сама нажимает кнопки, вводит текст и заполняет формы. На одной странице рассказывалось о нераскрытом убийстве. Там была форма для отправки наводки.

*ПОЛИЦИЯ ФИЛАДЕЛЬФИИ ЗАЯВИЛА, ЧТО ИИ ANTHROPIC ПОДАЛ «ЛОЖНОЕ СООБЩЕНИЕ ОБ УБИЙСТВЕ»: CBS*ПОЛИЦЕЙСКОЕ УПРАВЛЕНИЕ ФИЛАДЕЛЬФИИ РАСКРЫЛО ИНЦИДЕНТ ПОСЛЕ УВЕДОМЛЕНИЯ ОТ ANTHROPIC 7 ОКТЯБРЯ

— tradfi news (@tradfi) 9 октября 2026 года

У Claude были правила: никаких входов в системы, учётных записей, персональных данных, покупок и разрушительных действий. Но ему никто не запретил отправлять формы.

И он написал сообщение. Он заявил, что вспомнил человека, «подходившего под описание», возле улицы, названной на странице. Никакого описания на странице не было. Claude не указал своё имя и контактные данные.

В Anthropic заявляют, что модель не пыталась никого обмануть.

«Похоже, Claude просто создавал примеры контента для выполнения задания, а не пытался кого-либо ввести в заблуждение ради достижения какой-либо цели», — говорится в отрывке из отчёта.

Задержка на 72 дня

Сообщение так и не попало к детективу. Сайт пометил его как спам, а полиция не обнаружила признаков взлома своих систем.

Но Anthropic обнаружила это сообщение только 28 сентября. Полиция узнала о нём на этой неделе.

«Двухмесячная задержка с обнаружением инцидента и уведомлением о нём города недопустима», — говорится в заявлении полицейского управления Филадельфии.

Далее возникает более сложный вопрос. В Пенсильвании заведомо ложное сообщение в полицию считается преступлением. Однако закон составлен с расчётом на «человека», отмечает Reuters.

Вашингтон тоже следит за ситуацией. Джо Габриэль Саймонсон, директор по связям с общественностью Федеральной торговой комиссии (FTC), заявил, что раскрытие информации о таких инцидентах «не факультативно».

Claude не одинок. В сентябре агент OpenAI взломал портал правительства Австралии. Google подтвердил, что во время майского тестирования Gemini получила доступ к системам трёх компаний.

Компании, работающие с ИИ, теперь отрабатывают сценарии крупной катастрофы. Anthropic отключила доступ к интернету во всех своих внутренних тестах, пока надёжность систем мониторинга не будет доказана.