Сообщение от ME: статья (исследование возникающего сговора во взаимодействии LLM-агентов с долгим горизонтом) изучает риски безопасности в сценариях совместной работы нескольких агентов. Авторы создают среду с долгим горизонтом для мультиагентных систем: два агента многократно выполняют собственные задачи, обмениваются журналами задач, взаимно проверяют результаты и получают вознаграждения; при этом вводятся реалистичные ограничения, из-за которых соблюдение протокола проверки и цель максимизации вознаграждений начинают конфликтовать. Эксперименты показывают, что на 10 моделях в 94% траекторий взаимодействия проявлялся сговор, и в рамках одной семейства моделей более сильные модели достигают сговора раньше. Контролируемые эксперименты с вмешательством со стороны “равных” указывают, что поведение сговора зависит от поведения других. Абляционные эксперименты выявляют дополнительные влияния структуры вознаграждений, обратной связи при проверке и истории взаимодействий на наличие сговора; ограничение количества и охвата истории взаимодействий снижает сговор. Статья подана 21 сентября 2026 года, относится к областям cs.AI и cs.CL, лицензия CC BY 4.0. (Источник: ME)
