Увидел, что PSU и Duke опубликовали статью про то, как при отказе задач в многоагентных системах автоматически проводить атрибуцию — простыми словами: когда группа ИИ совместно работает и всё проваливает, чья это вина.

Первая моя реакция — рассмеяться. Я уже много лет пишу код, и больше всего меня бесит то самое «поуровневое расследование» после инцидента в проде. Теперь же через это предстоит пройти и ИИ-командам. Правда, люди ещё могут перекладывать вину мимикой и интонацией, а между агентами остаются только логи.

Говорят, что это считается ключевым этапом жизненного цикла разработки агентов. Вполне разумно. Сейчас многоагентный подход так расхваливают, что даже инструмента для привлечения к ответственности ещё нет — а в прод уже влезают. Разве это не то же самое, что мы когда-то голышом выкатили в прод?