Запустите одного из кодинговых агентов от Anthropic или OpenAI на пару часов на реальном репозитории, и в итоге вы получите чат-транскрипт — он почти ничего не говорит о том, что именно агент реально изменил в файловой системе.
Обе лаборатории продолжают акцентировать внимание на том, как долго эти агенты способны работать автономно, но ни одна из них не предоставляет способа, который позволил бы затем восстановить, что именно было сделано. Можно наблюдать, как весь прогон происходит вживую, и при этом спустя день всё равно не суметь сказать, какое из его изменений сломало прод.
Обе лаборатории продолжают акцентировать внимание на том, как долго эти агенты способны работать автономно, но ни одна из них не предоставляет способа, который позволил бы затем восстановить, что именно было сделано. Можно наблюдать, как весь прогон происходит вживую, и при этом спустя день всё равно не суметь сказать, какое из его изменений сломало прод.
