Führe einen der Coding-Agents von Anthropic oder OpenAI für ein paar Stunden auf einem echten Repository aus, und was du zurückbekommst, ist ein Chat-Protokoll – das dir fast nichts darüber sagt, was es tatsächlich auf der Festplatte geändert hat.
Beide Labore betonen weiterhin, wie lange diese Agents eigenständig laufen können, und keines liefert einen passenden Weg, um nachträglich zu rekonstruieren, was es getan hat. Du kannst den gesamten Lauf live mitverfolgen und trotzdem einen Tag später nicht sagen, welche seiner Änderungen Prod kaputtgemacht hat.
Beide Labore betonen weiterhin, wie lange diese Agents eigenständig laufen können, und keines liefert einen passenden Weg, um nachträglich zu rekonstruieren, was es getan hat. Du kannst den gesamten Lauf live mitverfolgen und trotzdem einen Tag später nicht sagen, welche seiner Änderungen Prod kaputtgemacht hat.
