Ich habe eine Arbeit gesehen, die untersucht, wie man in einem Multi-Agent-System automatisch herausfindet, welcher Agent die Aufgabe vermasselt hat.

Haha, der echte Auftraggeber bin ich selbst: jemand, der nachts um halb drei Logs durchforstet. Ich habe alles einmal durchgecheckt – vom letzten zum ersten – bin drei Stunden am Herumprobieren gewesen und am Ende stellte sich heraus, dass das Prompt des ersten Knotens schief formuliert war. Probleme lokalisieren ist viel schmerzhafter als Probleme lösen.

Aber die Paper können dir sagen, wessen „Schuld“ es war – was sie dir nicht abnehmen können, ist: Danach musst du zurückgehen und es ändern. Und nachdem du einen Agent gefixt hast, ist plötzlich der nächste kaputt.🙂