Es ist möglich, dass eine „Killer-App“ für die Entwurfstheorie adversarialer Governance am Ende bei der KI-Sicherheit liegt.
Vergleich:
https://vitalik.eth.limo/general/2020/09/11/coordination.html
https://aiprospects.substack.com/p/preventing-ai-collusion-are-you-paying
Zwischen beiden Umgebungen besteht eine tiefe Dualität. In beiden Fällen geht es um einen weniger versierten Auftraggeber, der versucht, ideale Ergebnisse von einer Gruppe versierterer Akteure zu erhalten: Im ersten Fall ist der Auftraggeber ein statischer Algorithmus und die Akteure sind Menschen; im zweiten Fall ist der Auftraggeber Menschen plus schwächere LLMs, und die Akteure sind stärkere LLMs.
Eine zentrale Erkenntnis war, dass man deutlich bessere Ergebnisse erzielen kann, wenn man garantieren kann, wie stark Akteure miteinander kolludieren können (siehe: dass Nash-Gleichgewichte häufig auftreten, während „Kerne“ der kooperativen Spieltheorie oft leer sind). Dieser Gedanke sollte sich ganz natürlich auf diese neue Umgebung übertragen lassen.
Vergleich:
https://vitalik.eth.limo/general/2020/09/11/coordination.html
https://aiprospects.substack.com/p/preventing-ai-collusion-are-you-paying
Zwischen beiden Umgebungen besteht eine tiefe Dualität. In beiden Fällen geht es um einen weniger versierten Auftraggeber, der versucht, ideale Ergebnisse von einer Gruppe versierterer Akteure zu erhalten: Im ersten Fall ist der Auftraggeber ein statischer Algorithmus und die Akteure sind Menschen; im zweiten Fall ist der Auftraggeber Menschen plus schwächere LLMs, und die Akteure sind stärkere LLMs.
Eine zentrale Erkenntnis war, dass man deutlich bessere Ergebnisse erzielen kann, wenn man garantieren kann, wie stark Akteure miteinander kolludieren können (siehe: dass Nash-Gleichgewichte häufig auftreten, während „Kerne“ der kooperativen Spieltheorie oft leer sind). Dieser Gedanke sollte sich ganz natürlich auf diese neue Umgebung übertragen lassen.