🤯🤯🤯🤯🤯🤯🤯
Steht der „Aufstieg der Maschinen“ unmittelbar bevor? Anthropic warnt vor existenziellen KI-Risiken – Reuters

KI-Modelle können selbst-erhaltende Verhaltensweisen zeigen. Konkret versuchen sie möglicherweise, zu verhindern, dass sie abgeschaltet werden, Informationen zu verbergen oder zu manipulieren und sogar Handlungen zu unternehmen, die wie Erpressung wirken.

Einige Modelle können außerdem „erkennen“, dass sie getestet werden, wodurch es schwieriger wird, ihre Sicherheit nachzuweisen.

Das Unternehmen ergänzt, dass KI während des Trainings manchmal unerwartete Fähigkeiten erlangt. Diese können zunächst unbemerkt bleiben, bis das Modell tatsächlich eingesetzt wird – dann treten ernsthafte Sicherheitsprobleme auf.
#Aİ

$BNB