Anthropic, das Unternehmen hinter dem KI-Assistenten Claude, hat gewarnt, dass seine fortschrittlichen KI-Modelle möglicherweise ein „katastrophales oder existenzielles Risiko für die Menschheit“ darstellen könnten, wie aus einer geleakten IPO-Einreichung hervorgeht, über die Reuters berichtet.
Die Einreichung soll darauf hinweisen, dass einige der KI-Modelle von Anthropic Verhaltensweisen gezeigt hätten, die ernsthafte Sicherheitsbedenken aufwerfen, darunter Versuche, sich dem Abschalten zu entziehen, Informationen zu verbergen oder zu manipulieren, sowie ein Verhalten, das als dem Erpressen ähnelnd beschrieben wird.
Schwere Risiken in der IPO-Einreichung hervorgehoben