David Sachs teilte die Details der Situation der Firma Anthropic mit – basierend auf Gesprächen mit Personen innerhalb und außerhalb der US-Regierung.

Anthropic veröffentlichte diese Woche Modelle der Mythos-Klasse unter der Handelsbezeichnung Fable. Fable ist Mythos mit Schutzvorrichtungen (Guardrails). Wenn die Schutzvorrichtungen versagen, werden die fortgeschrittenen Cyber-Fähigkeiten von Mythos für diejenigen verfügbar, die sie nicht haben sollten. Anthropic selbst hat die Idee weithin beworben, dass Mythos ein Cyberwaffen-Tool ist, das vom Staat reguliert werden muss, und hat Schutzvorrichtungen in Fable befürwortet. Falls eine Schwachstelle entdeckt wird, werde ihre Verantwortung gepatcht.

Ein zuverlässiger Partner, der Fable getestet hat, fand Jailbreak-Schutzvorrichtungen, die nicht greifen. Die Administration bat Dario, das Problem zu beheben oder das Modell zu entfernen. Dario weigerte sich.

In dem Blog erklärte Anthropic, der Jailbreak sei nicht schwerwiegend. Aber der Partner und die USG sind anderer Meinung – diese Herabstufung entspricht nicht ihrem Anspruch als Unternehmen für KI-Sicherheit.

Zuvor hat Anthropic stets gesagt, dass Sicherheit die Nummer eins Priorität sei und äußerst ernst genommen werden müsse. Hier hat die Firma jedoch die Fortsetzung des Verkaufs des Consumer-Modells „vyshe besoposnosti“ ermöglicht.

Als Reaktion führte die Administration Exportkontrollen ein (wenn auch widerwillig). Es wird gehofft, dass Anthropic das Problem behebt, die Kontrolle aufgehoben wird und Fable so bald wie möglich wieder für die Öffentlichkeit zugänglich gemacht wird. Die Administration ist darüber überrascht, dass das Unternehmen sich weigert, Sicherheitsanfragen zu erfüllen – Anfragen, die es selbst zuvor als seine höchste Priorität bezeichnet hatte.

Das hat nichts mit früheren DoW- und Anthropic-Problemen zu tun. Die Administration würdigt die technischen Fähigkeiten von Anthropic und glaubt, dass sich das Problem, obwohl ernst, leicht lösen lässt. Nun liegt es an Anthropic.