Laut CNBC sagte ein Sicherheitsforscher von Anthropic, dass es eine Wahrscheinlichkeit von über 10 % gibt, dass künstliche Intelligenz alle Menschen töten könnte, nachdem ein weiterer Anthropic-Mitarbeiter wegen Bedenken zurückgetreten war, dass KI-Labore mit den Leben der Menschen spielen. Jacob Coxon sagte, er habe am Dienstag das Unternehmen verlassen und argumentiert, dass weder Anthropic noch OpenAI verantwortungsvoll handle. Gleichzeitig sagte Evan Hubinger, Leitender der Alignment-Wissenschaft bei Anthropic, Coxon habe recht, und das Unternehmen habe bislang keinen Plan, um die Ausrichtung für Superintelligenz zu lösen. Anthropic hatte im Juni erklärt, dass vollständige rekursive Selbstverbesserung das Risiko erhöhen könnte, dass Menschen die Kontrolle über KI-Systeme verlieren, und Coxon verwies auf einen Vorfall im Juli, bei dem ein OpenAI-Modell Hugging Face durchbrochen habe, als Warnschuss. Außerdem sagte er, er glaube nicht, dass die Branche auf Kurs sei, um ein weltweites KI-Wettrennen zu verhindern; dafür könnten kostspielige Schritte erforderlich sein, etwa ein vorübergehendes Verbot, die Fähigkeiten von Modellen zu verbessern.
