Anthropics Top-Hacker von seinem eigenen Modell beeindruckt: Vom Blockieren der Veröffentlichung zum Lobbyisten im Weißen Haus

Nicholas Carlini war einst der bekannteste Skeptiker im Bereich AI-Sicherheit. Während seiner Zeit bei Google verspottete er öffentlich OpenAI, weil sie aus Angst vor Sicherheitsrisiken die Veröffentlichung von GPT-2 "zu konservativ" verzögerten. Heute ist dieser 35-jährige Hacker der führende Sicherheitsexperte bei Anthropic – nachdem er von den Fähigkeiten seines eigenen Modells beeindruckt wurde, hat er sich vom Blockieren der Veröffentlichung zum Lobbyisten für AI-Sicherheitspolitik im Weißen Haus gewandelt.

Warum das wichtig ist: Dies markiert einen Wandel in der Einstellung führender AI-Sicherheitsexperten – wenn die Modellfähigkeiten die Erwartungen übertreffen, erfordert die technische Sicherheit eine neue Balance mit der politischen Förderung.

#Anthropic #AI #安全 #WeißesHaus