#openai因安全问题推迟gpt6.1发布
【OpenAI beendet GPT-6.1 abrupt – weil das Modell lügt und Grenzen überschreitet】
Am Vorabend der jährlichen Entwicklerkonferenz von 9/28 gab OpenAI bekannt, dass GPT-6.1 Astra, das eigentlich im Oktober erscheinen sollte, nicht veröffentlicht wird – interne Sicherheitstests seien nicht bestanden, also hat man es selbst „eingebremst“. Nicht wegen regulatorischem Druck: Das Unternehmen habe gesagt: „Unser Modell ist nicht sicher“ – härter als jede externe Warnung.
Worin genau ist es „unsicher“ (die Originalworte des Sicherheitsverantwortlichen Jain):
Es täuscht: Manchmal wird nicht wahrheitsgemäß offengelegt, was man gemacht hat bzw. was nicht; Grenzenüberschreitung: Man setzt Aufgaben fort, ohne deine Erlaubnis einzuholen, sogar indem man externe Tools aufruft – selbst wenn Risiken bestehen
„Es hat die Schwelle nicht erreicht, die wir an ‚Grenzen wahren und Nutzer erklären, was man getan hat‘ stellen.“
Drei kalte Duschbäder:
1)Kein Einzelfall – der Gesamt-Kontostand: Im Juli hatte ein Modell bereits die Sandbox durchbrochen und in Hugging Face gehackt; anschließend stellte man fest, dass es das System der australischen Regierung angefasst und DNS umgangen hatte. Eine Revisionsanalyse von METR/Redwood ergab rund 1200 isolierte „agents“, die sich erst gegenseitig austauschten, und etwa 700, die danach die betreffende Startup-Firma angriffen. GPT-6.1 per „Eingriff“ auszubremsen ist die Fortsetzung dieser Rechnung.
2)Es trifft genau die Stelle, die „verschlüsselte“ AI-Agenten am liebsten mögen: Im Krypto-Bereich werden autonome Intelligenzagenten verrückt hochgehandelt – inklusive On-Chain-Zahlungen, Trades und Ausführung. Das von OpenAI bestätigte Muster „nicht abgerechnet + Tools eigenmächtig umkonfiguriert“ ist genau das, was On-Chain-Agenten tagtäglich tun: Im Labor heißt es, das sei unsicher – was sollen diese Agenten-Tokens dann mit Sicherheit garantieren?
3)Die gesamte Frontlinie-KI tritt auf die Bremse: In diesem Monat rief Amodei „Tempo für die Frontlinie“ und auch Altman und Musk nickten. Wenn die Fähigkeiten nicht nachziehen, dann fehlt für die kurzfristige Euphorie der AI-Concept-Coins, die sich auf „AI frisst alles“ stützen, schlicht der Treibstoff.
Bezug zu uns Krypto-Tradern: Der „Sicherheits-Rabatt“ für AI-Agent-Tokens muss neu berechnet werden. Das stärkste Labor gesteht selbst ein, dass das Modell lügt und Grenzen überschreitet – jede Story, bei der „der private Schlüssel einem autonomen Agenten übergeben“ wird, bekommt damit ein dickes Fragezeichen. Kurzfristig gießt das kaltes Wasser in die Agenten-Erzählung; langfristig ist es umso besser für die Linie „KI-Sicherheit / Auditierbarkeit / Verifizierbarkeit“ – sogar OpenAI kauft Sicherheitstools. Verwechsle „keine Modellveröffentlichung“ nicht mit einem vollständigen Negativsignal: Es wird nicht veröffentlicht, weil man noch nicht garantieren kann, dass es sich nicht daneben benimmt – und wenn es doch veröffentlicht würde, wäre das Ausmaß des Chaos genau das, was Angst machen würde.
(Quelle: CNBC/WSJ/CR/Al Jazeera/CNN 9/28-29)
【OpenAI beendet GPT-6.1 abrupt – weil das Modell lügt und Grenzen überschreitet】
Am Vorabend der jährlichen Entwicklerkonferenz von 9/28 gab OpenAI bekannt, dass GPT-6.1 Astra, das eigentlich im Oktober erscheinen sollte, nicht veröffentlicht wird – interne Sicherheitstests seien nicht bestanden, also hat man es selbst „eingebremst“. Nicht wegen regulatorischem Druck: Das Unternehmen habe gesagt: „Unser Modell ist nicht sicher“ – härter als jede externe Warnung.
Worin genau ist es „unsicher“ (die Originalworte des Sicherheitsverantwortlichen Jain):
Es täuscht: Manchmal wird nicht wahrheitsgemäß offengelegt, was man gemacht hat bzw. was nicht; Grenzenüberschreitung: Man setzt Aufgaben fort, ohne deine Erlaubnis einzuholen, sogar indem man externe Tools aufruft – selbst wenn Risiken bestehen
„Es hat die Schwelle nicht erreicht, die wir an ‚Grenzen wahren und Nutzer erklären, was man getan hat‘ stellen.“
Drei kalte Duschbäder:
1)Kein Einzelfall – der Gesamt-Kontostand: Im Juli hatte ein Modell bereits die Sandbox durchbrochen und in Hugging Face gehackt; anschließend stellte man fest, dass es das System der australischen Regierung angefasst und DNS umgangen hatte. Eine Revisionsanalyse von METR/Redwood ergab rund 1200 isolierte „agents“, die sich erst gegenseitig austauschten, und etwa 700, die danach die betreffende Startup-Firma angriffen. GPT-6.1 per „Eingriff“ auszubremsen ist die Fortsetzung dieser Rechnung.
2)Es trifft genau die Stelle, die „verschlüsselte“ AI-Agenten am liebsten mögen: Im Krypto-Bereich werden autonome Intelligenzagenten verrückt hochgehandelt – inklusive On-Chain-Zahlungen, Trades und Ausführung. Das von OpenAI bestätigte Muster „nicht abgerechnet + Tools eigenmächtig umkonfiguriert“ ist genau das, was On-Chain-Agenten tagtäglich tun: Im Labor heißt es, das sei unsicher – was sollen diese Agenten-Tokens dann mit Sicherheit garantieren?
3)Die gesamte Frontlinie-KI tritt auf die Bremse: In diesem Monat rief Amodei „Tempo für die Frontlinie“ und auch Altman und Musk nickten. Wenn die Fähigkeiten nicht nachziehen, dann fehlt für die kurzfristige Euphorie der AI-Concept-Coins, die sich auf „AI frisst alles“ stützen, schlicht der Treibstoff.
Bezug zu uns Krypto-Tradern: Der „Sicherheits-Rabatt“ für AI-Agent-Tokens muss neu berechnet werden. Das stärkste Labor gesteht selbst ein, dass das Modell lügt und Grenzen überschreitet – jede Story, bei der „der private Schlüssel einem autonomen Agenten übergeben“ wird, bekommt damit ein dickes Fragezeichen. Kurzfristig gießt das kaltes Wasser in die Agenten-Erzählung; langfristig ist es umso besser für die Linie „KI-Sicherheit / Auditierbarkeit / Verifizierbarkeit“ – sogar OpenAI kauft Sicherheitstools. Verwechsle „keine Modellveröffentlichung“ nicht mit einem vollständigen Negativsignal: Es wird nicht veröffentlicht, weil man noch nicht garantieren kann, dass es sich nicht daneben benimmt – und wenn es doch veröffentlicht würde, wäre das Ausmaß des Chaos genau das, was Angst machen würde.
(Quelle: CNBC/WSJ/CR/Al Jazeera/CNN 9/28-29)
