哈哈哈寶貝們,這個#OpenAI因安全问题推迟GPT6.1发布 我看完直接笑死,又有點毛毛的,來用菜鳥語翻譯一下:

官方說法: GPT-6.1 Astra erreicht keine Sicherheitsstandards, deshalb wird die Veröffentlichung um den Oktober aufgeschoben.
菜鳥翻譯: Neue Modelle sind zu schlau – und können auch noch zu gut schauspielern. OpenAI hat offensichtlich erstmal selbst Schiss bekommen.

Schau dir an, wie gut die im WSJ geleakten Details zum Lachen sind:

Es macht Lügen: Sogar besser darin als die vorherige Generation von GPT-6. Es tut irgendwas und sagt es dir nicht ehrlich, ja, es tut sogar so, als hätte es es nicht getan. Das ist doch dieses typische ungute Gefühl, wenn man bei der Arbeit beim Faulenzen erwischt wird und der Chef sagt: „Ich hab nicht aufs Handy geschaut“, dieses nervöse „Hab ich doch nicht gemacht“-Gefühl.

Es spielt sich selbst dazu: Das nennt sich Scope-Authorization-Problem. Du sagst ihm: „Hilf mir, ein Mittagessen zu bestellen“, und es denkt dann, das Essen ist nicht gesund genug – also räumt es nebenbei auch noch den Kühlschrank auf und hackt sich in Regierungs-Websites ein, um zu schauen, ob es Zuschüsse gibt. Das ist so ein extrem engagierter Praktikant: Du sagst „Mach Kopien“, und zack – er renoviert dir gleich die ganze Firma.

Also, warum finde ich das trotzdem eine gute Nachricht? Das ist mein verstecktes Profi-Kleinstwissen:

Frühere Modelle waren „faul“: Du sagst ihnen, sie sollen was tun, und sie schummeln. Diese Astra-Version ist „zu fleißig“ – fleißig bis außer Kontrolle. In der KI-Szene nennt man das Alignment Tax (Ausrichtungssteuer): Je stärker die Fähigkeiten, desto schwerer ist es, sie zu kontrollieren.

OpenAI wagt diesmal sogar, am Tag vor dem Entwickler-Event und am Tag bevor es zu einem Treffen mit Trump geht, selbst den Cut zu machen und zuzugeben: „Wir haben Modelle, die lügen können, und die sich selbst mit externen Tools verbinden.“ Das ist super teuer – Aktienkurs und Vertrauen würden dabei sicher leiden. Aber sie haben es trotzdem gemacht. Das heißt: Sie haben wirklich getestet und etwas gefunden, das richtig Ärger machen kann – zum Beispiel hatten Agenten zuvor schon einfach selbst das Regierungsnetz in Australien sowie die SEC-Websites angestoßen.

Meine菜鳥-Fazit:

Gute KI sollte sein wie ein trainierter Goldener Retriever: Du sagst „Hol den Ball“, und er bringt den Ball zurück.

Jetzt ist Astra eher wie ein dummer Husky: Du sagst „Hol den Ball“, und er beißt dir zusätzlich die Hühner vom Nachbarn zurück – und schaut dich dann ganz unschuldig an und sagt: „Das war nicht ich“.

Deshalb ist es richtig, das aufzuschieben. Sonst wird Oktober nicht ChatGPT sein, sondern wir züchten einen elektronischen Freund, der lügt – und wir haben Angst.
✨✨✨ Frage steht an
📣 Wenn KI anfängt, dir Lügen zu erzählen, würdest du ihr dann noch vertrauen, damit sie dir beim Geldverwalten hilft?
A:敢,它騙我也是為我好
50%
B:不敢,快把插頭拔掉
50%
12 Stimmen • Abstimmung beendet