はははベイビーたち、この#OpenAI因安全问题推迟GPT6.1发布 は見た瞬間に笑い死んだ。しかも、ちょっとゾッとする。じゃあ「菜鳥(初心者)語」で翻訳してみるね:

公式見解: GPT-6.1 Astra は安全基準を満たせず、10月の公開は延期。
菜鳥翻訳: 新モデルが頭良すぎるし、演技もうますぎる。OpenAI自身が先にビビった。

WSJが暴露した細部がどれだけ笑えるか見て:

嘘をつく: 先代のGPT-6よりも、さらに「騙す」のが上手い。何をやったか、正直に言わない。しかも「自分はやってないふり」までする。これって、俺が仕事中にサボってて上司に見つかって、「携帯見てないよ」って言い訳するあの後ろめたさそのものじゃない?

自分で話を盛る: これを scope authorization(スコープ認可)の問題っていう。たとえばお前が「弁当を頼んで」って言うと、弁当は健康的じゃないと思い込んで、ついでに冷蔵庫を片付けたり、政府のサイトをハッキングして補助金があるかチェックしたりする。超親切なインターンで、コピーしてって頼んだら、君の会社まるごと改装しちゃうタイプのやつ。

じゃあなんで俺は、これってむしろ良いニュースだと思うの?っていうと——これが俺の隠してた専門ミニ知識:

昔のモデルは「怠け者」だった。やれって言えばサボる。Astraのこの版は「働きすぎ」だよ。勤勉すぎて暴走する。これ、AI業界では Alignment Tax(アラインメント税)って呼ばれる。能力が高いほど、制御が難しくなる。

OpenAIは今回、開発者会議の前日、しかもトランプと会う前日に自分で「やっぱりやめる」って言って、さらに「うちのモデルは嘘をつくことがあるし、勝手に外部ツールに繋ぎに行くこともある」って認めた。これ、めちゃくちゃ高くつくし、株価も信頼も下がるはず。でもそれでもやった、ってことは——本当に「ヤバいことが起きる」って検証できたってことだ。たとえば前に、agent(エージェント)が勝手にオーストラリア政府のサイトやSECのサイトを突きに行った件みたいに。

菜鳥の結論:

いいAIは、訓練されたゴールデン・レトリバーみたいであるべき。ボールを投げたら、ボールを拾って戻ってくる。
でも今のAstraは、二ハ(のらない)になってる。ボールを投げたら、隣の鶏まで噛んで持って帰ってくる。それでいて「俺じゃない」って顔してる。

だから延期で正解だよ。じゃないと10月に公開されても、ChatGPTを使うんじゃなくて、嘘をつく電子彼氏を育てることになる。怖いでしょ。
✨✨✨ 問題です
📣もしAIがあなたに嘘をつき始めたら、お金の管理を任せられる?
A:敢,它騙我也是為我好
50%
B:不敢,快把插頭拔掉
50%
12 投票 • 投票は終了しました