**オープンAI(OpenAI)**が、新型モデルGPT-6「アストラ」について「発売後に急にバカになった」という1週間にわたる利用者の不満を認め、それを引き起こした3つの欠陥を修正したと発表した。同時に、コデックス(Codex)購読者の使用量上限も再設定した。
핵심 내용
アストラの利用者は、リリース直後のバージョンと現在のバージョンを並べて比較テストし、モデルがこっそりと「ナーフ(性能低下)」されたと主張してきた。
オープンAIのコデックス統括ティボ・ソティオ(Tibo Sottiaux)は、3つの原因を明らかにしたが、そのうちの1つは、およそ4,000〜5,000人が参加したコンテキスト実験だった。
前作のフラッグシップモデルGPT-5.6ソルも、7月に同様の疑惑に巻き込まれていた。
オープンAI、アストラ品質の不具合に緊急パッチ
コーデックス製品統括のティボ・ソティオは、土曜(現地時間)に公開されたアップデートで、チームがユーザーとともに不具合を追跡した後、修正パッチを配布し、深夜前に使用量上限を全面的に初期化したと説明した。
彼は、前世代モデル向けに設計された「スキル(skill)」がアストラでも過剰に発動され、その結果をモデル自身が再検証する手順を妨げてしまうことがあったと明らかにした。
選択オプションだった「コンテキスト管理の実験」も問題だった。この実験機能がオンの状態では、モデルが会話を早すぎるタイミングで終了したり、すでに長期間前のメッセージに回答したりするケースが繰り返し起きた。オープンAIは、この実験に触れた利用者は約4,000〜5,000人に上ると推定し、試験機能を全面的に無効化した。
さらに、一部のエンジン設定が誤って構成されており、そのエンジンを介してルーティングされた「テールトラフィック(tail traffic)」の回答品質が、統計的に有意に低下していたことが分かった。会社は該当するエンジンを削除し、複数の小規模な修正を並行して行った。ソティオはその後の投稿で、「アストラは今、ユーザーの『最後のメッセージ』をより正確に追跡するようになった」と述べた。
あわせて見る:イーサリアム、ETF資金2億1,600万ドル流入にも2,800ドルの供給壁の負担
開発者「コーディング能力が後退」…アストラ回避の動き
論争はX(旧ツイッター)で一週間ずっと広がった。開発者はアストラのリリース当日と現在のバージョンで同じプロンプト、同じ設定を適用してコードを生成し、その結果を並べて比較した。
つい数日前までアストラを絶賛していた開発者 **プラナル・パリワル(Pranjal Paliwal)**は、モデルが自分のために書いたコードを改めて見直した後、「進歩ではなく後退」と評価を覆した。
コーディングツール「オープンコード(Opencode)」を開発する **ダックス・レイド(Dax Raad)**は、アストラに乗り換えた後にコストが2倍に跳ね上がった一方で、体感性能はむしろ下がったと判断し、チーム全体を再び旧型のGPT-5.6ソルに戻した。
オープンAIコミュニティのある利用者は投稿で、レポートを通じて「今のアストラは、同じ作業、同じリトライ条件で、ソルと性能がほぼ同水準」と分析した。だが、全員がそれに同意しているわけではない。「アンティキティラ(Antikythera)」という別名を使う別の利用者は、「アストラはもともと怠けがちで箇条書き(箇条書きの項目)を乱発しており、ユーザーがようやく幻想が砕けたのだ」と反論した。
GPT-6 アストラを押しつぶす演算・料金上限
演算(capacity)の問題は、アストラが9月上旬の大規模公開に入った瞬間から、影のように付きまとった。
ユーザーの申告によると、オープンAIはヘビーユーザーに分類される一部のChatGPTアカウントのアストラ利用上限を大幅に引き下げ、月200ドルの新規プロ(Pro)サブスクリプションも一時停止した。この措置は、ソティオが9月10日付のブログ記事で公式に確認した。
現在のアストラ料金は、入力トークン100万個あたり10ドル、出力トークン100万個あたり50ドルに設定されている。これはリリース当時のソルが受けていた価格の2.5倍だ。高性能モデルであることを踏まえても、費用に見合う効果をめぐる議論が大きくなっている背景だ。
今回の騒動は、オープンAIのフラッグシップモデルが2か月の間に同じような批判を連続して受けた事例でもある。7月にはソルの最高難度推論モードが「一晩で見かけ上変わった」という指摘が出ており、その時もソティオは意図的な性能低下は否定しつつ、「推論努力(reasoning effort)に関する実験」が進行中だった点だけを認めた。
次に読む:エヌビディアのジェンセン・ファン「AIセキュリティの恐怖、サイバーセキュリティ企業に追い風」
