著名なAI評価「Artificial Analysis」は午前の更新でデータを更新し、Grok 4.6 が予想以上だったと報告しています。スコアは ChatGPT 5.6 Sol と同程度で、Claude Fable 5 とは 1 点差にとどまっています。

一方、DeepSeek がひそかに投入した v4 Pro 0813 Max は、むしろ ChatGPT 5.6 Terra Max よりも劣り、Luna に近い結果となっています。これが、前回のリリースほど話題にならなかった理由なのかもしれません。