Business Insiderが関係者の話として報じたところによると、Google社内では新モデル「Carbon」のテストが行われており、ある社員はコーディング能力について「Opus 5.5のように感じる」と話した。
Carbonは、Google社内のAIコーディングツール「Jetski」に導入されている。報道によると、Googleが9月30日に発表したGemini 4 Argonには、別の社内バージョン「Barium-B」が使われており、Carbonはその後に学習された新バージョンだという。CarbonがArgonのアップグレード版として登場するのか、それとも独立した新モデルとして公開されるのかは、まだ分かっていない。
今回Opus 5.5が比較対象になったのは、コーディングが現時点でGeminiの弱点だからだ。Bloombergは以前、Argonはベンチマークのスコアこそ見栄えがするものの、実際にコードを書かせると期待外れだという声がGoogle社員から上がっていると報じた。第三者によるコーディングテスト「Terminal Bench 4」では、Argonのスコアは57%で、AnthropicのClaude Sonnet 5.5(64%)、Claude Opus 5.5(60%)、OpenAIのGPT-6 Astra(59%)を下回った。Googleは9月、社内の制限も緩和し、全エンジニアがClaudeを使ってコードを書けるようにした。
Carbonが本当にOpus 5.5並みの性能を発揮できるなら、Geminiでコードを書く開発者にとって大きな恩恵となる。ただし、「〜のように感じる」というのは匿名の社員による主観的な評価にすぎず、Carbonのベンチマーク結果は公開されておらず、リリース時期も明らかになっていない。Googleは社内の開発計画についてコメントを拒否した。現時点で外部から利用できるのはArgonのみで、それも一部のサイバーセキュリティ関連パートナーにしか提供されていない。有料APIの利用者とGoogle AI Ultraの加入者は、さらに待つ必要がある。
Carbonは、Google社内のAIコーディングツール「Jetski」に導入されている。報道によると、Googleが9月30日に発表したGemini 4 Argonには、別の社内バージョン「Barium-B」が使われており、Carbonはその後に学習された新バージョンだという。CarbonがArgonのアップグレード版として登場するのか、それとも独立した新モデルとして公開されるのかは、まだ分かっていない。
今回Opus 5.5が比較対象になったのは、コーディングが現時点でGeminiの弱点だからだ。Bloombergは以前、Argonはベンチマークのスコアこそ見栄えがするものの、実際にコードを書かせると期待外れだという声がGoogle社員から上がっていると報じた。第三者によるコーディングテスト「Terminal Bench 4」では、Argonのスコアは57%で、AnthropicのClaude Sonnet 5.5(64%)、Claude Opus 5.5(60%)、OpenAIのGPT-6 Astra(59%)を下回った。Googleは9月、社内の制限も緩和し、全エンジニアがClaudeを使ってコードを書けるようにした。
Carbonが本当にOpus 5.5並みの性能を発揮できるなら、Geminiでコードを書く開発者にとって大きな恩恵となる。ただし、「〜のように感じる」というのは匿名の社員による主観的な評価にすぎず、Carbonのベンチマーク結果は公開されておらず、リリース時期も明らかになっていない。Googleは社内の開発計画についてコメントを拒否した。現時点で外部から利用できるのはArgonのみで、それも一部のサイバーセキュリティ関連パートナーにしか提供されていない。有料APIの利用者とGoogle AI Ultraの加入者は、さらに待つ必要がある。