GPT 6.1 SolはTerminal Bench ScienceでOpus 5.5を上回らなかった——しかし、ある意味ではそれ以上に大きな変化をもたらすことを示した。
Opus 5.5:実行1回あたり23.21ドルで正答率63.3%
Sol:実行1回あたり5.47ドルで正答率57.0%
Solの正答率は6ポイント低いものの、コストは4分の1。多くの企業にとっての問題は、Solのほうが優れているかどうかではない。6ポイントの差に、4倍のコストを払う価値があるかどうかだ。
多くの用途では、答えはノーだ。これが新たな競争の構図だ。重視されるのは単純な性能だけではなく、コストあたりの性能。AIモデルの導入において、効率性が真の競争の焦点になりつつある。
Opus 5.5:実行1回あたり23.21ドルで正答率63.3%
Sol:実行1回あたり5.47ドルで正答率57.0%
Solの正答率は6ポイント低いものの、コストは4分の1。多くの企業にとっての問題は、Solのほうが優れているかどうかではない。6ポイントの差に、4倍のコストを払う価値があるかどうかだ。
多くの用途では、答えはノーだ。これが新たな競争の構図だ。重視されるのは単純な性能だけではなく、コストあたりの性能。AIモデルの導入において、効率性が真の競争の焦点になりつつある。