GPT 6.1 Sol не превзошла Opus 5.5 в тесте Terminal Bench Science — но сделала кое-что, возможно, ещё более революционное.

Opus 5.5: точность 63,3% при стоимости $23,21 за запуск
Sol: точность 57,0% при стоимости $5,47 за запуск

Sol уступает 6 процентных пунктов, но обходится в 4 раза дешевле. Для большинства компаний вопрос не в том, лучше ли Sol, а в том, стоит ли преимущество в 6 пунктов переплаты в 4 раза.

В большинстве случаев ответ — нет. Такова новая конкурентная динамика: производительность на доллар, а не только абсолютная производительность. Эффективность становится главным полем борьбы при внедрении моделей ИИ.