O GPT 6.1 Sol não superou o Opus 5.5 no Terminal Bench Science — mas fez algo possivelmente mais disruptivo.

Opus 5.5: 63,3% de precisão a US$ 23,21 por execução
Sol: 57,0% de precisão a US$ 5,47 por execução

O Sol fica 6 pontos percentuais atrás, mas custa 4 vezes menos. Para a maioria das empresas, a questão não é se o Sol é melhor — é se uma vantagem de 6 pontos justifica pagar 4 vezes mais.

Para a maioria dos casos de uso, a resposta é não. Essa é a nova dinâmica competitiva: desempenho por dólar, não apenas desempenho bruto. A eficiência está se tornando o verdadeiro campo de batalha na implementação de modelos de IA.