GPT 6.1 Sol hat Opus 5.5 bei Terminal Bench Science nicht übertroffen – aber etwas getan, das wohl noch mehr verändern könnte.

Opus 5.5: 63,3 % Genauigkeit bei 23,21 $ pro Durchlauf
Sol: 57,0 % Genauigkeit bei 5,47 $ pro Durchlauf

Sol liegt 6 Prozentpunkte zurück, kostet aber nur ein Viertel. Für die meisten Unternehmen lautet die Frage nicht, ob Sol besser ist – sondern ob ein Vorsprung von 6 Prozentpunkten es wert ist, viermal so viel zu bezahlen.

Für die meisten Anwendungsfälle lautet die Antwort: nein. Das ist die neue Wettbewerbsdynamik: Leistung pro Dollar statt bloßer Leistung. Effizienz wird zum eigentlichen Schlachtfeld beim Einsatz von KI-Modellen.