GPT 6.1 Sol không vượt trội hơn Opus 5.5 trong Terminal Bench Science — nhưng nó đã làm được điều có thể nói là gây xáo trộn hơn.

Opus 5.5: độ chính xác 63,3% với chi phí 23,21 USD mỗi lượt chạy
Sol: độ chính xác 57,0% với chi phí 5,47 USD mỗi lượt chạy

Sol kém hơn 6 điểm phần trăm nhưng có chi phí thấp hơn 4 lần. Câu hỏi đặt ra cho phần lớn công ty không phải là Sol có tốt hơn hay không — mà là liệu chênh lệch 6 điểm có đáng để trả cao hơn 4 lần hay không.

Với phần lớn trường hợp sử dụng, câu trả lời là không. Đây là động lực cạnh tranh mới: hiệu suất trên mỗi đô la, chứ không chỉ là hiệu suất thuần túy. Tính hiệu quả đang trở thành chiến trường thực sự trong việc triển khai mô hình AI.