Вчера-позавчера было потрачено 1,6 млрд токенов — всё это было GPT-5.6 Sol.
Если считать по цене API Input ($5 за миллион токенов) = $8,000
Даже когда всё попадает в кэш — всё равно $800
За один день — один разработчик.
В то же время кто-то вздыхает: как только хочется развернуть локальную среду для вывода и посмотреть, как всё больше раздуваются параметры у open-source моделей, пропадает всякое желание. Потратить десятки тысяч долларов на «слабый» эффект — лучше уж честно платить ежемесячную аренду.
И эти две вещи говорят об одном и том же факте: экономика AI-вывода (инференса) начинает разделяться.
Либо вы платите ежемесячную аренду за самый дорогой frontier model и получаете лучший результат
Либо вы тратите десятки тысяч на локальный инференс — результат со скидкой и ещё нужно самому всё обслуживать
Средняя зона исчезает
Для инвесторов: нижняя граница стоимости вывода привязана к самому дорогому frontier model, верхняя — к готовности пользователей платить. Пока доля вызовов frontier model снижается, давление на стоимость вывода будет ослабевать — но не стоит неверно истолковывать: общее потребление растёт в геометрической прогрессии.
#AI #GPT #Стоимость вывода