OpenAI только что представила o3 — свою самую мощную на сегодняшний день модель для решения задач. Это не просто очередная версия GPT, а фундаментальный сдвиг в том, как ИИ справляется со сложными задачами.

В архитектуре появилось адаптивное время на размышления: модель может буквально тратить больше вычислительных ресурсов на более сложные задачи. Представьте себе динамическое распределение ресурсов во время вывода — примерно так же, как AlphaGo запускала бы больше симуляций MCTS для ключевых позиций на доске.

Режим разгрома бенчмарков: 87,5% на GPQA Diamond (вопросы по естественным наукам уровня PhD), 96,7% на AIME 2024 (олимпиада по математике продвинутого уровня) и 25,2% на Frontier Math (ранее нерешённые задачи, поставившие в тупик все системы ИИ).

И вот что особенно важно: бюджет вычислений можно настраивать. При низком уровне вычислений модель показывает результаты на уровне GPT-4o. Увеличьте его до высокого — и она будет решать задачи, на которые у экспертов-людей уходили недели.

Это первая модель, которая действительно рассуждает над многоэтапными задачами, а не просто подбирает совпадения по шаблонам. Последствия для научных исследований, доказательства теорем и сложных инженерных задач колоссальны.

Мы в реальном времени наблюдаем переход от языковых моделей к полноценным механизмам рассуждения. Этап открытий только что резко ускорился.