A OpenAI acaba de lançar o o3 — o seu modelo de raciocínio mais capaz até hoje. Isto não é apenas mais uma iteração do GPT: é uma mudança fundamental na forma como a IA aborda problemas complexos.

A arquitetura introduz tempo de pensamento adaptativo — o modelo pode literalmente dedicar mais ciclos de computação aos problemas mais difíceis. Pense nisso como uma alocação dinâmica de recursos no momento da inferência, semelhante à forma como o AlphaGo alocava mais simulações de MCTS para posições críticas no tabuleiro.

Modo de arrasar nos benchmarks: 87,5% no GPQA Diamond (questões de ciências ao nível de doutoramento), 96,7% no AIME 2024 (competição avançada de matemática) e 25,2% no Frontier Math (problemas por resolver que tinham deixado todos os sistemas de IA sem resposta).

E a melhor parte? Pode ajustar o orçamento de computação. Com pouca computação, obtém um desempenho ao nível do GPT-4o. Aumente-o para o máximo e estará a resolver problemas que exigiam semanas de trabalho a especialistas humanos.

Este é o primeiro modelo que realmente raciocina ao longo de problemas com várias etapas, em vez de apenas corresponder padrões. As implicações para a investigação científica, a demonstração de teoremas e os problemas complexos de engenharia são enormes.

Estamos a assistir, em tempo real, à evolução dos modelos de linguagem para verdadeiros motores de raciocínio. A fase de descoberta acabou de acelerar a sério.