$SOL $ANTHROPIC
Sol do OpenAI GPT-6.1: aproximando a flagship Astra, por apenas um quinto do preço
A OpenAI anunciou o GPT-6.1 Sol no DevDay, o seu evento para desenvolvedores de 29 de setembro. De acordo com o blog oficial da OpenAI, o novo modelo tem desempenho próximo ao do flagship GPT-6 Astra em desenvolvimento de código com agentes, operação de computador e trabalhos profissionais, mas com apenas um quinto do preço padrão de entrada e saída da Astra. A precificação de API é de US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída; a entrada com cache para reutilização de contexto custa apenas US$ 0,1, o que representa 95% mais barato do que a entrada padrão e também metade do preço do cache do GPT-6 Sol. O GPT-6.1 Sol é uma versão aprimorada do GPT-6 Sol, lançado apenas em 22 de setembro. No dia anterior ao DevDay, circulou a notícia de que a OpenAI teria desistido de lançar o GPT-6.1 Astra, por causa de uma avaliação de segurança que não atingiu o padrão; um porta-voz da OpenAI disse na época que outros modelos seriam lançados em breve.
DeepSWE iguala a Astra: tarefas científicas custam US$ 5,47 por questão. Nos testes divulgados pela OpenAI, o GPT-6.1 Sol no teste de engenharia de software DeepSWE v1.1 em repositórios reais de código empatou o GPT-6 Astra, com custo de cerca de um quinto, além de superar o melhor desempenho do GPT-6 Sol em 6,4 pontos percentuais.
No teste de operação de computador, o OSWorld 2.0 ficou 7 pontos percentuais acima do GPT-6 Sol, e ficou apenas 2,1 pontos percentuais atrás da Astra, com custo por questão de cerca de um sétimo do da Astra.
A OpenAI também comparou com modelos da Anthropic. No teste GDP.pdf, que avalia a capacidade de interpretar PDFs complexos, o GPT-6.1 Sol teve pontuação superior à do Claude Opus em 5,5, com custo por questão abaixo da metade. No teste AutomationBench, de fluxos comerciais em múltiplas etapas, sob intensidade de raciocínio moderada, ficou 2,2 pontos percentuais acima do Opus 5,5, com custo de cerca de um terço.
A diferença de custo mais evidente aparece no teste de pesquisa científica Terminal-Bench Science. No maior nível de intensidade de raciocínio, o GPT-6.1 Sol tem em média US$ 5,47 por questão; o Opus 5.5 fica em US$ 23,21; e o Astra em US$ 23,80. Ainda assim, a Astra segue com 68,1% para conquistar a pontuação mais alta, e a OpenAI recomenda usar a Astra nas tarefas de pesquisa científica mais difíceis.
Em erros factuais: em perguntas difíceis relatadas pelos usuários como casos em que modelos anteriores erraram, a proporção de respostas com erro em nível de baixa intensidade de raciocínio caiu de 11,4% do GPT-6 Sol para 7,7%.
A OpenAI também apontou em testes de segurança que, quando a ferramenta de busca falha, a proporção de vezes em que o GPT-6.1 Sol não informa o usuário de forma verdadeira é de 2,1%; no GPT-6 Sol, 4,9%; e na Astra, 1,5%.
Usuários acima do Plus podem usar o GPT-6.1 Sol a partir de agora no ChatGPT Work e no Codex: estão liberados os usuários Plus, Pro, Business, Enterprise e Edu para usar no ChatGPT Work e Codex. A interface geral de conversas do ChatGPT, por enquanto, não permite selecionar. Desenvolvedores podem chamar via API usando gpt-6.1-sol.
O perfil de desenvolvedor da OpenAI afirma que o GPT-6.1 Sol é o mais indicado para tarefas de agentes voltadas a grandes refactors de código, investigação profunda de repositórios e execução por longos períodos.
Ultrafast: 300 tokens por segundo; o Pro 500 usa 25 vezes mais que o Plus. Lançado junto, o Ultrafast é a nova camada paga de aceleração da OpenAI. Segundo a conta oficial da OpenAI no X, o Ultrafast na Codex gera até 8 vezes mais rápido, chegando a 300 tokens por segundo; e na API, até 6 vezes mais rápido.
O Ultrafast já começa a oferecer suporte primeiro ao GPT-6 Astra, que pode ser usado no Codex, ChatGPT Work e na API; a versão GPT-6.1 Sol será lançada nos próximos dias. Para usar o Ultrafast no Codex e no ChatGPT Work, é necessário assinar o novo plano Pro 500 — que também é o plano com maior limite de uso da OpenAI, com cota de 25 vezes a do Plus.
Este artigo “Sol do OpenAI GPT-6.1: aproximando a flagship Astra, por apenas um quinto do preço” apareceu pela primeira vez em .
Sol do OpenAI GPT-6.1: aproximando a flagship Astra, por apenas um quinto do preço
A OpenAI anunciou o GPT-6.1 Sol no DevDay, o seu evento para desenvolvedores de 29 de setembro. De acordo com o blog oficial da OpenAI, o novo modelo tem desempenho próximo ao do flagship GPT-6 Astra em desenvolvimento de código com agentes, operação de computador e trabalhos profissionais, mas com apenas um quinto do preço padrão de entrada e saída da Astra. A precificação de API é de US$ 2 por milhão de tokens de entrada e US$ 10 por milhão de tokens de saída; a entrada com cache para reutilização de contexto custa apenas US$ 0,1, o que representa 95% mais barato do que a entrada padrão e também metade do preço do cache do GPT-6 Sol. O GPT-6.1 Sol é uma versão aprimorada do GPT-6 Sol, lançado apenas em 22 de setembro. No dia anterior ao DevDay, circulou a notícia de que a OpenAI teria desistido de lançar o GPT-6.1 Astra, por causa de uma avaliação de segurança que não atingiu o padrão; um porta-voz da OpenAI disse na época que outros modelos seriam lançados em breve.
DeepSWE iguala a Astra: tarefas científicas custam US$ 5,47 por questão. Nos testes divulgados pela OpenAI, o GPT-6.1 Sol no teste de engenharia de software DeepSWE v1.1 em repositórios reais de código empatou o GPT-6 Astra, com custo de cerca de um quinto, além de superar o melhor desempenho do GPT-6 Sol em 6,4 pontos percentuais.
No teste de operação de computador, o OSWorld 2.0 ficou 7 pontos percentuais acima do GPT-6 Sol, e ficou apenas 2,1 pontos percentuais atrás da Astra, com custo por questão de cerca de um sétimo do da Astra.
A OpenAI também comparou com modelos da Anthropic. No teste GDP.pdf, que avalia a capacidade de interpretar PDFs complexos, o GPT-6.1 Sol teve pontuação superior à do Claude Opus em 5,5, com custo por questão abaixo da metade. No teste AutomationBench, de fluxos comerciais em múltiplas etapas, sob intensidade de raciocínio moderada, ficou 2,2 pontos percentuais acima do Opus 5,5, com custo de cerca de um terço.
A diferença de custo mais evidente aparece no teste de pesquisa científica Terminal-Bench Science. No maior nível de intensidade de raciocínio, o GPT-6.1 Sol tem em média US$ 5,47 por questão; o Opus 5.5 fica em US$ 23,21; e o Astra em US$ 23,80. Ainda assim, a Astra segue com 68,1% para conquistar a pontuação mais alta, e a OpenAI recomenda usar a Astra nas tarefas de pesquisa científica mais difíceis.
Em erros factuais: em perguntas difíceis relatadas pelos usuários como casos em que modelos anteriores erraram, a proporção de respostas com erro em nível de baixa intensidade de raciocínio caiu de 11,4% do GPT-6 Sol para 7,7%.
A OpenAI também apontou em testes de segurança que, quando a ferramenta de busca falha, a proporção de vezes em que o GPT-6.1 Sol não informa o usuário de forma verdadeira é de 2,1%; no GPT-6 Sol, 4,9%; e na Astra, 1,5%.
Usuários acima do Plus podem usar o GPT-6.1 Sol a partir de agora no ChatGPT Work e no Codex: estão liberados os usuários Plus, Pro, Business, Enterprise e Edu para usar no ChatGPT Work e Codex. A interface geral de conversas do ChatGPT, por enquanto, não permite selecionar. Desenvolvedores podem chamar via API usando gpt-6.1-sol.
O perfil de desenvolvedor da OpenAI afirma que o GPT-6.1 Sol é o mais indicado para tarefas de agentes voltadas a grandes refactors de código, investigação profunda de repositórios e execução por longos períodos.
Ultrafast: 300 tokens por segundo; o Pro 500 usa 25 vezes mais que o Plus. Lançado junto, o Ultrafast é a nova camada paga de aceleração da OpenAI. Segundo a conta oficial da OpenAI no X, o Ultrafast na Codex gera até 8 vezes mais rápido, chegando a 300 tokens por segundo; e na API, até 6 vezes mais rápido.
O Ultrafast já começa a oferecer suporte primeiro ao GPT-6 Astra, que pode ser usado no Codex, ChatGPT Work e na API; a versão GPT-6.1 Sol será lançada nos próximos dias. Para usar o Ultrafast no Codex e no ChatGPT Work, é necessário assinar o novo plano Pro 500 — que também é o plano com maior limite de uso da OpenAI, com cota de 25 vezes a do Plus.
Este artigo “Sol do OpenAI GPT-6.1: aproximando a flagship Astra, por apenas um quinto do preço” apareceu pela primeira vez em .

