$SOL $ANTHROPIC
OpenAI GPT-6.1 Sol:se acerca al buque insignia Astra, y el precio es solo una quinta parte

El 29 de septiembre, OpenAI presentó GPT-6.1 Sol en su conferencia para desarrolladores DevDay. Según el blog oficial de OpenAI, el nuevo modelo muestra un rendimiento cercano al de su buque insignia GPT-6 Astra en desarrollo de software mediante programación por agentes, control de computadoras y trabajos profesionales, pero con un precio de entrada y salida estándar que es solo una quinta parte del de Astra. La tarifa de API es de 2 dólares por cada millón de tokens de entrada y 10 dólares por cada millón de tokens de salida. La entrada con caché por reutilización de contexto cuesta solo 0.1 dólar, es decir, 95% más barata que la entrada estándar, y también a la mitad del precio en caché de GPT-6 Sol. GPT-6.1 Sol es una versión mejorada de GPT-6 Sol, que se lanzó recién el 22 de septiembre. Un día antes de DevDay, se rumoreó que OpenAI había descartado publicar GPT-6.1 Astra, debido a que la evaluación de seguridad no alcanzó el umbral; en ese momento, un portavoz de OpenAI señaló que se lanzarían otros modelos próximamente.

DeepSWE empata a Astra: en tareas científicas, el costo es de 5.47 dólares por problema. En las pruebas publicadas por OpenAI, GPT-6.1 Sol en el examen de ingeniería de software DeepSWE v1.1 sobre repositorios de código reales empata con GPT-6 Astra; el costo es de aproximadamente una quinta parte y, además, supera el mejor desempeño de GPT-6 Sol en 6.4 puntos porcentuales. En las pruebas de operación de computadora, OSWorld 2.0 obtiene 7 puntos porcentuales más que GPT-6 Sol, y queda a solo 2.1 puntos porcentuales de Astra, con un costo por problema de aproximadamente una séptima parte del de Astra.

OpenAI también compara con modelos de Anthropic. En el test GDP.pdf, que evalúa la capacidad de comprender PDFs complejos, la puntuación de GPT-6.1 Sol es 5.5 puntos más alta que la de Claude Opus, con un costo por problema de menos de la mitad. En AutomationBench, una prueba de procesos comerciales de varios pasos, con una intensidad media de razonamiento, GPT-6.1 Sol supera a Opus en 2.2 puntos porcentuales, y el costo ronda un tercio.

La brecha de costos más marcada aparece en el test de investigación científica Terminal-Bench Science. Con la máxima intensidad de razonamiento, GPT-6.1 Sol promedia 5.47 dólares por problema; Opus 5.5 cuesta 23.21 dólares y Astra 23.80 dólares. Sin embargo, Astra aún se queda con la puntuación máxima con 68.1%, y OpenAI sugiere que incluso para las tareas científicas más difíciles se use Astra.

En cuanto a errores factuales: en preguntas difíciles reportadas por usuarios donde los modelos anteriores se equivocaron, la proporción de respuestas con errores bajo baja intensidad de razonamiento disminuyó del 11.4% de GPT-6 Sol al 7.7%. En pruebas de seguridad adicionales, OpenAI señaló que, cuando falla la herramienta de búsqueda, la proporción en la que GPT-6.1 Sol no informa con veracidad al usuario es de 2.1%; en GPT-6 Sol es 4.9%, y en Astra, 1.5%.

Los usuarios de Plus y superiores pueden usar GPT-6.1 Sol en ChatGPT Work y Codex a partir de ahora: Plus, Pro, Business, Enterprise y Edu. Por el momento, el ChatGPT general no puede seleccionar esta opción en la interfaz de conversación. Los desarrolladores pueden llamar al modelo mediante API usando gpt-6.1-sol.

La cuenta de desarrolladores de OpenAI indica que GPT-6.1 Sol es el más adecuado para tareas de agentes de gran reestructuración de software, seguimiento profundo del código y ejecuciones prolongadas.

Ultrafast: 300 tokens por segundo; el plan Pro 500 usa 25 veces más que Plus. Ultrafast, presentado junto con esto, es el nuevo nivel de aceleración de pago de OpenAI. Según la cuenta oficial de X de OpenAI, en Codex Ultrafast logra hasta 8 veces más velocidad de generación, alcanzando hasta 300 tokens por segundo, y en la API puede ser hasta 6 veces más rápido. Ultrafast empezará a admitir primero la variante GPT-6 Astra, que puede usarse en Codex, ChatGPT Work y la API; la versión GPT-6.1 Sol llegará en los próximos días.

Para usar Ultrafast en Codex y ChatGPT Work se requiere suscribirse al nuevo plan Pro 500, que además es el plan con el mayor tope de uso de OpenAI: su asignación equivale a 25 veces la de Plus.

Este artículo OpenAI GPT-6.1 Sol:se acerca al buque insignia Astra, y el precio es solo una quinta parte apareció por primera vez en .