**OpenAI** reconoció que las quejas de los usuarios durante una semana sobre que el nuevo modelo GPT-6 Astra “se volvió más tonto después del lanzamiento” eran ciertas, y afirmó que corrigió tres fallas que habrían provocado esto. Al mismo tiempo, volvió a establecer el límite de uso para los suscriptores de Codex.

contenido clave

  • Los usuarios de Astra han realizado pruebas comparativas lado a lado entre la versión justo después del lanzamiento y la versión actual, y han sostenido que el modelo ha sido “degradado” en silencio (reducción del rendimiento).

  • Tibo Sottiaux, director general de Codex de OpenAI, dio a conocer tres causas; una de ellas fue un experimento de contexto en el que participaron aproximadamente entre 4.000 y 5.000 personas.

  • El modelo insignia anterior, GPT-5.6 Sol, también se vio envuelto en las mismas sospechas en julio.

OpenAI, parche de emergencia por fallas en la calidad de Astra

El responsable general del producto Códex, Tibo Sotiyo, explicó que, mediante una actualización publicada el sábado (hora local), el equipo primero rastreó los defectos junto con los usuarios y luego desplegó los parches de corrección, reiniciando por completo el límite de uso antes de la medianoche.

Aclaró que ‘skills’ diseñadas para modelos de generaciones anteriores se activaban de forma excesiva incluso en Astra, lo que a veces impedía el proceso mediante el cual el modelo revalidaba por sí mismo los resultados.

También fue un problema el ‘experimento de gestión de contexto’, que era una opción de selección. Con esa función experimental activada, se repitieron casos en los que el modelo terminaba la conversación demasiado pronto o respondía a mensajes que ya eran antiguos. OpenAI estimó que los usuarios expuestos a este experimento rondaban entre 4.000 y 5.000 personas, y desactivó por completo la función de prueba.

Además, se descubrió que algunos ajustes del motor estaban configurados incorrectamente, lo que hacía que la calidad de las respuestas del ‘tail traffic’ enrutado a través de ese motor cayera de manera estadísticamente significativa. La empresa eliminó esos motores y aplicó, en paralelo, varios cambios pequeños. Luego, Sotiyo dijo en una publicación que “Astra ahora rastrea con más precisión el ‘último mensaje’ del usuario”.

A tener en cuenta: Ethereum, con entrada de 2160 millones de dólares a los fondos cotizados (ETF), pero con la carga de un muro de oferta de 2800 dólares

“Retroceso de habilidades para programar”… movimiento para esquivar Astra

La polémica se propagó durante toda una semana en X (antes Twitter). Los desarrolladores aplicaron el mismo prompt y los mismos ajustes en el día de lanzamiento de Astra y en la versión actual, generaron código y luego compararon los resultados lado a lado.

Hasta hace apenas unos días, el desarrollador **Pranjal Paliwal** había elogiado encarecidamente a Astra; pero, tras revisar de nuevo el código que el modelo escribió para él, invirtió la evaluación y lo calificó como “retroceso, no progreso”.

Dax Raad, quien desarrolla la herramienta de código ‘OpenCode’, considera que, aunque después de pasarse a Astra el costo se duplicó, el rendimiento percibido en realidad bajó. Por eso, su equipo volvió a cambiarse de nuevo al Sol GPT-5.6, más antiguo.

Un usuario de la comunidad de OpenAI analizó en un post que, mediante el informe, “ahora Astra tiene prácticamente el mismo nivel de rendimiento que Sol, con el mismo trabajo y las mismas condiciones de reintento”. No obstante, no todos están de acuerdo. Otro usuario que firma como ‘Antikythera’ rebatió: “Astra ya era perezosa desde el principio y llenaba de viñetas (bullet points) sin parar; ahora los usuarios por fin se han quitado la venda”.

Capacidad y límites de tarifas que aplastan a Astra de GPT-6

El problema de la capacidad (capacity) empezó a seguir a Astra como una sombra desde el momento en que entró en la fase de gran despliegue a inicios de septiembre.

Según reportes de los usuarios, OpenAI redujo drásticamente el límite de uso de Astra de algunas cuentas de ChatGPT clasificadas como usuarios pesados, y además se suspendió temporalmente la nueva suscripción Pro de 200 dólares al mes. Esta medida fue confirmada de forma oficial por Sotiyo en una entrada de blog fechada el 10 de septiembre.

En la actualidad, el precio de Astra se establece en 10 dólares por cada 1 millón de tokens de entrada y 50 dólares por cada 1 millón de tokens de salida. Es alrededor de 2,5 veces el precio que Sol recibía en el momento del lanzamiento. Incluso considerando que se trata de un modelo de alto rendimiento, el trasfondo es que crecen las discusiones sobre la relación costo-eficiencia.

Esta controversia también es un caso en el que dos veces seguidas, en menos de dos meses, el modelo insignia de OpenAI recibió críticas similares. En julio, surgieron comentarios de que el modo de inferencia de máxima dificultad de Sol “cambió superficialmente en una sola noche”, y en ese entonces Sotiyo sólo reconoció que se realizaban “experimentos sobre el esfuerzo de razonamiento (reasoning effort)”, negando que hubiera un descenso deliberado del rendimiento.

Para seguir leyendo: Jensen Huang de NVIDIA “El miedo a la seguridad de la IA es una buena noticia para las empresas de ciberseguridad”