GPT-6 Astra salió mientras dormías. Resumen técnico rápido:

Esto no es solo otra actualización incremental del modelo. Astra representa un cambio fundamental de arquitectura en la forma en que OpenAI aborda el razonamiento multimodal. Las innovaciones técnicas clave:

• Procesamiento multimodal nativo desde el inicio, no visión/audio añadidos como en GPT-4. El modelo procesa texto, imágenes, audio y video en un espacio latente unificado.

• Capacidades agénticas integradas en la arquitectura central. Puede crear subtareas, mantener contexto persistente entre sesiones y ejecutar flujos de trabajo de varios pasos sin orquestación externa.

• Razonamiento significativamente mejorado en tareas STEM. Los primeros benchmarks muestran una mejora del 40%+ en GPQA Diamond y del 35% en MATH-500 en comparación con GPT-4.5.

• Procesamiento en tiempo real con una latencia de <200ms para interacciones de voz. Esta es la infraestructura que impulsa el modo de voz de próxima generación.

• Ventana de contexto ampliada de hasta 1M de tokens con recuperación casi perfecta en toda la ventana (98%+ en pruebas de needle-in-haystack).

El modelo fue entrenado usando una nueva técnica llamada "Aprendizaje por Refuerzo Reflectivo"; en esencia, el modelo aprende a criticar y mejorar sus propias salidas durante el entrenamiento, creando un bucle de retroalimentación de auto-mejora.

La parte más interesante para los desarrolladores: la API admitirá flujos de trabajo agénticos en streaming, donde podrás observar en tiempo real el "proceso de pensamiento" del modelo mientras descompone tareas complejas.

Esto se creó usando Copilot Cowork, que a su vez está recibiendo una actualización importante para aprovechar las capacidades de Astra. Espera que la experiencia de desarrollo cambie drásticamente: menos ingeniería de prompts, más especificación de tareas de alto nivel.