OpenAI ha solucionado tres defectos que, según dice, explican una semana de quejas de los usuarios de que GPT-6 Astra, su modelo fronterizo más nuevo, se había vuelto más tonto desde su lanzamiento, y está restableciendo los límites de uso para los suscriptores del Codex como una especie de disculpa. La actualización provino del líder de producto del Codex, Tibo Sottiaux, quien dijo que el equipo trabajó con los usuarios para rastrear las fallas, luego envió correcciones y un reinicio completo del uso antes de la medianoche, hora local, según una actualización publicada el sábado.
La admisión cierra un tramo difícil para lo que OpenAI ha anunciado como su modelo más capaz hasta la fecha. Desde que Astra alcanzó una amplia disponibilidad a principios de septiembre, los desarrolladores de X habían estado ejecutando indicaciones idénticas contra el Astra del día del lanzamiento y la versión actual, manteniendo todas las configuraciones iguales y publicando comparaciones lado a lado que parecían mostrar un modelo silenciosamente debilitado. Para obtener más información sobre los modelos que impulsan este debate, consulte nuestra cobertura de últimos desarrollos de IA.
Los Tres Defectos, Nombrados
Según Sottiaux, el primer culpable fueron las habilidades: archivos de aviso escritos para modelos anteriores que se activaban con demasiada frecuencia en Astra, lo que a veces impedía que el modelo verificara su propio trabajo. El segundo fue un experimento opcional de gestión de contexto que podría hacer que el modelo se cerrara antes de tiempo o respondiera a mensajes obsoletos. OpenAI deshabilitó el experimento después de que aproximadamente entre 4.000 y 5.000 usuarios se vieran afectados, dijo la compañía.
El tercer defecto tenía que ver con la infraestructura más que con el modelo en sí: algunos motores de inferencia se habían configurado incorrectamente y la calidad del tráfico de cola que se enrutaba a través de ellos se degradaba de manera mensurable. OpenAI eliminó esos motores e hizo varias reparaciones menores. Sottiaux escribió que el modelo ahora rastrea con mayor precisión el último mensaje de un usuario, un guiño a las quejas de que Astra había estado respondiendo preguntas que el usuario ya había dejado atrás.
Los desarrolladores ya habían seguido adelante
Las quejas se acumularon a lo largo de la semana. El desarrollador Pranjal Paliwal, que había elogiado a Astra días antes, volvió a leer el código que había escrito para él y luego calificó el resultado como una regresión en lugar de un progreso. Dax Raad, que crea la herramienta de codificación Opencode, volvió a trasladar a su equipo al antiguo GPT-5.6 Sol después de que el gasto en Astra se duplicara por desventajas que consideró que no valían la pena. Un usuario del foro describió que Astra ahora está al mismo nivel que Sol en tareas idénticas, con los mismos reintentos.
No todos aceptaron esa lectura. Un usuario seudónimo que escribía como Antikythera argumentó que la modelo siempre había sido perezosa y aficionada a las viñetas, y que los usuarios simplemente habían dejado de deslumbrarse. Ese desacuerdo refleja lo difícil que es resolver los reclamos sobre la calidad del modelo: indicaciones idénticas, veredictos diferentes.
Problema de capacidad en segundo plano
La disputa por la calidad aterrizó, mientras que la capacidad ha ensombrecido el lanzamiento. OpenAI redujo los límites de uso de Astra para los usuarios habituales de ChatGPT según los informes de los usuarios y suspendió las nuevas suscripciones Pro de $ 200, un paso que Sottiaux confirmó el 10 de septiembre, citando la demanda. El modelo todavía cuesta $10 por millón de tokens de entrada y $50 por millón de tokens de salida, que es 2,5 veces lo que Sol cobró cuando se lanzó.
También hay un precedente incómodo: este es el segundo buque insignia de OpenAI en dos meses que genera la misma acusación por parte de los usuarios de pago. En julio, los usuarios dijeron que el modo de razonamiento superior de Sol se había vuelto superficial de la noche a la mañana. Sottiaux negó haberlo debilitado deliberadamente en ese momento, aunque confirmó que la empresa había estado experimentando con esfuerzos de razonamiento. Los ciclos repetidos de "el modelo empeoró" seguidos de "encontramos defectos" se están convirtiendo en un patrón que la empresa tendrá que gestionar: la transparencia ayuda, pero también la estabilidad.
El propio consejo de OpenAI: utilice menos barreras de seguridad
Además de las correcciones, OpenAI publicó una guía de migración del ingeniero Eric Provencher que equivale a una recomendación contradictoria: los modelos más capaces necesitan menos apoyo. Las descripciones de habilidades demasiado largas, los requisitos generales de lectura y las reglas de aprobación rígidas pueden obstaculizar el camino de Astra, según la guía. Las instrucciones que se han acumulado con el tiempo pueden corroer el contexto o hacer que el modelo deje de funcionar demasiado pronto.
Provencher recomienda que los equipos revisen sus habilidades, los archivos AGENTS.md y las indicaciones de tareas cada vez que cambien de modelo, vinculen estrechamente las instrucciones con tareas específicas y definan claramente cuándo se realiza un trabajo, porque incluso sin restricciones, Astra puede detenerse antes que GPT-5.6 Sol. Los equipos que bloquearon las cosas después de que los modelos anteriores se volvieron deshonestos deberían revisar esas reglas: Astra tiene mejor juicio, argumenta la publicación, pero puede interpretar las viejas restricciones tan literalmente que se detiene cuando quieres que continúe.
¿Qué pasa después?
El reinicio de uso brinda a los suscriptores del Codex un borrón y cuenta nueva para reevaluar el modelo, y OpenAI observará las mismas pruebas en paralelo que ejecutan sus usuarios. La cuestión más profunda es la confianza: los desarrolladores que pagan y que vieron un buque insignia degradarse una semana después del lanzamiento ahora tienen una explicación documentada, tres defectos nombrados y un reinicio, pero también una nueva razón para comparar cada actualización del modelo con el día en que se lanzó.
Manténgase a la vanguardia de la IA
Lanzamientos de modelos, autopsias de defectos y las herramientas que remodelan el trabajo del software: se rastrean todos los días.
Leer más noticias sobre IA →