El GPT-6 Astra de OpenAI ha agregado un trofeo inusual a su récord: un juego completo del icónico portal de rompecabezas en primera persona de Valve, completado de forma autónoma en menos de 24 horas con un costo total de cómputo de $571,18. The Verge informó sobre el hito el 6 de septiembre de 2026, dándole crédito a un usuario conocido como acogedorblaze, quien conectó el modelo fronterizo al juego y le permitió resolver el resto.
Portal es una prueba exigente para un agente de IA a pesar de su antigüedad. Lanzado por Valve en 2007, el juego requiere que los jugadores razonen sobre acertijos espaciales usando una pistola de portal, creando aberturas conectadas en paredes, pisos y techos para moverse a través de cámaras de prueba que rutinariamente desafían la intuición. No hay combates en los que apoyarse ni marcadores de misión que seguir; Cada cámara es esencialmente un acertijo de física. Para los lectores que siguen cómo se prueban los modelos de frontera, esta ejecución es una entrada vívida en nuestra cobertura de desarrollos de IA.
Desde videos de demostración hasta una finalización completa
La carrera no surgió de la nada. A principios del 6 de septiembre, un video de YouTube que mostraba a GPT-6 Astra jugando a Portal circuló en Hacker News, y una publicación de seguimiento que señalaba que el modelo había "completado de forma autónoma" el juego llamó la atención a medida que avanzaba el día. El informe de The Verge confirmó los detalles: el juego completo, completado en menos de 24 horas, por menos de $600 en cómputo, con un video condensado de la carrera publicado para los escépticos.
The Verge no pudo resistirse a cuantificar el aspecto ambiental de la factura, señalando que el recorrido probablemente consumió aproximadamente el agua de una pequeña piscina en el enfriamiento del centro de datos. Es un irónico recordatorio de que los juegos agentes son baratos para el usuario pero no gratuitos para el planeta.
Por qué un rompecabezas de 2007 es un punto de referencia importante
Beating Portal no es un punto de referencia programado como ARC-AGI o SWE-bench, y en parte es por eso que resuena. El juego exige exactamente las habilidades que históricamente han separado a los humanos de los sistemas de IA:
- Razonamiento espacial. Las soluciones requieren predecir dónde la salida de un portal lanzará el cuerpo del jugador: razonamiento de física tridimensional que ha hecho tropezar a los agentes durante años.
- Planificación a largo plazo. Las cámaras encadenan múltiples pasos; fallar en el último paso generalmente significa rehacer la secuencia desde el principio.
- Aprender del fracaso sin tomarse de la mano. No hay pistas. El agente debe inferir las reglas del juego mediante prueba y error y luego generalizarlas a nuevas cámaras.
A principios de este año, el GPT-6 Astra de OpenAI superó los puntos de referencia ARC-AGI-3 centrados en el razonamiento agente, y el modelo ha llamado la atención por las capacidades de uso de la computadora: la capacidad de operar interfaces de software como lo haría una persona. La carrera del Portal es una demostración lúdica pero genuina de ese mismo conjunto de habilidades: percepción, planificación y control, desplegadas durante horas sin intervención humana.
Parte de una ola más amplia
La carrera también es una señal de dónde han aterrizado los juegos de IA en 2026. Las puntuaciones de referencia ahora comparten espacio con hitos culturales: modelos que componen corales de Bach, superan pruebas de reconocimiento de corrección manuscrita y completan juegos que alguna vez representaron la frase "las computadoras nunca harán esto". Cada paso alivia una vieja certeza y plantea la pregunta de cuál será el próximo.
También hay implicaciones prácticas. El mismo bucle que permitió que la configuración de Cozyblaze dirigiera Portal (capturas de pantalla, decisiones, a un costo de unos pocos cientos de dólares) es el bucle que se está desarrollando para pruebas de software, robótica y asistentes de uso de computadoras. Un modelo que puede tener en cuenta la física de un juego durante una partida completa es uno que, en principio, puede realizar tareas de software largas y desordenadas que derrotan a los sistemas de contexto más corto.
Por ahora, sin embargo, la conclusión es más sencilla. Una IA superó uno de los acertijos más queridos de los juegos, de principio a fin, por aproximadamente el precio del depósito de una nueva GPU, y publicó el video. Las cámaras de prueba de Aperture Science fueron diseñadas para hacer que los humanos se sintieran inteligentes. Este fin de semana hicieron lucir fluida a una modelo.
Cómo se recibió la carrera
La respuesta siguió el arco de los hitos de los juegos de IA en general: primero la incredulidad, luego el video y luego la aceptación. En Hacker News, la ejecución atrajo un flujo constante de comentaristas que analizaban cómo funcionaba la configuración y lo que implicaba sobre la IA agente, y varios señalaron que la factura total fue menor de lo que muchos asumieron que costaría dicha ejecución. El vídeo condensado de la finalización dio a los escépticos una manera de verificar la afirmación ellos mismos, que es más de lo que ofrecen la mayoría de los resultados de referencia.
También invitaba a la comparación con los hitos anteriores. Los juegos han servido durante décadas como campo de pruebas público en este campo, desde juegos de mesa hasta estrategia en tiempo real y entornos sandbox abiertos. Cada vez que un juego falla, el argumento cambia: los escépticos de hoy insisten en que la hazaña fue limitada, especializada o especializada de alguna manera no generalizable. Lo que hace que el Portal sea notable dentro de esa historia es lo ordinaria que era la configuración: un modelo de frontera disponible comercialmente, un juego de consumo y unos pocos cientos de dólares en computación, en lugar de un sistema de investigación personalizado entrenado específicamente para el juego.
---
Manténgase a la vanguardia de la IAObtenga las últimas noticias, análisis y avances en IA, todo en un solo lugar.
Leer más noticias sobre IA →