OpenAI GPT-6 Astra přidala ke svému rekordu neobvyklou trofej: kompletní přehrání ikonického hlavolamu z pohledu první osoby Portal od Valve, dokončené autonomně za méně než 24 hodin s celkovými výpočtovými náklady 571,18 $. The Verge ohlásil milník 6. září 2026 a připsal to uživateli známému jako cozyblaze, který zapojil hraniční model do hry a nechal ji, aby vyřešila zbytek.
Portal je pro agenta umělé inteligence náročný test navzdory svému věku. Hra, kterou vydala společnost Valve v roce 2007, vyžaduje, aby hráči uvažovali o prostorových hádankách pomocí portálové pistole – vytvářením propojených otvorů ve stěnách, podlahách a stropech, aby se mohli pohybovat testovacími komorami, které se běžně vzpírají intuici. Neexistuje žádný bojový grind, o který by se člověk mohl opřít, a žádný ukazatel questu, který by se dal sledovat; každá komora je v podstatě fyzikální hádanka. Pro čtenáře, kteří sledují, jak jsou hraniční modely zátěžově testovány, je tento běh živým záznamem v našem [pokrytí vývoje AI] (https://aibuzzwire.news).
Od ukázkových videí k úplnému dokončení
Útěk nepřišel z ničeho nic. Dříve, 6. září, video na YouTube ukazující hru GPT-6 Astra, jak hraje Portal, kolovalo na Hacker News a navazující příspěvek uvádějící, že model „autonomně dokončil“ hru, během dne vzbudilo pozornost. Zpráva The Verge potvrdila podrobnosti: plná hra, poražená za méně než 24 hodin, za méně než 600 dolarů v přepočtu – se zhuštěným videem z běhu zveřejněným pro skeptiky.
The Verge nemohl odolat kvantifikaci environmentální stránky účtu a poznamenal, že běh pravděpodobně spotřeboval zhruba vodu v hodnotě malého bazénu v chlazení datového centra. Je to křivá připomínka, že agentní hraní her je levné pro uživatele, ale není zdarma pro planetu.
Proč je hlavolam z roku 2007 vážným měřítkem
Beating Portal není plánovaný benchmark jako ARC-AGI nebo SWE-bench, a to je částečně důvod, proč rezonuje. Hra vyžaduje přesně ty dovednosti, které historicky oddělovaly lidi od systémů AI:
- Prostorové uvažování. Řešení vyžadují předvídat, kde výstup z portálu spustí hráčovo tělo – trojrozměrné fyzikální uvažování, které agenty po léta podrazilo.
- Plánování s dlouhým horizontem. Komory řetězí několik kroků; neúspěšný poslední krok obvykle znamená opakování sekvence od začátku.
- Učit se z neúspěchu bez držení ruky. Neexistují žádné rady. Agent musí odvodit pravidla hry pomocí pokusů a omylů a poté je zobecnit do nových komnat.
Začátkem tohoto roku OpenAI GPT-6 Astra překonala benchmarky ARC-AGI-3 zaměřené na agentní uvažování a tento model upoutal pozornost na možnosti použití počítače – schopnost ovládat softwarová rozhraní způsobem, jakým by to dělal člověk. Běh portálu je hravou, ale opravdovou ukázkou stejné sady dovedností: vnímání, plánování a ovládání, odvíjené hodiny bez lidského zásahu.
Část širší vlny
Běh je také známkou toho, kam se AI hraní dostalo v roce 2026. Srovnávací výsledky nyní sdílejí prostor s kulturními milníky: modely skládající Bachovy chorály, překonávající ručně psané testy rozpoznávání oprav a dokončující hry, které kdysi zastupovaly frázi „počítače tohle nikdy neudělají“. Každý průchod zbavuje staré jistoty a vyvolává otázku, jaký bude ten další.
Má to i praktické důsledky. Stejná smyčka, která umožnila nastavení cozyblaze řídit Portal – snímky obrazovky, rozhodnutí ven, za cenu několika stovek dolarů – je smyčka, která se vyrábí pro testování softwaru, robotiku a pomocníky při používání počítače. Model, který dokáže udržet fyziku hry v paměti pro celou hru, je model, který se v zásadě dokáže prokousat dlouhými, chaotickými softwarovými úkoly, které porazí systémy s kratším kontextem.
Prozatím je však s sebou jednodušší. Umělá inteligence porazila jednu z nejoblíbenějších herních hádanek, od začátku do konce, přibližně za cenu vkladu nového GPU – a zveřejnila video. Testovací komory Aperture Science byly navrženy tak, aby se lidé cítili chytře. Tento víkend udělali modelku, aby vypadala plynule.
Jak byl běh přijat
Odezva obecně sledovala oblouk herních milníků s umělou inteligencí: nejprve nedůvěra, pak video a poté přijetí. Na Hacker News běh přitahoval stálý proud komentátorů, kteří rozebírali, jak nastavení fungovalo a co to implikovalo o agentní AI – s několika poznámkami, že celkový účet byl nižší, než mnozí předpokládali, že by takový běh stál. Zhuštěné video z dokončení poskytlo skeptikům způsob, jak si tvrzení sami ověřit, což je více, než nabízí většina výsledků benchmarků.
Vyzvala také ke srovnání s milníky, které nastaly dříve. Hraní sloužilo po desetiletí jako veřejný zkušební prostor, od deskových her přes strategie v reálném čase až po sandboxy s otevřeným koncem. Pokaždé, když hra padne, argument se posune: dnešní skeptici trvají na tom, že tento výkon byl úzký, specializovaný nebo nějakým způsobem specializovaný, nezobecněný. To, co dělá Portal v této historii pozoruhodným, je to, jak obyčejné bylo nastavení - komerčně dostupný hraniční model, spotřebitelská hra a několik set dolarů výpočetní techniky, spíše než zakázkový výzkumný systém trénovaný speciálně pro tuto hru.
---
Stay Ahead of AIZískejte nejnovější zprávy, analýzy a průlomové informace o umělé inteligenci – vše na jednom místě.
Přečtěte si další zprávy o AI →