OpenAI ਦੇ GPT-6 Astra ਨੇ ਆਪਣੇ ਰਿਕਾਰਡ ਵਿੱਚ ਇੱਕ ਅਸਾਧਾਰਨ ਟਰਾਫੀ ਸ਼ਾਮਲ ਕੀਤੀ ਹੈ: ਵਾਲਵ ਦੇ ਆਈਕੋਨਿਕ ਪਹਿਲੇ-ਵਿਅਕਤੀ ਪਜ਼ਲਰ ਪੋਰਟਲ ਦਾ ਇੱਕ ਪੂਰਾ ਪਲੇਥਰੂ, $571.18 ਦੀ ਕੁੱਲ ਗਣਨਾ ਲਾਗਤ 'ਤੇ 24 ਘੰਟਿਆਂ ਤੋਂ ਘੱਟ ਸਮੇਂ ਵਿੱਚ ਖੁਦਮੁਖਤਿਆਰੀ ਨਾਲ ਪੂਰਾ ਹੋਇਆ। ਦ ਵਰਜ ਨੇ 6 ਸਤੰਬਰ, 2026 ਨੂੰ ਮੀਲਪੱਥਰ ਦੀ ਰਿਪੋਰਟ ਕੀਤੀ, ਕੋਜ਼ੀਬਲੇਜ਼ ਵਜੋਂ ਜਾਣੇ ਜਾਂਦੇ ਇੱਕ ਉਪਭੋਗਤਾ ਨੂੰ ਕ੍ਰੈਡਿਟ ਦਿੱਤਾ ਗਿਆ, ਜਿਸ ਨੇ ਫਰੰਟੀਅਰ ਮਾਡਲ ਨੂੰ ਗੇਮ ਤੱਕ ਵਾਇਰ ਕੀਤਾ ਅਤੇ ਇਸਨੂੰ ਬਾਕੀ ਦਾ ਪਤਾ ਲਗਾਉਣ ਦਿੱਤਾ।
ਪੋਰਟਲ ਇੱਕ ਏਆਈ ਏਜੰਟ ਲਈ ਇਸਦੀ ਉਮਰ ਦੇ ਬਾਵਜੂਦ ਇੱਕ ਮੰਗ ਪ੍ਰੀਖਿਆ ਹੈ। 2007 ਵਿੱਚ ਵਾਲਵ ਦੁਆਰਾ ਜਾਰੀ ਕੀਤੀ ਗਈ, ਗੇਮ ਵਿੱਚ ਖਿਡਾਰੀਆਂ ਨੂੰ ਇੱਕ ਪੋਰਟਲ ਬੰਦੂਕ ਦੀ ਵਰਤੋਂ ਕਰਦੇ ਹੋਏ ਸਥਾਨਿਕ ਪਹੇਲੀਆਂ ਬਾਰੇ ਤਰਕ ਕਰਨ ਦੀ ਲੋੜ ਹੁੰਦੀ ਹੈ - ਟੈਸਟ ਚੈਂਬਰਾਂ ਵਿੱਚ ਜਾਣ ਲਈ ਕੰਧਾਂ, ਫ਼ਰਸ਼ਾਂ ਅਤੇ ਛੱਤਾਂ ਵਿੱਚ ਲਿੰਕਡ ਓਪਨਿੰਗ ਬਣਾਉਣਾ ਜੋ ਨਿਯਮਿਤ ਤੌਰ 'ਤੇ ਅਨੁਭਵ ਦੀ ਉਲੰਘਣਾ ਕਰਦੇ ਹਨ। ਇੱਥੇ ਝੁਕਣ ਲਈ ਕੋਈ ਲੜਾਈ ਪੀਸਣ ਦੀ ਲੋੜ ਨਹੀਂ ਹੈ ਅਤੇ ਕੋਈ ਖੋਜ ਮਾਰਕਰ ਨਹੀਂ ਹੈ; ਹਰ ਚੈਂਬਰ ਜ਼ਰੂਰੀ ਤੌਰ 'ਤੇ ਭੌਤਿਕ ਵਿਗਿਆਨ ਦੀ ਬੁਝਾਰਤ ਹੈ। ਪਾਠਕਾਂ ਲਈ ਕਿ ਕਿਵੇਂ ਫਰੰਟੀਅਰ ਮਾਡਲਾਂ ਦੀ ਤਣਾਅ-ਜਾਂਚ ਕੀਤੀ ਜਾ ਰਹੀ ਹੈ, ਇਹ ਦੌੜ ਸਾਡੇ AI ਵਿਕਾਸ ਕਵਰੇਜ ਵਿੱਚ ਇੱਕ ਸਪਸ਼ਟ ਪ੍ਰਵੇਸ਼ ਹੈ।
ਡੈਮੋ ਵੀਡੀਓਜ਼ ਤੋਂ ਲੈ ਕੇ ਪੂਰੀ ਸੰਪੂਰਨਤਾ ਤੱਕ
ਦੌੜ ਕਿਧਰੇ ਵੀ ਨਹੀਂ ਨਿਕਲੀ। ਇਸ ਤੋਂ ਪਹਿਲਾਂ 6 ਸਤੰਬਰ ਨੂੰ, ਹੈਕਰ ਨਿਊਜ਼ 'ਤੇ GPT-6 Astra ਪਲੇਅ ਪੋਰਟਲ ਨੂੰ ਦਿਖਾਉਣ ਵਾਲਾ ਇੱਕ YouTube ਵੀਡੀਓ, ਅਤੇ ਇੱਕ ਫਾਲੋ-ਅਪ ਪੋਸਟ ਜਿਸ ਵਿੱਚ ਨੋਟ ਕੀਤਾ ਗਿਆ ਸੀ ਕਿ ਮਾਡਲ ਨੇ "ਖੁਦਮੁਖਤਿਆਰ ਢੰਗ ਨਾਲ ਪੂਰਾ" ਕਰ ਲਿਆ ਹੈ, ਜਿਵੇਂ ਕਿ ਦਿਨ ਚੜ੍ਹਦਾ ਗਿਆ ਧਿਆਨ ਖਿੱਚਿਆ ਗਿਆ। ਦ ਵਰਜ ਦੀ ਰਿਪੋਰਟ ਨੇ ਵੇਰਵਿਆਂ ਦੀ ਪੁਸ਼ਟੀ ਕੀਤੀ: ਪੂਰੀ ਗੇਮ, 24 ਘੰਟਿਆਂ ਤੋਂ ਘੱਟ ਸਮੇਂ ਵਿੱਚ, ਗਣਨਾ ਵਿੱਚ $600 ਤੋਂ ਘੱਟ ਲਈ - ਸੰਦੇਹਵਾਦੀਆਂ ਲਈ ਪ੍ਰਕਾਸ਼ਿਤ ਦੌੜ ਦੇ ਇੱਕ ਸੰਘਣੇ ਵੀਡੀਓ ਦੇ ਨਾਲ।
ਵਰਜ ਬਿੱਲ ਦੇ ਵਾਤਾਵਰਣਕ ਪੱਖ ਨੂੰ ਮਾਪਣ ਦਾ ਵਿਰੋਧ ਨਹੀਂ ਕਰ ਸਕਿਆ, ਇਹ ਨੋਟ ਕਰਦਿਆਂ ਕਿ ਦੌੜ ਨੇ ਡਾਟਾ ਸੈਂਟਰ ਕੂਲਿੰਗ ਵਿੱਚ ਲਗਭਗ ਇੱਕ ਛੋਟੇ ਸਵਿਮਿੰਗ ਪੂਲ ਦੇ ਪਾਣੀ ਦੀ ਖਪਤ ਕੀਤੀ ਸੀ। ਇਹ ਇੱਕ ਰੀਮਾਈਂਡਰ ਹੈ ਕਿ ਏਜੰਟ ਗੇਮਿੰਗ ਦੌੜਾਂ ਉਪਭੋਗਤਾ ਲਈ ਸਸਤੀਆਂ ਹਨ ਪਰ ਗ੍ਰਹਿ ਲਈ ਮੁਫਤ ਨਹੀਂ ਹਨ।
ਕਿਉਂ ਇੱਕ 2007 ਪਜ਼ਲਰ ਇੱਕ ਗੰਭੀਰ ਬੈਂਚਮਾਰਕ ਹੈ
ਬੀਟਿੰਗ ਪੋਰਟਲ ਏਆਰਸੀ-ਏਜੀਆਈ ਜਾਂ ਐਸਡਬਲਯੂਈ-ਬੈਂਚ ਵਰਗਾ ਕੋਈ ਅਨੁਸੂਚਿਤ ਬੈਂਚਮਾਰਕ ਨਹੀਂ ਹੈ, ਅਤੇ ਇਸ ਲਈ ਅੰਸ਼ਕ ਤੌਰ 'ਤੇ ਇਹ ਗੂੰਜਦਾ ਹੈ। ਗੇਮ ਬਿਲਕੁਲ ਉਨ੍ਹਾਂ ਹੁਨਰਾਂ ਦੀ ਮੰਗ ਕਰਦੀ ਹੈ ਜਿਨ੍ਹਾਂ ਨੇ ਇਤਿਹਾਸਕ ਤੌਰ 'ਤੇ ਮਨੁੱਖਾਂ ਨੂੰ ਏਆਈ ਪ੍ਰਣਾਲੀਆਂ ਤੋਂ ਵੱਖ ਕੀਤਾ ਹੈ:
- ਸਪੇਸ਼ੀਅਲ ਤਰਕ। ਹੱਲਾਂ ਲਈ ਇਹ ਅਨੁਮਾਨ ਲਗਾਉਣ ਦੀ ਲੋੜ ਹੁੰਦੀ ਹੈ ਕਿ ਇੱਕ ਪੋਰਟਲ ਐਗਜ਼ਿਟ ਖਿਡਾਰੀ ਦੇ ਸਰੀਰ ਨੂੰ ਕਿੱਥੇ ਲਾਂਚ ਕਰੇਗਾ — ਤਿੰਨ-ਅਯਾਮੀ ਭੌਤਿਕ ਵਿਗਿਆਨ ਤਰਕ ਜੋ ਸਾਲਾਂ ਤੋਂ ਏਜੰਟਾਂ ਨੂੰ ਟ੍ਰਿਪ ਕਰ ਰਿਹਾ ਹੈ।
- ਲੌਂਗ-ਹੋਰੀਜ਼ਨ ਪਲੈਨਿੰਗ। ਚੈਂਬਰ ਚੇਨ ਮਲਟੀਪਲ ਸਟੈਪਸ; ਅੰਤਮ ਪੜਾਅ ਨੂੰ ਅਸਫਲ ਕਰਨ ਦਾ ਮਤਲਬ ਆਮ ਤੌਰ 'ਤੇ ਸ਼ੁਰੂ ਤੋਂ ਕ੍ਰਮ ਨੂੰ ਦੁਬਾਰਾ ਕਰਨਾ ਹੁੰਦਾ ਹੈ।
- ਹੱਥ ਫੜੇ ਬਿਨਾਂ ਅਸਫਲਤਾ ਤੋਂ ਸਿੱਖਣਾ। ਕੋਈ ਸੰਕੇਤ ਨਹੀਂ ਹਨ। ਏਜੰਟ ਨੂੰ ਅਜ਼ਮਾਇਸ਼ ਅਤੇ ਗਲਤੀ ਦੁਆਰਾ ਗੇਮ ਦੇ ਨਿਯਮਾਂ ਦਾ ਅਨੁਮਾਨ ਲਗਾਉਣਾ ਚਾਹੀਦਾ ਹੈ, ਫਿਰ ਉਹਨਾਂ ਨੂੰ ਨਵੇਂ ਚੈਂਬਰਾਂ ਵਿੱਚ ਸਧਾਰਣ ਕਰਨਾ ਚਾਹੀਦਾ ਹੈ।
ਇਸ ਸਾਲ ਦੇ ਸ਼ੁਰੂ ਵਿੱਚ, ਓਪਨਏਆਈ ਦੇ GPT-6 ਐਸਟਰਾ ਨੇ ਏਜੰਟਿਕ ਤਰਕ 'ਤੇ ਕੇਂਦ੍ਰਿਤ ARC-AGI-3 ਬੈਂਚਮਾਰਕਾਂ ਵਿੱਚ ਸਭ ਤੋਂ ਉੱਪਰ ਹੈ, ਅਤੇ ਮਾਡਲ ਨੇ ਕੰਪਿਊਟਰ-ਵਰਤੋਂ ਸਮਰੱਥਾਵਾਂ ਵੱਲ ਧਿਆਨ ਖਿੱਚਿਆ ਹੈ - ਸਾਫਟਵੇਅਰ ਇੰਟਰਫੇਸ ਨੂੰ ਚਲਾਉਣ ਦੀ ਸਮਰੱਥਾ ਜਿਸ ਤਰ੍ਹਾਂ ਇੱਕ ਵਿਅਕਤੀ ਕਰੇਗਾ। ਪੋਰਟਲ ਰਨ ਉਸੇ ਹੁਨਰ ਦੇ ਸੈੱਟ ਦਾ ਇੱਕ ਚੰਚਲ ਪਰ ਅਸਲ ਪ੍ਰਦਰਸ਼ਨ ਹੈ: ਧਾਰਨਾ, ਯੋਜਨਾਬੰਦੀ, ਅਤੇ ਨਿਯੰਤਰਣ, ਮਨੁੱਖੀ ਦਖਲ ਤੋਂ ਬਿਨਾਂ ਘੰਟਿਆਂ ਲਈ ਅਨਰੋਲ ਕੀਤਾ ਗਿਆ।
ਇੱਕ ਵਿਸ਼ਾਲ ਲਹਿਰ ਦਾ ਹਿੱਸਾ
ਦੌੜ ਇਸ ਗੱਲ ਦਾ ਵੀ ਸੰਕੇਤ ਹੈ ਕਿ AI ਗੇਮਿੰਗ 2026 ਵਿੱਚ ਕਿੱਥੇ ਪਹੁੰਚੀ ਹੈ। ਬੈਂਚਮਾਰਕ ਸਕੋਰ ਹੁਣ ਸੱਭਿਆਚਾਰਕ ਮੀਲਪੱਥਰ ਦੇ ਨਾਲ ਸਪੇਸ ਸਾਂਝੇ ਕਰਦੇ ਹਨ: ਬਾਕ ਕੋਰਲਜ਼ ਨੂੰ ਕੰਪੋਜ਼ ਕਰਨ ਵਾਲੇ ਮਾਡਲ, ਹੱਥ ਲਿਖਤ-ਸੁਧਾਰ ਪਛਾਣ ਟੈਸਟਾਂ ਨੂੰ ਹਰਾਉਂਦੇ ਹੋਏ, ਅਤੇ ਗੇਮਾਂ ਨੂੰ ਪੂਰਾ ਕਰਨਾ ਜੋ ਇੱਕ ਵਾਰ "ਕੰਪਿਊਟਰ ਕਦੇ ਵੀ ਅਜਿਹਾ ਨਹੀਂ ਕਰਨਗੇ" ਵਾਕੰਸ਼ ਲਈ ਖੜ੍ਹੇ ਸਨ। ਹਰ ਪਾਸ ਇੱਕ ਪੁਰਾਣੀ ਪ੍ਰਮਾਣਿਕਤਾ ਤੋਂ ਰਾਹਤ ਦਿੰਦਾ ਹੈ ਅਤੇ ਇਹ ਸਵਾਲ ਉਠਾਉਂਦਾ ਹੈ ਕਿ ਅਗਲਾ ਕੀ ਹੋਵੇਗਾ।
ਵਿਹਾਰਕ ਪ੍ਰਭਾਵ ਵੀ ਹਨ। ਉਹੀ ਲੂਪ ਜੋ ਕੋਜ਼ੀਬਲੇਜ਼ ਦੇ ਸੈਟਅਪ ਨੂੰ ਪੋਰਟਲ ਨੂੰ ਚਲਾਉਣ ਦਿੰਦਾ ਹੈ - ਕੁਝ ਸੌ ਡਾਲਰ ਦੀ ਲਾਗਤ ਨਾਲ ਸਕਰੀਨਸ਼ਾਟ, ਫੈਸਲੇ ਲੈਣ - ਸਾਫਟਵੇਅਰ ਟੈਸਟਿੰਗ, ਰੋਬੋਟਿਕਸ, ਅਤੇ ਕੰਪਿਊਟਰ-ਵਰਤੋਂ ਸਹਾਇਕਾਂ ਲਈ ਤਿਆਰ ਕੀਤਾ ਜਾ ਰਿਹਾ ਲੂਪ ਹੈ। ਇੱਕ ਮਾਡਲ ਜੋ ਇੱਕ ਖੇਡ ਦੇ ਭੌਤਿਕ ਵਿਗਿਆਨ ਨੂੰ ਇੱਕ ਪੂਰੇ ਪਲੇਅਥਰੂ ਲਈ ਧਿਆਨ ਵਿੱਚ ਰੱਖ ਸਕਦਾ ਹੈ, ਜੋ ਸਿਧਾਂਤਕ ਤੌਰ 'ਤੇ, ਲੰਬੇ, ਗੜਬੜ ਵਾਲੇ ਸੌਫਟਵੇਅਰ ਕਾਰਜਾਂ ਨੂੰ ਪੀਸ ਸਕਦਾ ਹੈ ਜੋ ਛੋਟੇ ਸੰਦਰਭ ਪ੍ਰਣਾਲੀਆਂ ਨੂੰ ਹਰਾਉਂਦੇ ਹਨ।
ਫਿਲਹਾਲ, ਹਾਲਾਂਕਿ, ਟੇਕਵੇਅ ਸਰਲ ਹੈ। ਇੱਕ AI ਨੇ ਗੇਮਿੰਗ ਦੀਆਂ ਸਭ ਤੋਂ ਪਿਆਰੀਆਂ ਪਹੇਲੀਆਂ ਵਿੱਚੋਂ ਇੱਕ ਨੂੰ ਹਰਾਇਆ, ਇੱਕ ਨਵੇਂ GPU ਦੇ ਡਿਪਾਜ਼ਿਟ ਦੀ ਕੀਮਤ ਲਈ, ਖਤਮ ਕਰਨਾ ਸ਼ੁਰੂ ਕਰੋ — ਅਤੇ ਵੀਡੀਓ ਪੋਸਟ ਕੀਤਾ। ਅਪਰਚਰ ਸਾਇੰਸ ਦੇ ਟੈਸਟ ਚੈਂਬਰ ਮਨੁੱਖਾਂ ਨੂੰ ਹੁਸ਼ਿਆਰ ਮਹਿਸੂਸ ਕਰਨ ਲਈ ਤਿਆਰ ਕੀਤੇ ਗਏ ਸਨ। ਇਸ ਵੀਕਐਂਡ ਵਿੱਚ, ਉਨ੍ਹਾਂ ਨੇ ਇੱਕ ਮਾਡਲ ਨੂੰ ਸ਼ਾਨਦਾਰ ਰੂਪ ਦਿੱਤਾ।
ਰਨ ਕਿਵੇਂ ਮਿਲੀ
ਜਵਾਬ ਨੇ ਆਮ ਤੌਰ 'ਤੇ AI ਗੇਮਿੰਗ ਮੀਲਪੱਥਰ ਦੇ ਚਾਪ ਨੂੰ ਟਰੈਕ ਕੀਤਾ: ਪਹਿਲਾਂ ਅਵਿਸ਼ਵਾਸ, ਫਿਰ ਵੀਡੀਓ, ਫਿਰ ਸਵੀਕ੍ਰਿਤੀ। ਹੈਕਰ ਨਿਊਜ਼ 'ਤੇ, ਰਨ ਨੇ ਟਿੱਪਣੀ ਕਰਨ ਵਾਲਿਆਂ ਦੀ ਇੱਕ ਸਥਿਰ ਧਾਰਾ ਖਿੱਚੀ ਕਿ ਸੈੱਟਅੱਪ ਕਿਵੇਂ ਕੰਮ ਕਰਦਾ ਹੈ ਅਤੇ ਇਹ ਏਜੰਟ AI ਬਾਰੇ ਕੀ ਸੰਕੇਤ ਕਰਦਾ ਹੈ - ਕਈਆਂ ਨੇ ਨੋਟ ਕੀਤਾ ਕਿ ਕੁੱਲ ਬਿੱਲ ਬਹੁਤ ਸਾਰੇ ਲੋਕਾਂ ਦੇ ਅਨੁਮਾਨ ਤੋਂ ਘੱਟ ਸੀ ਕਿ ਅਜਿਹੀ ਦੌੜ ਦੀ ਲਾਗਤ ਆਵੇਗੀ। ਸੰਪੂਰਨਤਾ ਦੇ ਸੰਘਣੇ ਵੀਡੀਓ ਨੇ ਸੰਦੇਹਵਾਦੀਆਂ ਨੂੰ ਦਾਅਵੇ ਦੀ ਪੁਸ਼ਟੀ ਕਰਨ ਦਾ ਇੱਕ ਤਰੀਕਾ ਦਿੱਤਾ, ਜੋ ਕਿ ਜ਼ਿਆਦਾਤਰ ਬੈਂਚਮਾਰਕ ਨਤੀਜਿਆਂ ਦੀ ਪੇਸ਼ਕਸ਼ ਤੋਂ ਵੱਧ ਹੈ।
ਇਸਨੇ ਪਹਿਲਾਂ ਆਏ ਮੀਲਪੱਥਰਾਂ ਨਾਲ ਤੁਲਨਾ ਕਰਨ ਦਾ ਵੀ ਸੱਦਾ ਦਿੱਤਾ। ਗੇਮਿੰਗ ਨੇ ਬੋਰਡ ਗੇਮਾਂ ਤੋਂ ਲੈ ਕੇ ਓਪਨ-ਐਂਡ ਸੈਂਡਬੌਕਸ ਤੱਕ ਰੀਅਲ-ਟਾਈਮ ਰਣਨੀਤੀ ਤੱਕ, ਖੇਤਰ ਦੇ ਜਨਤਕ ਸਾਬਤ ਕਰਨ ਵਾਲੇ ਮੈਦਾਨ ਵਜੋਂ ਦਹਾਕਿਆਂ ਤੋਂ ਕੰਮ ਕੀਤਾ ਹੈ। ਹਰ ਵਾਰ ਜਦੋਂ ਕੋਈ ਖੇਡ ਡਿੱਗਦੀ ਹੈ, ਤਾਂ ਦਲੀਲ ਬਦਲ ਜਾਂਦੀ ਹੈ: ਅੱਜ ਦੇ ਸੰਦੇਹਵਾਦੀ ਜ਼ੋਰ ਦਿੰਦੇ ਹਨ ਕਿ ਇਹ ਕਾਰਨਾਮਾ ਤੰਗ, ਵਿਸ਼ੇਸ਼, ਜਾਂ ਕਿਸੇ ਤਰੀਕੇ ਨਾਲ ਵਿਸ਼ੇਸ਼ ਸੀ ਜੋ ਆਮ ਨਹੀਂ ਸੀ। ਉਸ ਇਤਿਹਾਸ ਦੇ ਅੰਦਰ ਪੋਰਟਲ ਨੂੰ ਚਲਾਉਣ ਵਾਲੀ ਕਿਹੜੀ ਗੱਲ ਇਹ ਹੈ ਕਿ ਸੈੱਟਅੱਪ ਕਿੰਨਾ ਸਾਧਾਰਨ ਸੀ — ਇੱਕ ਵਪਾਰਕ ਤੌਰ 'ਤੇ ਉਪਲਬਧ ਸਰਹੱਦੀ ਮਾਡਲ, ਇੱਕ ਉਪਭੋਗਤਾ ਗੇਮ, ਅਤੇ ਕੁਝ ਸੌ ਡਾਲਰਾਂ ਦੀ ਗਣਨਾ, ਨਾ ਕਿ ਗੇਮ ਲਈ ਵਿਸ਼ੇਸ਼ ਤੌਰ 'ਤੇ ਸਿਖਲਾਈ ਪ੍ਰਾਪਤ ਇੱਕ ਬੇਸਪੋਕ ਖੋਜ ਪ੍ਰਣਾਲੀ ਦੀ ਬਜਾਏ।
---
AI ਤੋਂ ਅੱਗੇ ਰਹੋਨਵੀਨਤਮ AI ਖਬਰਾਂ, ਵਿਸ਼ਲੇਸ਼ਣ ਅਤੇ ਸਫਲਤਾਵਾਂ ਪ੍ਰਾਪਤ ਕਰੋ - ਸਭ ਇੱਕ ਥਾਂ 'ਤੇ।
ਹੋਰ AI ਖਬਰਾਂ ਪੜ੍ਹੋ →