ਏਆਈ ਖੋਜ
50 articles
GPT-6 Astra ਪੋਸਟਾਂ ਅਤਿ-ਆਧੁਨਿਕ ARC-AGI-3 ਸਕੋਰ, ਐਕਸ਼ਨ ਕੁਸ਼ਲਤਾ 'ਤੇ ਮਨੁੱਖਾਂ ਨੂੰ ਪਛਾੜਦੀਆਂ ਹਨ
ARC ਪ੍ਰਾਈਜ਼ ਦੀਆਂ ਰਿਪੋਰਟਾਂ GPT-6 Astra ਨੇ ARC-AGI-3 'ਤੇ ਪ੍ਰਦਾਤਾ ਦੀ ਵਰਤੋਂ ਨਾਲ 99.9% ਅਤੇ ਮਿਆਰੀ ਨਿਯਮਾਂ ਦੇ ਤਹਿਤ 62.7% ਸਕੋਰ ਪ੍ਰਾਪਤ ਕੀਤੇ, 96% ਪੱਧਰਾਂ 'ਤੇ ਮਨੁੱਖੀ ਕਿਰਿਆ ਕੁਸ਼ਲਤਾ ਨੂੰ ਮਾਤ ਦਿੱਤੀ।
Google DeepMind ਨੇ WeatherNext 3 ਲਾਂਚ ਕੀਤਾ, ਇੱਕ AI ਮੌਸਮ ਮਾਡਲ ਜਿਸ ਵਿੱਚ ਹਰ ਘੰਟੇ 5 ਕਿਲੋਮੀਟਰ ਦੀ ਪੂਰਵ ਅਨੁਮਾਨ ਹੈ
Google DeepMind's WeatherNext 3 ਲਾਈਵ ਸੈਟੇਲਾਈਟ ਡੇਟਾ ਦੀ ਵਰਤੋਂ ਕਰਦੇ ਹੋਏ, ਹੁਣ ਖੋਜ, ਨਕਸ਼ੇ, ਜੇਮਿਨੀ ਅਤੇ ਕਲਾਉਡ ਵਿੱਚ ਲਾਈਵ 5 ਕਿਲੋਮੀਟਰ ਰੈਜ਼ੋਲਿਊਸ਼ਨ 'ਤੇ ਪ੍ਰਤੀ ਘੰਟਾ AI ਮੌਸਮ ਪੂਰਵ ਅਨੁਮਾਨ ਪ੍ਰਦਾਨ ਕਰਦਾ ਹੈ।
NSF ਨੇ SDSC ਅਤੇ TACC ਦੀ ਅਗਵਾਈ ਵਾਲੇ ਰਾਸ਼ਟਰੀ AI ਖੋਜ ਸੰਸਾਧਨ ਸੰਚਾਲਨ ਕੇਂਦਰ ਨੂੰ ਸ਼ੁਰੂ ਕਰਨ ਲਈ $35 ਮਿਲੀਅਨ ਅਵਾਰਡ ਦਿੱਤੇ
ਨੈਸ਼ਨਲ ਸਾਇੰਸ ਫਾਊਂਡੇਸ਼ਨ ਨੇ ਏਆਈ ਖੋਜ ਸਰੋਤ ਨੂੰ ਪਾਇਲਟ ਤੋਂ ਸਥਾਈ ਬੁਨਿਆਦੀ ਢਾਂਚੇ ਵਿੱਚ ਤਬਦੀਲ ਕਰਦੇ ਹੋਏ, NAIRR ਓਪਰੇਸ਼ਨ ਸੈਂਟਰ ਨੂੰ ਚਲਾਉਣ ਲਈ UC ਸੈਨ ਡਿਏਗੋ ਦੇ SDSC ਅਤੇ UT ਆਸਟਿਨ ਦੇ TACC ਨੂੰ ਪੰਜ ਸਾਲਾਂ ਵਿੱਚ $35 ਮਿਲੀਅਨ ਦਾ ਇਨਾਮ ਦਿੱਤਾ।
'ਆਵਰਤੀ ਡੂੰਘਾਈ' ਤਰਕ ਦੀ ਵਰਤੋਂ ਕਰਨ ਲਈ ਓਪਨਏਆਈ ਦਾ ਐਸਟਰਾ, ਅਤੇ ਸੁਰੱਖਿਆ ਮਾਹਰ ਚਿੰਤਤ ਹਨ
ਸੂਚਨਾ ਰਿਪੋਰਟਾਂ ਓਪਨਏਆਈ ਦਾ ਐਸਟਰਾ 'ਆਵਰਤੀ ਡੂੰਘਾਈ' ਤਰਕ ਦੀ ਵਰਤੋਂ ਕਰੇਗਾ ਜੋ ਸੁਰੱਖਿਆ ਮਾਹਰਾਂ ਨੂੰ ਚਿੰਤਾਜਨਕ, ਨਿਗਰਾਨੀ ਕਰਨ ਲਈ ਇਸਦੀ ਸੋਚ ਦੀ ਲੜੀ ਨੂੰ ਔਖਾ ਬਣਾ ਸਕਦਾ ਹੈ।
ਫੀ-ਫੇਈ ਲੀ ਦੀ ਵਿਸ਼ਵ ਪ੍ਰਯੋਗਸ਼ਾਲਾਵਾਂ ਨੇ ਐਟਲਸ ਦਾ ਪਰਦਾਫਾਸ਼ ਕੀਤਾ, ਸਪੇਸ਼ੀਅਲ ਇੰਟੈਲੀਜੈਂਸ ਲਈ ਇੱਕ ਓਮਨੀ ਵਰਲਡ ਮਾਡਲ
ਵਰਲਡ ਲੈਬਜ਼ ਐਟਲਸ ਇੱਕ ਮਲਟੀਮੋਡਲ ਆਟੋਰੀਗਰੈਸਿਵ ਡਿਫਿਊਜ਼ਨ ਟ੍ਰਾਂਸਫਾਰਮਰ ਹੈ ਜੋ ਟੈਕਸਟ, ਚਿੱਤਰਾਂ ਅਤੇ ਵੀਡੀਓ ਤੋਂ 3D ਸੰਸਾਰਾਂ ਨੂੰ ਤਿਆਰ, ਪੁਨਰਗਠਨ ਅਤੇ ਸਿਮੂਲੇਟ ਕਰਦਾ ਹੈ।
ਰੁਟੀਨ ਈਸੀਜੀ ਤੋਂ 2 ਸਕਿੰਟਾਂ ਦੇ ਅੰਦਰ 'ਸੁਪਰਹਿਊਮਨ' ਏਆਈ ਦਿਲ ਦੀ ਬਿਮਾਰੀ ਦਾ ਪਤਾ ਲਗਾਉਂਦਾ ਹੈ
ਲੱਖਾਂ ਈਸੀਜੀ 'ਤੇ ਸਿਖਲਾਈ ਪ੍ਰਾਪਤ ਇੱਕ ਏਆਈ ਟੂਲ ਨੇ 67,000-ਮਰੀਜ਼ਾਂ ਦੇ ਅਜ਼ਮਾਇਸ਼ ਵਿੱਚ ਦਿਲ ਦੇ ਵਾਲਵ ਰੋਗਾਂ ਦੇ 90% ਕੇਸਾਂ ਦਾ ਪਤਾ ਲਗਾਇਆ, ਮਹੀਨੇ-ਲੰਬੇ ਇੰਤਜ਼ਾਰ ਦਾ ਸਾਹਮਣਾ ਕਰ ਰਹੇ ਮਰੀਜ਼ਾਂ ਲਈ ਫਾਸਟ-ਟਰੈਕਿੰਗ ਦੀ ਪੇਸ਼ਕਸ਼ ਕੀਤੀ।
ਐਂਥਰੋਪਿਕ ਨੇ ਸਾਇੰਸ ਪੁਸ਼ ਲਈ ਵਿਸਤ੍ਰਿਤ AI ਵਿੱਚ ਵਿਗਿਆਨੀਆਂ ਲਈ 10,000 ਮੁਫਤ ਕਲਾਉਡ ਸੀਟਾਂ ਖੋਲ੍ਹੀਆਂ
ਐਂਥਰੋਪਿਕ ਜੀਵ-ਵਿਗਿਆਨ ਸੁਰੱਖਿਆ ਨੂੰ ਕਾਇਮ ਰੱਖਦੇ ਹੋਏ, 10,000 ਵਿਗਿਆਨੀਆਂ ਨੂੰ ਮੁਫਤ ਕਲਾਉਡ ਸਬਸਕ੍ਰਿਪਸ਼ਨ ਅਤੇ ਪ੍ਰਤੀ ਪ੍ਰੋਜੈਕਟ ਵਿਗਿਆਨ ਕ੍ਰੈਡਿਟ ਲਈ AI ਵਿੱਚ $50,000 ਤੱਕ ਦੇਵੇਗਾ।
ਐਂਥਰੋਪਿਕ ਦੇ ਆਟੋਮੇਟਿਡ ਖੋਜਕਰਤਾ ਦਿਖਾਉਂਦੇ ਹਨ ਕਿ ਏਆਈ ਆਪਣੀਆਂ ਖੁਦ ਦੀਆਂ ਅਲਾਈਨਮੈਂਟ ਅਸਫਲਤਾਵਾਂ ਨੂੰ ਠੀਕ ਕਰ ਸਕਦਾ ਹੈ
ਐਂਥਰੋਪਿਕ ਦੇ ਨਵੇਂ ਪੇਪਰ ਵਿੱਚ ਕਿਹਾ ਗਿਆ ਹੈ ਕਿ ਆਟੋਮੇਟਿਡ AI ਖੋਜਕਰਤਾਵਾਂ ਨੇ ਸਾਰੇ 10 ਟੈਸਟ ਬੈਂਚਮਾਰਕਾਂ 'ਤੇ $4 ਪ੍ਰਤੀ ਘੰਟਾ, ਮਨੁੱਖੀ ਖੋਜਕਰਤਾਵਾਂ ਲਈ $150 ਪ੍ਰਤੀ ਘੰਟਾ 'ਤੇ ਅਲਾਈਨਮੈਂਟ ਵਿੱਚ ਸੁਧਾਰ ਕੀਤਾ ਹੈ।
ਏਆਈ ਨਿਯੰਤਰਣ ਦੇ ਨੁਕਸਾਨ ਦੀਆਂ ਘਟਨਾਵਾਂ ਜੁਲਾਈ ਵਿੱਚ ਲਗਭਗ ਦੁੱਗਣੀਆਂ ਹੋ ਗਈਆਂ, ਯੂਕੇ-ਸਮਰਥਿਤ ਖੋਜ ਨੇ ਪਾਇਆ
ਯੂਕੇ AISI-ਫੰਡਿਡ ਰਿਸਰਚ ਮਾਨੀਟਰਿੰਗ ਐਕਸ ਦੀਆਂ ਰਿਪੋਰਟਾਂ ਅਨੁਸਾਰ, AI ਦੇ ਨਿਯੰਤਰਣ ਦੇ ਨੁਕਸਾਨ ਦੀਆਂ ਘਟਨਾਵਾਂ ਜੁਲਾਈ ਵਿੱਚ 300+ ਤੱਕ ਪਹੁੰਚ ਗਈਆਂ, ਜੋ ਕਿ ਜੂਨ ਦੀ ਗਿਣਤੀ ਨਾਲੋਂ ਲਗਭਗ ਦੁੱਗਣੀ ਹੈ, 2026 ਵਿੱਚ 1,600 ਕੇਸਾਂ ਦੇ ਨਾਲ।
Google DeepMind ਦਾ AI ਸਹਿ-ਵਿਗਿਆਨੀ ਹੁਣ ਪ੍ਰਯੋਗਾਂ ਦੀ ਯੋਜਨਾ ਬਣਾਉਂਦਾ ਹੈ, ਲੈਬ ਉਪਕਰਣ ਚਲਾਉਂਦਾ ਹੈ ਅਤੇ ਪੇਪਰ ਲਿਖਦਾ ਹੈ
Google DeepMind ਨੇ ਆਪਣੇ AI ਸਹਿ-ਵਿਗਿਆਨੀ ਦਾ ਇੱਕ ਬੰਦ-ਲੂਪ ਲੈਬ ਪਾਰਟਨਰ ਵਿੱਚ ਵਿਸਤਾਰ ਕੀਤਾ ਜੋ ਪ੍ਰਯੋਗਾਂ ਨੂੰ ਡਿਜ਼ਾਈਨ ਕਰਦਾ ਹੈ, ਲੈਬ ਉਪਕਰਣਾਂ ਨੂੰ ਨਿਯੰਤਰਿਤ ਕਰਦਾ ਹੈ ਅਤੇ ਖੋਜ ਪੱਤਰ ਲਿਖਦਾ ਹੈ।
ਓਪਨਏਆਈ ਏਜੰਟਾਂ ਨੇ ਆਪਣੇ ਖੁਦ ਦੇ ਸਿਸਟਮ ਨੂੰ ਰੂਟ ਕਰਨ ਲਈ ਲੀਨਕਸ ਕਰਨਲ ਫਲਾਅ ਦਾ ਸ਼ੋਸ਼ਣ ਕੀਤਾ, ਰਿਪੋਰਟ ਜ਼ਾਹਰ ਕਰਦੀ ਹੈ
OpenAI ਦੀ ਘਟਨਾ ਰਿਪੋਰਟ ਕਹਿੰਦੀ ਹੈ ਕਿ AI ਏਜੰਟਾਂ ਨੇ CVE-2026-53362 ਲਈ ਕੰਪਨੀ ਦੇ ਬੁਨਿਆਦੀ ਢਾਂਚੇ 'ਤੇ ਰੂਟ ਐਕਸੈਸ ਹਾਸਲ ਕਰਨ ਲਈ ਜਨਤਕ ਸ਼ੋਸ਼ਣ ਦੀ ਵਰਤੋਂ ਕੀਤੀ, ਜਿਸ ਨਾਲ CISA KEV ਸੂਚੀਕਰਨ ਲਈ ਪ੍ਰੇਰਿਆ ਗਿਆ।
ਸਟੈਨਫੋਰਡ-ਅਗਵਾਈ ਵਾਲਾ ਟਰਮੀਨਲ-ਬੈਂਚ-ਸਾਇੰਸ ਰੀਅਲ ਰਿਸਰਚ ਵਰਕਫਲੋਜ਼ 'ਤੇ AI ਏਜੰਟਾਂ ਦੇ ਟੈਸਟ - ਵਧੀਆ ਮਾਡਲ ਸਕੋਰ 30%
ਟਰਮੀਨਲ-ਬੈਂਚ-ਸਾਇੰਸ 0.1, 70 ਮਾਹਰ ਦੁਆਰਾ ਚੁਣੇ ਗਏ ਵਿਗਿਆਨਕ ਕਾਰਜਾਂ ਦਾ ਇੱਕ ਸਟੈਨਫੋਰਡ-ਅਗਵਾਈ ਵਾਲਾ ਬੈਂਚਮਾਰਕ, ਇੱਥੋਂ ਤੱਕ ਕਿ ਸਭ ਤੋਂ ਮਜ਼ਬੂਤ AI ਏਜੰਟ, ਕਲਾਉਡ ਓਪਸ 5 ਨੂੰ ਲੱਭਦਾ ਹੈ, ਅਸਲ ਖੋਜ ਵਰਕਫਲੋ ਦਾ ਸਿਰਫ਼ 30% ਹੱਲ ਕਰਦਾ ਹੈ।
ਗੂਗਲ ਡੀਪਮਾਈਂਡ ਪਾਇਲਟ ਬੈਂਚਮਾਰਕ ਗੰਦਗੀ ਨੂੰ ਹਰਾਉਣ ਲਈ ਵਿਸ਼ਵ ਦੇ ਪਹਿਲੇ ਡਬਲ-ਬਲਾਈਂਡ ਏਆਈ ਮੁਲਾਂਕਣ
DeepMind ਦਾ ਕ੍ਰਿਪਟੋਗ੍ਰਾਫਿਕ ਮੁਲਾਂਕਣ ਬਾਕਸ ਸਿੰਗਾਪੁਰ ਦੇ AI ਸੁਰੱਖਿਆ ਇੰਸਟੀਚਿਊਟ ਦੇ ਨਾਲ ਆਪਣੀ ਕਿਸਮ ਦੇ ਪਹਿਲੇ ਪਾਇਲਟ ਵਿੱਚ ਜੈਮਿਨੀ ਵਜ਼ਨ ਅਤੇ ਬਾਹਰੀ ਟੈਸਟਾਂ ਨੂੰ ਆਪਸੀ ਨਿੱਜੀ ਤੌਰ 'ਤੇ ਨਿਜੀ ਰੱਖਦਾ ਹੈ।
ਓਪਨਏਆਈ ਟਰੇਸ ਹੱਗਿੰਗ ਫੇਸ ਏਜੰਟ ਹੈਕ ਟੂ ਟਰੇਨਿੰਗ-ਏਰਾ ਰਿਵਾਰਡ ਹੈਕਿੰਗ: ਮਾਡਲਾਂ ਨੂੰ ਅਣਜਾਣੇ ਵਿੱਚ ਧੋਖਾ ਦੇਣਾ ਸਿਖਾਇਆ ਗਿਆ ਸੀ
OpenAI ਦੀ ਨਵੀਂ ਤਕਨੀਕੀ ਰਿਪੋਰਟ ਵਿੱਚ ਕਿਹਾ ਗਿਆ ਹੈ ਕਿ ਹੱਗਿੰਗ ਫੇਸ ਨੂੰ ਹੈਕ ਕਰਨ ਵਾਲੇ ਏਜੰਟਾਂ ਨੂੰ ਸਿਖਲਾਈ ਦੌਰਾਨ ਧੋਖਾਧੜੀ ਅਤੇ ਸੰਚਾਰ ਕਰਨ ਲਈ ਇਨਾਮ ਦਿੱਤਾ ਗਿਆ ਸੀ - ਅਤੇ ਇਹ ਹੱਲ ਰਾਤੋ-ਰਾਤ ਨਹੀਂ ਹੋਵੇਗਾ।
ਦੁਨੀਆ ਦੀ ਪਹਿਲੀ AI- ਸਹਾਇਤਾ ਪ੍ਰਾਪਤ ਬ੍ਰੇਨ ਟਿਊਮਰ ਸਰਜਰੀ ਨੇ ਲੰਡਨ ਦੇ ਮਰੀਜ਼ ਦੀ ਨਜ਼ਰ ਬਚਾਈ
ਲੰਡਨ ਦੇ NHNN ਦੇ ਸਰਜਨਾਂ ਨੇ ਲਾਈਵ AI ਮਾਰਗਦਰਸ਼ਨ ਦੇ ਨਾਲ ਇੱਕ 11mm ਬ੍ਰੇਨ ਟਿਊਮਰ ਨੂੰ ਹਟਾ ਦਿੱਤਾ ਜੋ ਕਿ ਕਲਰ-ਕੋਡਿਡ ਨਾਜ਼ੁਕ ਸਰੀਰ ਵਿਗਿਆਨ, ਮਰੀਜ਼ ਰਾਈਸ ਹਿਬਰਟ ਦੀ ਨਜ਼ਰ ਨੂੰ ਬਚਾਉਂਦਾ ਹੈ।
ਗੂਗਲ ਨੇ ਇੱਕ ਸਰਵ ਵਿਆਪਕ ਸੀ ਲਾਇਬ੍ਰੇਰੀ ਨੂੰ ਦੁਬਾਰਾ ਲਿਖਣ ਲਈ ਜੇਮਿਨੀ ਦੀ ਵਰਤੋਂ ਕੀਤੀ - ਅਤੇ ਇਸਦੀ ਰਿਪੋਰਟ ਕੀਤੇ ਜਾਣ ਤੋਂ ਪਹਿਲਾਂ ਇੱਕ ਜ਼ੀਰੋ-ਦਿਨ ਚਕਮਾ ਦਿੱਤਾ ਗਿਆ
Google ਨੇ Rust ਵਿੱਚ C ਚਿੱਤਰ ਲਾਇਬ੍ਰੇਰੀ giflib ਨੂੰ ਦੁਬਾਰਾ ਲਿਖਣ ਲਈ Gemini ਦੀ ਵਰਤੋਂ ਕੀਤੀ, ਇਸਨੂੰ 30 ਮਿਲੀਅਨ GIFs 'ਤੇ ਪ੍ਰਮਾਣਿਤ ਕੀਤਾ, ਅਤੇ ਖੁਲਾਸਾ ਕਰਨ ਤੋਂ ਪਹਿਲਾਂ CVE-2026-26740 ਤੋਂ ਸੁਰੱਖਿਅਤ ਸੀ।
AI ਏਜੰਟ ਸਵੈ-ਇੱਛਾ ਨਾਲ ਬਹੁਗਿਣਤੀ ਰਾਏ ਦੇ ਅਨੁਕੂਲ ਹੁੰਦੇ ਹਨ - ਅਤੇ ਪੀਅਰ ਦਬਾਅ ਉਹਨਾਂ ਦੀਆਂ ਕਦਰਾਂ-ਕੀਮਤਾਂ ਨੂੰ ਬਦਲ ਸਕਦਾ ਹੈ, ਅਧਿਐਨ ਲੱਭਦਾ ਹੈ
ਕੋਨਸਟਾਂਜ਼ ਖੋਜਕਰਤਾਵਾਂ ਨੇ ਪਾਇਆ ਕਿ ਏਆਈ ਏਜੰਟ ਬਹੁਗਿਣਤੀ ਦੀ ਪਾਲਣਾ ਕਰਦੇ ਹਨ ਜਿਵੇਂ ਕਿ ਚੁੰਬਕੀ ਵਾਲੇ ਕਣਾਂ, Asch-ਸ਼ੈਲੀ ਦੇ ਪੀਅਰ ਪ੍ਰੈਸ਼ਰ ਦੀ ਉਪਜ, ਅਤੇ ਸਮੂਹਿਕ ਗੜਬੜ ਵਿੱਚ ਬਦਲਿਆ ਜਾ ਸਕਦਾ ਹੈ।
ਏਆਈ ਏਜੰਟਾਂ ਨੇ ਪ੍ਰਾਈਮ ਇੰਟੈਲੈਕਟ ਦੇ ਨੈਨੋਜੀਪੀਟੀ ਸਪੀਡਰਨ ਟੈਸਟ ਵਿੱਚ ਮਨੁੱਖੀ ਰਿਕਾਰਡ ਦੇ ਨਾਲ ਅੰਤਰ ਨੂੰ ਘਟਾਇਆ
ਪ੍ਰਾਈਮ ਇੰਟੈਲੈਕਟ ਨੇ ਨੈਨੋਜੀਪੀਟੀ ਸਪੀਡਰਨ 'ਤੇ 153 ਆਟੋਨੋਮਸ ਏਆਈ ਖੋਜ ਚਲਾਈ। ਸਭ ਤੋਂ ਵਧੀਆ ਏਜੰਟ ਨੇ ਮਨੁੱਖੀ ਰਿਕਾਰਡ ਦੇ ਪਾੜੇ ਦੇ 81.7% ਨੂੰ ਬੰਦ ਕਰ ਦਿੱਤਾ. ਪੂਰਾ ਲੀਡਰਬੋਰਡ।
ਓਪਨ ਏਆਈ ਮਾਡਲ ਅੱਧੇ ਸਮੇਂ ਵਿੱਚ ਬੰਦ ਫਰੰਟੀਅਰ ਮਾਡਲਾਂ ਨੂੰ ਫੜ ਰਹੇ ਹਨ, ਅਰਧ-ਵਿਸ਼ਲੇਸ਼ਣ ਲੱਭਦਾ ਹੈ
ਅਰਧ-ਵਿਸ਼ਲੇਸ਼ਣ ਨੇ ਪਾਇਆ ਕਿ ਓਪਨ-ਵੇਟ AI ਮਾਡਲ ਹੁਣ ਹਰੇਕ LLM ਯੁੱਗ ਦੇ ਅੱਧੇ ਸਮੇਂ ਵਿੱਚ ਬੰਦ ਫਰੰਟੀਅਰ ਮਾਡਲਾਂ ਨਾਲ ਮੇਲ ਖਾਂਦੇ ਹਨ, ਫਰੰਟੀਅਰ ਲੈਬ ਹਾਸ਼ੀਏ ਲਈ ਖਤਰੇ ਨੂੰ ਤਿੱਖਾ ਕਰਦੇ ਹਨ।
DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research
London startup Inherent says its Faraday agent, built on a 27-billion-parameter Qwen 3.6 model, beat frontier systems at reproducing science papers.
AI ਹੋਮਵਰਕ ਅਧਿਐਨ: ਸਕੋਰ 18 ਪ੍ਰਤੀਸ਼ਤ, ਪ੍ਰੀਖਿਆ ਪ੍ਰਦਰਸ਼ਨ 20 ਪ੍ਰਤੀਸ਼ਤ ਹੇਠਾਂ
27,000 ਚੀਨੀ ਵਿਦਿਆਰਥੀਆਂ ਦੇ ਅਧਿਐਨ ਵਿੱਚ ਪਾਇਆ ਗਿਆ ਕਿ ਏਆਈ ਨੇ ਹੋਮਵਰਕ ਸਕੋਰ 18 ਪ੍ਰਤੀਸ਼ਤ ਨੂੰ ਉੱਚਾ ਕੀਤਾ ਜਦੋਂ ਕਿ ਪ੍ਰੀਖਿਆ ਦੇ ਸਕੋਰ 20 ਪ੍ਰਤੀਸ਼ਤ ਘਟੇ, ਕਿਉਂਕਿ ਜ਼ਿਆਦਾਤਰ ਉਪਭੋਗਤਾਵਾਂ ਨੇ ਅਸਾਈਨਮੈਂਟਾਂ ਨੂੰ ਪੂਰੀ ਤਰ੍ਹਾਂ ਆਊਟਸੋਰਸ ਕੀਤਾ।
ਗੂਗਲ ਡੀਪਮਾਈਂਡ ਆਪਣੀ ਗੇਮ ਏਆਈ ਖੋਜ ਨੂੰ ਈਵੀਈ ਔਨਲਾਈਨ ਦੇ 23-ਸਾਲ ਪੁਰਾਣੇ ਨਿਰੰਤਰ ਬ੍ਰਹਿਮੰਡ ਵਿੱਚ ਲੈ ਜਾਂਦਾ ਹੈ
Google DeepMind ਵੇਰਵੇ ਦਿੰਦਾ ਹੈ ਕਿ ਕਿਵੇਂ 15 ਸਾਲਾਂ ਦੀ ਗੇਮ AI ਖੋਜ, Atari ਤੋਂ AlphaStar ਤੱਕ, ਹੁਣ Fenris Creations ਦੇ ਨਾਲ EVE ਔਨਲਾਈਨ ਵਿੱਚ ਫੈਲੀ ਹੈ।
Nvidia ਦੇ AVO ਏਜੰਟ ਨੇ ਕਲਾਉਡ ਓਪਸ 5 ਦੇ ਨਾਲ ARC-AGI-3 'ਤੇ 100% ਹਿੱਟ ਕੀਤਾ — ਪਰੂਫ ਦ ਹਾਰਨੇਸ ਹੁਣ ਮਾਡਲ ਨੂੰ ਹਰਾਉਂਦਾ ਹੈ
Nvidia ਦੇ AVO ਏਜੰਟ ਆਰਕੀਟੈਕਚਰ ਨੇ ਕਲਾਉਡ ਓਪਸ 5 ਨੂੰ ਸਾਰੇ 183 ਪੱਧਰਾਂ ਵਿੱਚ ਇੱਕ ਸੰਪੂਰਣ 100% ARC-AGI-3 ਸਕੋਰ ਤੱਕ ਪਹੁੰਚਾਇਆ — ਇੱਕੋ ਮਾਡਲ ਨੇ ਸਿਰਫ਼ 30% ਸਕੋਰ ਕੀਤਾ।
ਟੇਰੇਂਸ ਤਾਓ ਦਾ ਕਹਿਣਾ ਹੈ ਕਿ ਏਆਈ ਗਣਿਤ ਨੂੰ ਗੋਡੇਲ ਤੋਂ ਬਾਅਦ ਸਭ ਤੋਂ ਵੱਡੀ ਗਣਨਾ ਵਿੱਚ ਧੱਕ ਰਿਹਾ ਹੈ
ਫੀਲਡਜ਼ ਮੈਡਲਿਸਟ ਦਾ ਨਵਾਂ ਲੇਖ ਦਲੀਲ ਦਿੰਦਾ ਹੈ ਕਿ AI ਤਣਾਅ-ਟੈਸਟਿੰਗ ਗਣਿਤ ਦੇ ਅਣਲਿਖਤ ਮੁੱਲ ਹੈ - ਜੋ ਯੋਗਦਾਨ ਵਜੋਂ ਗਿਣਿਆ ਜਾਂਦਾ ਹੈ, ਅਤੇ ਅਸਲ ਵਿੱਚ ਕੰਮ ਕਿਸ ਨੇ ਕੀਤਾ।
ਕਲੌਡ ਕੰਮ ਕਰਨ ਵਾਲੇ ਪ੍ਰੋਟੀਨ ਬਾਈਂਡਰਾਂ ਦੇ ਨਾਲ ਨਾਲ ਚੋਟੀ ਦੇ ਮਨੁੱਖੀ ਮਾਹਰਾਂ ਨੂੰ ਡਿਜ਼ਾਈਨ ਕਰਦਾ ਹੈ, ਐਂਥਰੋਪਿਕ ਕਹਿੰਦਾ ਹੈ
ਐਂਥਰੋਪਿਕ ਕਹਿੰਦਾ ਹੈ ਕਿ ਕਲਾਉਡ ਨੇ 15 ਵਿੱਚੋਂ 14 ਟੀਚਿਆਂ ਲਈ ਖਾਸ ਹਿੱਟ ਰੇਟ ਦੇ ਨਾਲ ਕੰਮ ਕਰਨ ਵਾਲੇ ਪ੍ਰੋਟੀਨ ਬਾਈਂਡਰ ਡਿਜ਼ਾਈਨ ਕੀਤੇ, ਅਤੇ ਕੱਚੇ ਰਸਾਇਣ ਵਿਗਿਆਨ ਦੇ ਡੇਟਾ ਦਾ ਮਿੰਟਾਂ ਵਿੱਚ ਵਿਸ਼ਲੇਸ਼ਣ ਕੀਤਾ।
ਐਲਐਲਐਮ 'ਵਿਚਾਰਧਾਰਕ ਗਿਰਗਿਟ' ਹਨ: ਅਧਿਐਨ ਨੇ ਸਾਰੇ 21 ਟੈਸਟ ਕੀਤੇ ਮਾਡਲਾਂ ਨੂੰ ਉਪਭੋਗਤਾਵਾਂ ਦੀ ਰਾਜਨੀਤੀ ਦਾ ਪ੍ਰਤੀਬਿੰਬ ਪਾਇਆ
47,376 ਜਵਾਬਾਂ ਦੇ ਇੱਕ ਵਿਗਿਆਨਕ ਰਿਪੋਰਟਾਂ ਦੇ ਅਧਿਐਨ ਵਿੱਚ ਪਾਇਆ ਗਿਆ ਹੈ ਕਿ ਸਾਰੇ 21 ਵੱਡੇ ਭਾਸ਼ਾ ਮਾਡਲਾਂ ਨੇ ਆਪਣੇ ਰਾਜਨੀਤਿਕ ਰੁਖ ਨੂੰ ਉਪਭੋਗਤਾਵਾਂ ਨਾਲ ਮੇਲ ਕਰਨ ਲਈ ਬਦਲਿਆ, ਈਕੋ ਚੈਂਬਰਾਂ ਨੂੰ ਖਤਰੇ ਵਿੱਚ ਪਾਇਆ।
ਐਮਆਈਟੀ ਸਟੱਡੀ ਨੇ ਏਆਈ-ਉਤਪੰਨ ਚਿੱਤਰਾਂ ਨੂੰ ਲੱਭਿਆ ਹੈ ਅਕਸਰ ਕਿਸੇ ਵੀ ਸਿਖਲਾਈ ਡੇਟਾ ਦਾ ਪਤਾ ਨਹੀਂ ਲਗਾਇਆ ਜਾ ਸਕਦਾ ਹੈ
ਨੇਚਰ ਕਮਿਊਨੀਕੇਸ਼ਨਜ਼ ਵਿੱਚ ਪ੍ਰਕਾਸ਼ਿਤ ਐਮਆਈਟੀ ਖੋਜ ਦਰਸਾਉਂਦੀ ਹੈ ਕਿ ਫੈਲਾਅ ਮਾਡਲ ਆਉਟਪੁੱਟ ਪੈਮਾਨੇ 'ਤੇ ਅਯੋਗ ਹੋ ਜਾਂਦੇ ਹਨ, ਏਆਈ ਕਾਪੀਰਾਈਟ ਮੁਕੱਦਮੇ ਨੂੰ ਗੁੰਝਲਦਾਰ ਬਣਾਉਂਦੇ ਹਨ।
ਬੈਂਚਮਾਰਕਪੋਕਲਿਪਸ: ਡੈਨ ਲੂ ਦਿਖਾਉਂਦਾ ਹੈ ਕਿ ਕਿਵੇਂ ਏਆਈ ਏਜੰਟ ਚੁੱਪਚਾਪ ਗੇਮ ਪ੍ਰਦਰਸ਼ਨ ਦੇ ਮਾਪਦੰਡ ਬਣਾਉਂਦੇ ਹਨ
ਇੰਜੀਨੀਅਰ ਡੈਨ ਲੂ ਦਰਸਾਉਂਦਾ ਹੈ ਕਿ AI ਏਜੰਟ ਮਾਮੂਲੀ ਤੌਰ 'ਤੇ ਵੱਡੇ ਬੈਂਚਮਾਰਕ ਸੂਟਾਂ ਨੂੰ ਓਵਰਫਿਟ ਕਰ ਸਕਦੇ ਹਨ, ਜਾਅਲੀ ਪ੍ਰਦਰਸ਼ਨ ਜਿੱਤਾਂ - ਅਤੇ ਜਾਅਲੀ AI ਖੋਜ ਦਾਅਵਿਆਂ ਨੂੰ ਪੈਦਾ ਕਰ ਸਕਦੇ ਹਨ।
ਖੋਜਕਰਤਾਵਾਂ ਨੇ ਸਿਰਫ਼ ਪੰਜਵੇਂ-ਗਰੇਡ ਦੀ ਸਮੱਗਰੀ 'ਤੇ LLM ਨੂੰ ਸਿਖਲਾਈ ਦਿੱਤੀ - ਅਤੇ ਇਸਦੀ ਸਮਰੱਥਾ ਦੀ ਸੀਮਾ ਲੱਭੀ
LittleLearner, ਸਿਰਫ਼ K-5 ਪਾਠਕ੍ਰਮ 'ਤੇ ਸਿਖਲਾਈ ਪ੍ਰਾਪਤ 5B ਮਾਡਲ, ਸਕੇਲਿੰਗ ਅਤੇ ਪੋਸਟ-ਟ੍ਰੇਨਿੰਗ ਗਿਆਨ ਨੂੰ ਵਧਾਉਂਦਾ ਹੈ ਪਰ ਉਸ ਨੂੰ ਅੱਗੇ ਨਹੀਂ ਵਧਾ ਸਕਦਾ ਜੋ ਪੂਰਵ-ਸਿਖਲਾਈ ਪ੍ਰਦਾਨ ਕਰਦਾ ਹੈ।
ਐਂਥਰੋਪਿਕ ਦੀ ਨਵੀਂ ਰਿਸਕ ਰਿਪੋਰਟ ਨੇ ਗਲਤ ਢੰਗ ਨਾਲ ਦਰਜਾਬੰਦੀ ਵਧਾ ਦਿੱਤੀ ਹੈ ਅਤੇ 'ਮਾਡਲ 2' ਦਾ ਖੁਲਾਸਾ ਕੀਤਾ ਹੈ
ਐਂਥਰੋਪਿਕ ਦੀ ਦੂਸਰੀ ਜੋਖਮ ਰਿਪੋਰਟ ਵਿਨਾਸ਼ਕਾਰੀ ਗੜਬੜੀ ਦੇ ਜੋਖਮ ਨੂੰ 'ਘੱਟ' ਤੱਕ ਵਧਾਉਂਦੀ ਹੈ ਅਤੇ ਇੱਕ ਮਜ਼ਬੂਤ ਅਪ੍ਰਕਾਸ਼ਿਤ ਅੰਦਰੂਨੀ ਮਾਡਲ ਦਾ ਖੁਲਾਸਾ ਕਰਦੀ ਹੈ ਜੋ ਇਹ ਕਹਿੰਦੀ ਹੈ ਕਿ ਇਹ ਜਹਾਜ਼ ਨਹੀਂ ਭੇਜੇਗੀ।
ਗੂਗਲ ਦਾ HEIR ਕੰਪਾਈਲਰ ਪ੍ਰਾਈਵੇਟ ਏਆਈ ਇਨਫਰੈਂਸ ਲਈ ਹੋਮੋਮੋਰਫਿਕ ਐਨਕ੍ਰਿਪਸ਼ਨ ਲਿਆਉਂਦਾ ਹੈ
Google HEIR ਨੂੰ ਪ੍ਰਦਰਸ਼ਿਤ ਕਰਦਾ ਹੈ, ਇੱਕ ਓਪਨ-ਸੋਰਸ ਕੰਪਾਈਲਰ ਜੋ ਕ੍ਰਿਪਟੋਗ੍ਰਾਫਿਕ ਤੌਰ 'ਤੇ ਪ੍ਰਾਈਵੇਟ AI ਲਈ ਏਨਕ੍ਰਿਪਟ ਕੀਤੇ ਡੇਟਾ 'ਤੇ ਸਿੱਧੇ AI ਅਨੁਮਾਨ ਨੂੰ ਚਲਾਉਂਦਾ ਹੈ।
ਐਂਥਰੋਪਿਕ ਉਸੇ ਕੰਮ 'ਤੇ ਏਆਈ ਏਜੰਟਾਂ ਨੂੰ ਛੱਡਦਾ ਹੈ ਅਤੇ ਉਹ ਇੱਕ ਮੈਦਾਨ ਯੁੱਧ ਸ਼ੁਰੂ ਕਰਦੇ ਹਨ
ਐਂਥਰੋਪਿਕ ਦੀ ਨਵੀਂ ਮਲਟੀਏਜੇਂਟ ਖੋਜ ਦਰਸਾਉਂਦੀ ਹੈ ਕਿ ਕਲਾਉਡ ਏਜੰਟ ਕੀਮਤਾਂ 'ਤੇ ਮਿਲ ਕੇ ਕੰਮ ਕਰਦੇ ਹਨ, ਨੌਕਰੀਆਂ ਦੀਆਂ ਕਤਾਰਾਂ ਨੂੰ ਹੜ੍ਹ ਦਿੰਦੇ ਹਨ, ਅਤੇ ਵਿਰੋਧੀਆਂ ਨੂੰ ਤੋੜ-ਮਰੋੜਣ ਲਈ ਸਵੈ-ਨਕਲ ਕਰਨ ਵਾਲੇ ਮਾਲਵੇਅਰ ਨੂੰ ਤਾਇਨਾਤ ਕਰਦੇ ਹਨ।
ਖੋਜਕਰਤਾਵਾਂ ਨੇ ਕਲਾਉਡ, ਜੀਪੀਟੀ, ਅਤੇ ਜੇਮਿਨੀ ਦੇ ਪਾਰ ਏਨਕ੍ਰਿਪਟਡ ਚੇਨ-ਆਫ-ਥੌਟ ਟਰੇਸ ਤੋਂ ਲੁਕੀ ਹੋਈ ਏਆਈ ਰੀਜ਼ਨਿੰਗ ਚੋਰੀ ਕੀਤੀ
ਖੋਜਕਰਤਾਵਾਂ ਨੇ ਜਨਤਕ ਰਿਪੋਜ਼ਟਰੀਆਂ ਤੋਂ 315,320 ਏਨਕ੍ਰਿਪਟਡ ਤਰਕ ਬਲਾਕਾਂ ਨੂੰ ਡੀਕੋਡ ਕੀਤਾ, ਪ੍ਰਮੁੱਖ AI ਪ੍ਰਦਾਤਾਵਾਂ ਵਿੱਚ 182 ਪ੍ਰਮਾਣ ਪੱਤਰਾਂ ਅਤੇ 367 PII ਕਲਾਕ੍ਰਿਤੀਆਂ ਦਾ ਪਰਦਾਫਾਸ਼ ਕੀਤਾ।
ਗੂਗਲ ਦੀ AMIE AI ਲੈਂਡਮਾਰਕ ਸਟੱਡੀ ਵਿੱਚ ਰੀਅਲ-ਟਾਈਮ ਵੀਡੀਓ ਮੈਡੀਕਲ ਸਲਾਹ-ਮਸ਼ਵਰੇ ਵਿੱਚ ਡਾਕਟਰਾਂ ਨਾਲ ਮੇਲ ਖਾਂਦੀ ਹੈ
ਗੂਗਲ ਰਿਸਰਚ ਦੇ AMIE ਵੀਡੀਓ AI ਸਿਸਟਮ ਨੇ ਰੀਅਲ-ਟਾਈਮ ਕਲੀਨਿਕਲ ਵੀਡੀਓ ਸਲਾਹ-ਮਸ਼ਵਰੇ ਵਿੱਚ ਮਾਹਰ-ਪੱਧਰ ਦੀ ਕਾਰਗੁਜ਼ਾਰੀ ਦਾ ਪ੍ਰਦਰਸ਼ਨ ਕੀਤਾ, ਇੱਕ ਬੇਤਰਤੀਬੇ ਅਧਿਐਨ ਵਿੱਚ ਮੁੱਖ ਮੈਟ੍ਰਿਕਸ ਵਿੱਚ ਬੋਰਡ-ਪ੍ਰਮਾਣਿਤ ਡਾਕਟਰਾਂ ਨਾਲ ਮੇਲ ਖਾਂਦਾ ਹੈ।
ਐਂਥਰੋਪਿਕ ਦੇ ਕਲੌਡ ਨੇ ਰੀਮੈਨ ਜ਼ੀਟਾ ਫੰਕਸ਼ਨ 'ਤੇ ਗਣਿਤ ਦੀ ਅਚਾਨਕ ਸਫਲਤਾ ਪ੍ਰਾਪਤ ਕੀਤੀ, 41.6% ਨੂੰ 67.2% ਤੱਕ ਬੰਨ੍ਹ ਕੇ ਧੱਕਿਆ
ਗਣਿਤ ਦੀ ਸਭ ਤੋਂ ਵੱਡੀ ਖੁੱਲ੍ਹੀ ਸਮੱਸਿਆ ਨੂੰ ਹੱਲ ਕਰਨ ਲਈ ਤੁਰੰਤ ਚੁਣੌਤੀ ਦੇ ਬਾਅਦ ਐਂਥਰੋਪਿਕ ਦੇ ਕਲੌਡ ਦੇ ਇੱਕ ਅਣਪ੍ਰਕਾਸ਼ਿਤ ਖੋਜ ਸੰਸਕਰਣ ਨੇ ਰੀਮੈਨ ਜ਼ੀਟਾ ਫੰਕਸ਼ਨ 'ਤੇ ਲੰਬੇ ਸਮੇਂ ਤੋਂ ਚੱਲ ਰਹੀ ਨੀਵੀਂ ਸੀਮਾ ਨੂੰ 41.6% ਤੋਂ 67.2% ਤੱਕ ਸੁਧਾਰਿਆ।
AI ਮਾਡਲ ਈਵੋ ਲੈਂਡਮਾਰਕ ਸਾਇੰਸ ਸਟੱਡੀ ਵਿੱਚ ਸਕ੍ਰੈਚ ਤੋਂ 16 ਨਵੇਂ ਵਾਇਰਸ ਪੈਦਾ ਕਰਦਾ ਹੈ
ਸਟੈਨਫੋਰਡ ਅਤੇ ਆਰਕ ਇੰਸਟੀਚਿਊਟ ਦੇ ਵਿਗਿਆਨੀਆਂ ਨੇ ਵਿਗਿਆਨ ਜਰਨਲ ਵਿੱਚ ਪ੍ਰਕਾਸ਼ਿਤ ਨਤੀਜਿਆਂ ਦੇ ਨਾਲ, ਸਕ੍ਰੈਚ ਤੋਂ 16 ਵਿਹਾਰਕ ਬੈਕਟੀਰੀਓਫੇਜ ਡਿਜ਼ਾਈਨ ਕਰਨ ਲਈ ਈਵੋ ਏਆਈ ਮਾਡਲ ਦੀ ਵਰਤੋਂ ਕੀਤੀ।
ਏਆਈ ਏਜੰਟ ਇੱਕ ਚੈਟ ਪ੍ਰੋਂਪਟ ਨਾਲੋਂ ਲਗਭਗ 600 ਗੁਣਾ ਜ਼ਿਆਦਾ ਊਰਜਾ ਦੀ ਖਪਤ ਕਰਦੇ ਹਨ, ਨਵੇਂ ਵਿਸ਼ਲੇਸ਼ਣ ਲੱਭਦੇ ਹਨ
ਜਲਵਾਯੂ ਵਿਗਿਆਨੀ ਜ਼ੇਕੇ ਹੌਸਫਾਦਰ ਦੇ ਅੱਠ-ਹਫਤੇ ਦੇ ਕਲਾਉਡ ਕੋਡ ਆਡਿਟ ਵਿੱਚ ਪਾਇਆ ਗਿਆ ਕਿ ਏਆਈ ਏਜੰਟ ਇੱਕ ਸਧਾਰਨ ਚੈਟ ਪੁੱਛਗਿੱਛ ਨਾਲੋਂ ਪ੍ਰਤੀ ਪ੍ਰੋਂਪਟ ਲਗਭਗ 600 ਗੁਣਾ ਜ਼ਿਆਦਾ ਊਰਜਾ ਦੀ ਵਰਤੋਂ ਕਰਦੇ ਹਨ, ਜੋ ਕਿ ਬਿਗ ਟੈਕ ਦੇ ਘੱਟ ਊਰਜਾ ਦੇ ਦਾਅਵਿਆਂ ਵਿੱਚ ਇੱਕ ਵਿਸ਼ਾਲ ਪਾੜੇ ਨੂੰ ਉਜਾਗਰ ਕਰਦੇ ਹਨ।
ਯੂਐਸ ਦੇ ਊਰਜਾ ਵਿਭਾਗ ਨੇ ਏਆਈ-ਸੰਚਾਲਿਤ ਵਿਗਿਆਨਕ ਖੋਜ ਲਈ ਜੈਨੇਸਿਸ ਓਪਨ ਮਾਡਲ ਪਹਿਲਕਦਮੀ ਦੀ ਸ਼ੁਰੂਆਤ ਕੀਤੀ
DOE ਦੀ Genesis Open Models ਪਹਿਲਕਦਮੀ ਨੇ Arcee ਨਾਲ Genesis-Science-1 ਦਾ ਪਰਦਾਫਾਸ਼ ਕੀਤਾ, ਸਮੱਗਰੀ, ਊਰਜਾ, ਫਿਊਜ਼ਨ, ਅਤੇ ਜੀਵ ਵਿਗਿਆਨ ਖੋਜ ਨੂੰ ਤੇਜ਼ ਕਰਨ ਲਈ ਓਪਨ-ਵੇਟ AI ਮਾਡਲਾਂ ਦੀ ਪੇਸ਼ਕਸ਼ ਕੀਤੀ।
AI ਡਿਜ਼ਾਈਨ ਕਰਦਾ ਹੈ 16 ਵਿਹਾਰਕ ਵਾਇਰਸ ਕੁਦਰਤ ਵਿੱਚ ਨਹੀਂ ਮਿਲੇ, ਸਟੈਨਫੋਰਡ ਅਤੇ ਬਰਾਡ ਇੰਸਟੀਚਿਊਟ ਖੋਜਕਰਤਾਵਾਂ ਦੀ ਰਿਪੋਰਟ
ਸਟੈਨਫੋਰਡ ਅਤੇ ਬ੍ਰੌਡ ਇੰਸਟੀਚਿਊਟ ਦੇ ਖੋਜਕਰਤਾਵਾਂ ਨੇ 16 ਕਾਰਜਸ਼ੀਲ ਵਾਇਰਸ ਬਣਾਉਣ ਲਈ ਜਨਰੇਟਿਵ ਏਆਈ ਦੀ ਵਰਤੋਂ ਕੀਤੀ ਜੋ ਬੈਕਟੀਰੀਆ ਨੂੰ ਮਾਰਦੇ ਹਨ, ਵਿਗਿਆਨ ਵਿੱਚ ਆਪਣੀ ਕਿਸਮ ਦਾ ਪਹਿਲਾ ਨਤੀਜਾ ਪ੍ਰਕਾਸ਼ਿਤ ਕਰਦੇ ਹਨ।
ਸਟੈਨਫੋਰਡ ਏਆਈ ਨੇ 16 ਨਵੇਂ ਵਾਇਰਸਾਂ ਨੂੰ ਕੁਦਰਤ ਵਿੱਚ ਨਹੀਂ ਪਾਇਆ, ਬਾਇਓਸਕਿਊਰਿਟੀ ਅਲਾਰਮ ਨੂੰ ਵਧਾਉਂਦਾ ਹੈ
ਸਟੈਨਫੋਰਡ ਦੇ ਵਿਗਿਆਨੀਆਂ ਨੇ 16 ਸਿੰਥੈਟਿਕ ਬੈਕਟੀਰੀਓਫੇਜ ਨੂੰ ਡਿਜ਼ਾਈਨ ਕਰਨ ਲਈ ਜੀਨੋਮ ਭਾਸ਼ਾ ਦੇ ਮਾਡਲਾਂ ਦੀ ਵਰਤੋਂ ਕੀਤੀ ਜੋ ਬੈਕਟੀਰੀਆ ਨੂੰ ਸੰਕਰਮਿਤ ਕਰਦੇ ਹਨ, ਪਹਿਲਾ ਪੂਰਾ ਏਆਈ-ਡਿਜ਼ਾਈਨ ਕੀਤਾ ਵਾਇਰਲ ਜੀਨੋਮ। ਮਾਹਰ ਨਵੀਂ ਨਿਗਰਾਨੀ ਦੀ ਤਾਕੀਦ ਕਰਦੇ ਹਨ।
Google WeatherNext 2 AI ਮਾਡਲ ਭਵਿੱਖਬਾਣੀ ਕਰਨ ਵਾਲਿਆਂ ਨੂੰ ਚੱਕਰਵਾਤ ਚੇਤਾਵਨੀ ਦੇ ਇੱਕ ਵਾਧੂ ਦਿਨ ਦਿੰਦਾ ਹੈ
Google DeepMind ਦਾ WeatherNext 2 AI ਮਾਡਲ 24+ ਘੰਟੇ ਵਾਧੂ ਚੱਕਰਵਾਤ ਲੀਡ ਟਾਈਮ ਪ੍ਰਦਾਨ ਕਰਦਾ ਹੈ, ਇੱਕ ਦਹਾਕੇ ਦੀ ਤਰੱਕੀ ਨਾਲ ਮੇਲ ਖਾਂਦਾ ਹੈ, ਅਤੇ ਹੁਣ ਓਪਨ ਸੋਰਸ ਹੈ। ਕੁਦਰਤ ਵਿੱਚ ਪ੍ਰਕਾਸ਼ਿਤ.
ਐਂਥਰੋਪਿਕ ਦੀ ਕਲੌਡ ਫੈਬਲ 5 ਇੱਕ ਛੋਟੇ ਫਾਰਮੂਲੇ ਨਾਲ 87-ਸਾਲ ਪੁਰਾਣੇ ਗਣਿਤ ਦੇ ਅਨੁਮਾਨ ਨੂੰ ਗਲਤ ਸਾਬਤ ਕਰਦੀ ਹੈ
ਇੱਕ ਮਾਨਵ-ਵਿਗਿਆਨਕ ਗਣਿਤ-ਵਿਗਿਆਨੀ ਨੇ ਕਲਾਉਡ ਫੈਬਲ 5 ਮਾਡਲ ਦੀ ਵਰਤੋਂ ਜੈਕੋਬੀਅਨ ਅੰਦਾਜ਼ੇ ਦਾ ਇੱਕ ਉਲਟ ਉਦਾਹਰਨ ਲੱਭਣ ਲਈ ਕੀਤੀ, ਇੱਕ ਸਮੱਸਿਆ ਨੂੰ ਟਾਲਿਆ ਜੋ 1939 ਤੋਂ ਖੜ੍ਹੀ ਹੈ।
NSF ਨੇ ਪੂਰੇ ਅਮਰੀਕਾ ਵਿੱਚ ਕੰਪਿਊਟ ਫੈਲਾਉਣ ਲਈ $100 ਮਿਲੀਅਨ ਰਾਜ ਅਤੇ ਖੇਤਰੀ AI ਬੁਨਿਆਦੀ ਢਾਂਚਾ ਹੱਬ ਲਾਂਚ ਕੀਤੇ
ਨੈਸ਼ਨਲ ਸਾਇੰਸ ਫਾਊਂਡੇਸ਼ਨ ਦਾ ਨਵਾਂ $100 ਮਿਲੀਅਨ ਰਾਜ ਅਤੇ ਖੇਤਰੀ AI ਬੁਨਿਆਦੀ ਢਾਂਚਾ ਹੱਬ ਪ੍ਰੋਗਰਾਮ ਖੋਜ ਅਤੇ ਕਰਮਚਾਰੀਆਂ ਦੀ ਸਿਖਲਾਈ ਲਈ AI ਕੰਪਿਊਟ ਤੱਕ ਪਹੁੰਚ ਨੂੰ ਵਧਾਉਣ ਲਈ 10 ਕੰਸੋਰਟੀਆ ਤੱਕ ਫੰਡ ਦੇਵੇਗਾ।
ਐਂਥਰੋਪਿਕ ਨੇ ਫਰੰਟੀਅਰ ਏਆਈ ਮਾਡਲਾਂ ਨੂੰ ਗੁਪਤ ਰੂਪ ਵਿੱਚ ਸਾਬੋਤਾਜਿੰਗ ਕੋਡ ਅਤੇ ਨਵੇਂ ਅਲਾਈਨਮੈਂਟ ਅਧਿਐਨ ਵਿੱਚ ਧੋਖਾਧੜੀ ਦੀ ਸਹਾਇਤਾ ਕੀਤੀ
ਐਂਥਰੋਪਿਕ ਦੀ ਅਲਾਈਨਮੈਂਟ ਸਾਇੰਸ ਟੀਮ ਨੇ ਛੇ ਕੰਪਨੀਆਂ ਦੇ ਫਰੰਟੀਅਰ ਮਾਡਲਾਂ ਵਿੱਚ ਚਾਰ ਨਵੇਂ ਏਜੰਟੀ ਗਲਤ ਅਲਾਇਨਮੈਂਟ ਅਸਫਲਤਾਵਾਂ ਦਾ ਦਸਤਾਵੇਜ਼ੀਕਰਨ ਕੀਤਾ, ਜਿਸ ਵਿੱਚ ਗੁਪਤ ਕੋਡ ਤੋੜ-ਮਰੋੜ ਅਤੇ ਧੋਖਾਧੜੀ ਸਹਾਇਤਾ ਸ਼ਾਮਲ ਹੈ।
ਮਾਈਕਰੋਸਾਫਟ ਓਪਨ-ਸੋਰਸ ਆਰਚਰਡ, ਇੱਕ ਏਜੰਟਿਕ ਏਆਈ ਫਰੇਮਵਰਕ ਜਿੱਥੇ ਛੋਟੇ ਮਾਡਲ ਫਰੰਟੀਅਰ ਸਿਸਟਮ ਦੇ ਵਿਰੋਧੀ ਹਨ
ਮਾਈਕ੍ਰੋਸਾਫਟ ਰਿਸਰਚ ਨੇ ਆਰਚਰਡ ਨੂੰ ਜਾਰੀ ਕੀਤਾ, ਏਆਈ ਏਜੰਟਾਂ ਨੂੰ ਸਿਖਲਾਈ ਦੇਣ ਲਈ ਇੱਕ ਓਪਨ-ਸੋਰਸ ਫਰੇਮਵਰਕ। ਇਸ ਦਾ 3-ਬਿਲੀਅਨ-ਪੈਰਾਮੀਟਰ ਮਾਡਲ SWE-ਬੈਂਚ ਵੈਰੀਫਾਈਡ 'ਤੇ 69.7% ਨੂੰ ਹਿੱਟ ਕਰਦਾ ਹੈ, ਫਰੰਟੀਅਰ ਸਿਸਟਮਾਂ ਤੱਕ ਪਹੁੰਚਦਾ ਹੈ।
ਏਆਈ ਕੋਡਿੰਗ ਏਜੰਟ ਏਜਿੰਗ ਰਿਸਰਚ ਸੌਫਟਵੇਅਰ ਨੂੰ ਆਧੁਨਿਕ ਬਣਾਉਂਦੇ ਹਨ ਪਰ ਇਹ ਨਹੀਂ ਦੱਸ ਸਕਦੇ ਕਿ ਵਿਗਿਆਨ ਸਹੀ ਹੈ ਜਾਂ ਨਹੀਂ
ਓਪਨਏਆਈ ਅਤੇ ਅਕਾਦਮਿਕ ਭਾਈਵਾਲਾਂ ਦੀ ਇੱਕ ਫੀਲਡ ਰਿਪੋਰਟ ਦਰਸਾਉਂਦੀ ਹੈ ਕਿ ਏਆਈ ਕੋਡਿੰਗ ਏਜੰਟ ਦਹਾਕਿਆਂ ਪੁਰਾਣੇ ਖੋਜ ਸਾਧਨਾਂ ਨੂੰ 60 ਗੁਣਾ ਤੱਕ ਤੇਜ਼ੀ ਨਾਲ ਦੁਬਾਰਾ ਬਣਾ ਸਕਦੇ ਹਨ, ਫਿਰ ਵੀ ਵਿਗਿਆਨਕ ਸ਼ੁੱਧਤਾ 'ਤੇ 'ਭਰੋਸੇ ਨਾਲ ਗਲਤ' ਰਹਿੰਦੇ ਹਨ।
OpenAI ਦਾ 'Astra' ਮਾਡਲ ਕੰਪਿਊਟ ਵਿੱਚ $2,000 ਤੋਂ ਘੱਟ ਲਈ 10 ਓਪਨ ਮੈਥ ਸਮੱਸਿਆਵਾਂ ਨੂੰ ਹੱਲ ਕਰਦਾ ਹੈ
ਓਪਨਏਆਈ ਦਾ ਕਹਿਣਾ ਹੈ ਕਿ ਇਸਦੇ ਅਣਪ੍ਰਕਾਸ਼ਿਤ 'ਅਸਟ੍ਰਾ' ਮਾਡਲ ਨੇ ਗਣਿਤ ਵਿੱਚ $2,000 ਤੋਂ ਘੱਟ ਲਈ 10 ਪਹਿਲਾਂ ਅਣਸੁਲਝੀਆਂ ਗਣਿਤ ਅਤੇ ਕੰਪਿਊਟਰ-ਵਿਗਿਆਨ ਦੀਆਂ ਸਮੱਸਿਆਵਾਂ ਨੂੰ ਹੱਲ ਕੀਤਾ, ਸੰਭਾਵਿਤ GPT-6 ਦੇ ਤੌਰ 'ਤੇ ਅਮਰੀਕੀ ਸੈਨੇਟਰਾਂ ਨੂੰ ਇਸ ਦਾ ਪੂਰਵਦਰਸ਼ਨ ਕੀਤਾ।
FAR.AI ਸੁਰੱਖਿਆ ਲੀਡਰਬੋਰਡ ਨੇ ਫਰੰਟੀਅਰ ਏਆਈ ਸੇਫਗਾਰਡਸ ਵਿੱਚ ਸੌ ਗੁਣਾ ਅੰਤਰ ਨੂੰ ਉਜਾਗਰ ਕੀਤਾ
FAR.AI ਦੇ ਨਵੇਂ AI ਸੁਰੱਖਿਆ ਲੀਡਰਬੋਰਡ ਨੇ ਪਾਇਆ ਕਿ Claude Fable 5 ਅਤੇ GPT-5.6 Sol ਨੇ ਜੇਲਬ੍ਰੇਕ ਦਾ ਵਿਰੋਧ ਕੀਤਾ, ਜਦੋਂ ਕਿ Grok 4.5 ਅਤੇ Gemini 3.1 Pro ਹਰ ਇੱਕ ਨੇ $300 ਤੋਂ ਘੱਟ ਲਈ ਤੋੜਿਆ, ਜਿਸ ਨਾਲ ਫਰੰਟੀਅਰ ਮਾਡਲਾਂ ਦੇ ਵਿਚਕਾਰ ਇੱਕ ਵਿਸ਼ਾਲ ਸੁਰੱਖਿਆ ਪਾੜਾ ਸਾਹਮਣੇ ਆਇਆ।
ਖੋਜਕਰਤਾ ਨੇ ਵਰਡ ਲਈ ਮਾਈਕ੍ਰੋਸਾੱਫਟ ਕੋਪਾਇਲਟ ਵਿੱਚ ਸਵੈ-ਪ੍ਰਚਾਰਕ ਏਆਈ ਕੀੜੇ ਦਾ ਪ੍ਰਦਰਸ਼ਨ ਕੀਤਾ
ਇੱਕ ਤਾਲਮੇਲ ਖੁਲਾਸੇ ਦਿਖਾਉਂਦਾ ਹੈ ਕਿ ਛੁਪੀਆਂ ਹਦਾਇਤਾਂ ਕੋਪਾਇਲਟ ਦੁਆਰਾ ਵਰਡ ਦਸਤਾਵੇਜ਼ਾਂ ਦੁਆਰਾ ਕੀੜੇ ਹੋ ਸਕਦੀਆਂ ਹਨ, ਆਪਣੇ ਆਪ ਨੂੰ ਅੱਗੇ ਨਕਲ ਕਰ ਸਕਦੀਆਂ ਹਨ ਅਤੇ GPT-5.6 ਵਿੱਚ ਇੱਕ ਮਾਡਲ ਅੱਪਗਰੇਡ ਹੋਣ ਤੋਂ ਬਚ ਸਕਦੀਆਂ ਹਨ।
ਐਂਥਰੋਪਿਕ ਦੇ ਕਲੌਡ 'ਮਿਥੋਸ' ਮਾਡਲ ਐਨਕ੍ਰਿਪਸ਼ਨ ਵਿੱਚ ਅਸਲ ਖਾਮੀਆਂ ਲੱਭਦਾ ਹੈ ਜੋ ਇੰਟਰਨੈਟ ਨੂੰ ਸੁਰੱਖਿਅਤ ਕਰਦਾ ਹੈ
ਐਂਥਰੋਪਿਕ ਦਾ ਕਹਿਣਾ ਹੈ ਕਿ ਇਸਦੇ ਕਲੌਡ ਮਿਥੋਸ ਪ੍ਰੀਵਿਊ ਮਾਡਲ ਨੇ AES ਅਤੇ HAWK ਐਨਕ੍ਰਿਪਸ਼ਨ ਐਲਗੋਰਿਦਮ ਵਿੱਚ ਅਸਲ ਕਮਜ਼ੋਰੀਆਂ ਦੀ ਖੋਜ ਕੀਤੀ, ਜਿਸ ਵਿੱਚ ਇੱਕ ਪੋਸਟ-ਕੁਆਂਟਮ ਸਿਫਰ ਮਨੁੱਖਾਂ ਨੇ ਦੋ ਸਾਲਾਂ ਲਈ ਸਮੀਖਿਆ ਕੀਤੀ ਸੀ।
