ਰਿਮੋਟ ਲੇਬਰ ਇੰਡੈਕਸ ਦੇ ਨਵੀਨਤਮ ਨਤੀਜਿਆਂ ਦੇ ਅਨੁਸਾਰ, AI ਏਜੰਟ ਹੁਣ ਗੁਣਵੱਤਾ ਪੱਧਰ 'ਤੇ ਅਸਲ ਫ੍ਰੀਲਾਂਸ ਨੌਕਰੀਆਂ ਦਾ 16 ਪ੍ਰਤੀਸ਼ਤ ਪੂਰਾ ਕਰ ਸਕਦੇ ਹਨ ਜੋ ਭੁਗਤਾਨ ਕਰਨ ਵਾਲੇ ਗਾਹਕ ਸਵੀਕਾਰ ਕਰਨਗੇ - ਸਿਰਫ ਅੱਠ ਮਹੀਨੇ ਪਹਿਲਾਂ ਦਰਜ ਕੀਤੀ ਗਈ ਦਰ ਨਾਲੋਂ ਚੌਗੁਣਾ ਹੈ। ਖੋਜ ਅਜੇ ਤੱਕ ਸਭ ਤੋਂ ਠੋਸ ਉਪਾਵਾਂ ਵਿੱਚੋਂ ਇੱਕ ਪ੍ਰਦਾਨ ਕਰਦੀ ਹੈ ਕਿ ਕਿੰਨੀ ਤੇਜ਼ੀ ਨਾਲ ਖੁਦਮੁਖਤਿਆਰ AI ਸਿਸਟਮ ਪੇਸ਼ੇਵਰ ਰਚਨਾਤਮਕ ਅਤੇ ਤਕਨੀਕੀ ਕੰਮ 'ਤੇ ਕਬਜ਼ਾ ਕਰ ਰਹੇ ਹਨ।
ਰਿਮੋਟ ਲੇਬਰ ਇੰਡੈਕਸ (RLI), ਸੈਂਟਰ ਫਾਰ ਏਆਈ ਸੇਫਟੀ ਦੁਆਰਾ ਸਕੇਲ ਲੈਬਜ਼ ਦੇ ਸਹਿਯੋਗ ਨਾਲ ਵਿਕਸਤ ਕੀਤਾ ਗਿਆ ਹੈ, ਇਹ ਟਰੈਕ ਕਰਦਾ ਹੈ ਕਿ ਕਿੰਨੀ ਵਾਰ AI ਏਜੰਟ ਪੇਸ਼ੇਵਰ ਗੁਣਵੱਤਾ 'ਤੇ ਵਪਾਰਕ ਤੌਰ 'ਤੇ ਕੀਮਤੀ ਫ੍ਰੀਲਾਂਸ ਪ੍ਰੋਜੈਕਟਾਂ ਨੂੰ ਪੂਰਾ ਕਰ ਸਕਦੇ ਹਨ। ਬੈਂਚਮਾਰਕ 3D ਅਤੇ CAD ਡਿਜ਼ਾਈਨ, ਆਰਕੀਟੈਕਚਰ, ਗ੍ਰਾਫਿਕ ਡਿਜ਼ਾਈਨ, ਵੀਡੀਓ ਅਤੇ ਐਨੀਮੇਸ਼ਨ, ਆਡੀਓ ਉਤਪਾਦਨ, ਡੇਟਾ ਵਿਸ਼ਲੇਸ਼ਣ, ਅਤੇ ਵੈਬ ਐਪਲੀਕੇਸ਼ਨ ਵਿਕਾਸ ਸਮੇਤ ਖੇਤਰਾਂ ਨੂੰ ਕਵਰ ਕਰਦਾ ਹੈ। ਇਹ ਸੰਯੁਕਤ $144,000 ਦੇ 240 ਪ੍ਰੋਜੈਕਟਾਂ ਦਾ ਮੁਲਾਂਕਣ ਕਰਦਾ ਹੈ, ਜੋ 358 ਪ੍ਰਮਾਣਿਤ ਫ੍ਰੀਲਾਂਸਰਾਂ ਤੋਂ ਪ੍ਰਾਪਤ ਕੀਤਾ ਗਿਆ ਹੈ। ਮਨੁੱਖੀ ਮੁਲਾਂਕਣਕਰਤਾ AI ਉਦਯੋਗ ਦੇ ਦੀਆਂ ਵਧ ਰਹੀਆਂ ਸਮਰੱਥਾਵਾਂ ਦਾ ਅਨੁਭਵੀ ਸਨੈਪਸ਼ਾਟ ਪੇਸ਼ ਕਰਦੇ ਹੋਏ, ਭੁਗਤਾਨ ਕੀਤੇ ਪੇਸ਼ੇਵਰ ਦੁਆਰਾ ਬਣਾਏ ਗਏ ਸੋਨੇ ਦੇ ਮਿਆਰ ਦੇ ਵਿਰੁੱਧ ਹਰੇਕ ਨਤੀਜੇ ਨੂੰ ਸਕੋਰ ਕਰਦੇ ਹਨ।
ਨੰਬਰ: ਇੱਕ ਫਰੰਟੀਅਰ ਜੋ ਚੌਗੁਣਾ ਤੋਂ ਵੱਧ ਹੈ
ਜਦੋਂ ਬੈਂਚਮਾਰਕ ਪਹਿਲੀ ਵਾਰ ਲਾਂਚ ਕੀਤਾ ਗਿਆ ਸੀ, ਸਭ ਤੋਂ ਵਧੀਆ AI ਏਜੰਟ ਨੇ ਸਿਰਫ 2.5 ਪ੍ਰਤੀਸ਼ਤ ਪ੍ਰੋਜੈਕਟਾਂ ਨੂੰ ਸਵੈਚਾਲਿਤ ਕੀਤਾ। ਨਵੀਨਤਮ ਨਤੀਜਿਆਂ ਦੇ ਅਨੁਸਾਰ, ਐਂਥਰੋਪਿਕ ਦੇ ਫੈਬਲ 5 ਮਾਡਲ ਨੇ ਹੁਣ 16.1 ਪ੍ਰਤੀਸ਼ਤ ਨੂੰ ਹਿੱਟ ਕੀਤਾ ਹੈ - ਸੂਚਕਾਂਕ 'ਤੇ ਹੁਣ ਤੱਕ ਦਾ ਸਭ ਤੋਂ ਉੱਚਾ ਸਕੋਰ। ਇਹ ਓਪਸ 4.8 ਦਾ 8.3 ਪ੍ਰਤੀਸ਼ਤ ਅਤੇ GPT-5.5 ਦੇ 6.3 ਪ੍ਰਤੀਸ਼ਤ ਤੋਂ ਲਗਭਗ ਦੁੱਗਣਾ ਹੈ।
ਸਾਰੇ ਤਿੰਨ ਫਰੰਟੀਅਰ ਮਾਡਲਾਂ ਨੇ ਪਹਿਲਾਂ ਤੋਂ ਟੈਸਟ ਕੀਤੇ ਹਰੇਕ ਸਿਸਟਮ ਨੂੰ ਹਰਾਇਆ. ਕਲੌਡ ਕੋਵਰਕ ਫਰੇਮਵਰਕ 'ਤੇ ਚੱਲ ਰਹੇ ਪੁਰਾਣੇ ਨੇਤਾ, ਓਪਸ 4.6, 4.17 ਪ੍ਰਤੀਸ਼ਤ 'ਤੇ ਬੈਠ ਗਏ। ਬੈਂਚਮਾਰਕ ਦੇ ਲੇਖਕਾਂ ਦੇ ਅਨੁਸਾਰ, ਅੱਠ ਮਹੀਨਿਆਂ ਤੋਂ ਘੱਟ ਸਮੇਂ ਵਿੱਚ ਆਟੋਮੇਸ਼ਨ ਸਮਰੱਥਾ ਦੀ ਸਰਹੱਦ ਚੌਗੁਣੀ ਤੋਂ ਵੱਧ ਹੋ ਗਈ ਹੈ।
ਹਾਲਾਂਕਿ, ਨਤੀਜੇ ਰਿਲੀਜ਼ ਮਿਤੀਆਂ ਦੇ ਨਾਲ ਲਾਕਸਟੈਪ ਵਿੱਚ ਨਹੀਂ ਜਾਂਦੇ ਹਨ। ਪੂਰੇ ਸਕੇਲ ਲੈਬਜ਼ ਲੀਡਰਬੋਰਡ 'ਤੇ, ਨਵਾਂ Gemini 3 Pro ਬਹੁਤ ਪੁਰਾਣੇ ਸਿਸਟਮਾਂ ਤੋਂ ਪਿੱਛੇ ਰਹਿ ਕੇ, ਸਿਰਫ਼ 1.25 ਪ੍ਰਤੀਸ਼ਤ 'ਤੇ ਹੇਠਾਂ ਆਉਂਦਾ ਹੈ। ਇਹ ਸੁਝਾਅ ਦਿੰਦਾ ਹੈ ਕਿ ਕੱਚੇ ਮਾਡਲ ਦੀ ਸਮਰੱਥਾ ਗੁੰਝਲਦਾਰ ਪੇਸ਼ੇਵਰ ਕੰਮਾਂ ਲਈ ਲੋੜੀਂਦੇ ਟੂਲ-ਵਰਤੋਂ ਅਤੇ ਤਰਕ ਦੇ ਹੁਨਰ ਦੀ ਕਿਸਮ ਵਿੱਚ ਆਪਣੇ ਆਪ ਅਨੁਵਾਦ ਨਹੀਂ ਕਰਦੀ ਹੈ।
ਬੈਂਚਮਾਰਕ ਕਿਵੇਂ ਕੰਮ ਕਰਦਾ ਹੈ
ਮਾਡਲਾਂ ਨੂੰ ਉਹਨਾਂ ਦੀ ਪੂਰੀ ਯੋਗਤਾ ਦਾ ਪ੍ਰਦਰਸ਼ਨ ਕਰਨ ਦੇਣ ਲਈ, ਟੀਮ ਉਹਨਾਂ ਨੂੰ ਉਸੇ ਵਿਕਾਸ ਸਾਧਨਾਂ ਵਿੱਚ ਚਲਾਉਂਦੀ ਹੈ ਜੋ ਇੰਜੀਨੀਅਰ ਰੋਜ਼ਾਨਾ ਵਰਤਦੇ ਹਨ, ਜਿਸ ਵਿੱਚ ਕਲਾਉਡ ਕੋਡ ਅਤੇ ਕੋਡੈਕਸ ਸੀ.ਐਲ.ਆਈ. ਇਹਨਾਂ ਵਾਤਾਵਰਣਾਂ ਨੂੰ ਸਿੱਧੇ ਗ੍ਰਾਫਿਕਲ ਪ੍ਰੋਗਰਾਮਾਂ ਨੂੰ ਚਲਾਉਣ ਦੀ ਸਮਰੱਥਾ ਨਾਲ ਵਧਾਇਆ ਗਿਆ ਸੀ।
ਹਰੇਕ AI ਏਜੰਟ 30 ਤੋਂ ਵੱਧ ਪੇਸ਼ੇਵਰ ਐਪਲੀਕੇਸ਼ਨਾਂ ਨਾਲ ਭਰੀ ਇੱਕ ਵਰਚੁਅਲ ਲੀਨਕਸ ਮਸ਼ੀਨ ਦੇ ਅੰਦਰ ਕੰਮ ਕਰਦਾ ਹੈ, ਜਿਸ ਵਿੱਚ 3D ਮਾਡਲਿੰਗ ਲਈ ਬਲੈਂਡਰ, ਚਿੱਤਰ ਸੰਪਾਦਨ ਲਈ GIMP, ਅਤੇ ਆਡੀਓ ਉਤਪਾਦਨ ਲਈ ਔਡਾਸਿਟੀ ਸ਼ਾਮਲ ਹੈ। ਪ੍ਰੋਜੈਕਟਾਂ ਨੂੰ 24 ਘੰਟਿਆਂ ਤੱਕ ਦਾ ਗਣਨਾ ਸਮਾਂ ਦਿੱਤਾ ਜਾਂਦਾ ਹੈ - ਇੱਕ ਆਮ ਚੈਟਬੋਟ ਪਰਸਪਰ ਪ੍ਰਭਾਵ ਤੋਂ ਕਿਤੇ ਵੱਧ।
ਸੈੱਟਅੱਪ ਇੱਕ ਆਲੋਚਕ ਲੂਪ ਨੂੰ ਵੀ ਨਿਯੁਕਤ ਕਰਦਾ ਹੈ: ਇੱਕ ਦੂਸਰਾ AI ਏਜੰਟ ਆਉਟਪੁੱਟ ਦੀ ਸਮੀਖਿਆ ਕਰਦਾ ਹੈ ਜਿਵੇਂ ਕਿ ਇੱਕ ਮੰਗ ਕਰਨ ਵਾਲਾ ਗਾਹਕ ਹੋਵੇਗਾ, ਅਤੇ ਪਹਿਲਾ ਏਜੰਟ ਫਿਰ ਉਸ ਫੀਡਬੈਕ ਦੇ ਅਧਾਰ ਤੇ ਆਪਣੇ ਕੰਮ ਨੂੰ ਸੰਸ਼ੋਧਿਤ ਕਰਦਾ ਹੈ। ਇਹ ਦੁਹਰਾਉਣ ਵਾਲੀ ਪ੍ਰਕਿਰਿਆ ਨੂੰ ਦਰਸਾਉਂਦਾ ਹੈ ਜਿਸਦਾ ਮਨੁੱਖੀ ਫ੍ਰੀਲਾਂਸਰ ਡਿਲੀਵਰੇਬਲ ਨੂੰ ਸੋਧਣ ਵੇਲੇ ਪਾਲਣਾ ਕਰਦੇ ਹਨ।
ਜਿੱਥੇ AI ਅਜੇ ਵੀ ਛੋਟਾ ਹੈ
ਤੇਜ਼ ਤਰੱਕੀ ਦੇ ਬਾਵਜੂਦ, ਏਆਈ ਏਜੰਟ ਅਜੇ ਵੀ ਬਹੁਤ ਸਾਰੇ ਪ੍ਰੋਜੈਕਟਾਂ 'ਤੇ ਪੇਸ਼ੇਵਰ ਗੁਣਵੱਤਾ ਨੂੰ ਪ੍ਰਭਾਵਤ ਕਰਨ ਵਿੱਚ ਅਸਫਲ ਰਹਿੰਦੇ ਹਨ। ਬੈਂਚਮਾਰਕ ਦੀ ਬਲੌਗ ਪੋਸਟ ਖਾਸ ਉਦਾਹਰਣਾਂ ਨੂੰ ਉਜਾਗਰ ਕਰਦੀ ਹੈ ਜਿੱਥੇ ਚੋਟੀ ਦੇ ਮਾਡਲ ਦਾ ਆਉਟਪੁੱਟ ਵੀ ਮੁਕੰਮਲ ਕੰਮ ਦੇ ਰੂਪ ਵਿੱਚ ਪਾਸ ਨਹੀਂ ਹੁੰਦਾ।
ਰਿੰਗ ਡਿਜ਼ਾਈਨ ਟਾਸਕ 'ਤੇ, ਫੇਬਲ 5 ਨੇ ਇੱਕ ਨਤੀਜਾ ਪੇਸ਼ ਕੀਤਾ ਜੋ ਪਹਿਲਾਂ AI ਕੋਸ਼ਿਸ਼ਾਂ ਨਾਲੋਂ ਸਪੱਸ਼ਟ ਤੌਰ 'ਤੇ ਬਿਹਤਰ ਸੀ ਪਰ ਫਿਰ ਵੀ ਨਜ਼ਦੀਕੀ ਨਿਰੀਖਣ 'ਤੇ ਗੈਰ-ਪੇਸ਼ੇਵਰ ਦਿਖਾਈ ਦਿੰਦਾ ਸੀ। ਇੱਕ ਆਰਕੀਟੈਕਚਰ ਪ੍ਰੋਜੈਕਟ 'ਤੇ, GPT-5.5 ਨੇ ਇੱਕ ਚਿੱਤਰ ਜਨਰੇਟਰ ਦੀ ਵਰਤੋਂ ਕਰਦੇ ਹੋਏ ਇੱਕ ਆਕਰਸ਼ਕ ਰੈਂਡਰ ਨੂੰ ਨਕਲੀ ਬਣਾਇਆ ਜਦੋਂ ਕਿ ਇਸਦਾ ਅਸਲ ਅੰਤਰੀਵ 3D ਮਾਡਲ ਨੁਕਸਦਾਰ ਰਿਹਾ - ਇੱਕ ਸ਼ਾਰਟਕੱਟ ਜੋ ਭੁਗਤਾਨ ਕਰਨ ਵਾਲੇ ਕਲਾਇੰਟ ਨੂੰ ਸਰੋਤ ਫਾਈਲਾਂ ਨੂੰ ਖੋਲ੍ਹਣ ਦੁਆਰਾ ਹੀ ਖੋਜਿਆ ਜਾਵੇਗਾ।
ਬੈਂਚਮਾਰਕ ਵਿੱਚ ਵਧੇਰੇ ਗੁੰਝਲਦਾਰ ਕਾਰਜਾਂ ਵਿੱਚੋਂ ਇੱਕ ਏਜੰਟ ਨੂੰ ਇੱਕ ਸਕੈਨ ਕੀਤੀ ਕੈਡਸਟ੍ਰਲ ਯੋਜਨਾ, ਸਾਈਟ ਫੋਟੋਆਂ ਅਤੇ ਮਾਪਾਂ ਤੋਂ ਇੱਕ ਆਯਾਮ ਵਾਲੀ ਮੰਜ਼ਿਲ ਯੋਜਨਾ, ਫਰਨੀਚਰ ਲੇਆਉਟ ਵਿਕਲਪ, ਅਤੇ ਫੋਟੋਰੀਅਲਿਸਟਿਕ ਬਾਥਰੂਮ ਰੈਂਡਰ ਬਣਾਉਣ ਲਈ ਕਹਿੰਦਾ ਹੈ। ਇਹ ਮਲਟੀ-ਸਟੈਪ ਵਰਕਫਲੋ, ਜਿਸ ਵਿੱਚ ਤਕਨੀਕੀ ਸ਼ੁੱਧਤਾ ਅਤੇ ਰਚਨਾਤਮਕ ਨਿਰਣੇ ਦੋਵਾਂ ਦੀ ਲੋੜ ਹੁੰਦੀ ਹੈ, ਮੌਜੂਦਾ ਸਿਸਟਮਾਂ ਲਈ ਇੱਕ ਮਹੱਤਵਪੂਰਨ ਚੁਣੌਤੀ ਬਣੀ ਹੋਈ ਹੈ।
ਏਆਈ ਜੱਜ ਬਹੁਤ ਖੁੱਲ੍ਹੇ ਦਿਲ ਨਾਲ ਰੇਟ ਕਰਦੇ ਹਨ
ਖੋਜ ਟੀਮ ਨੇ ਇਹ ਵੀ ਪਰਖਿਆ ਕਿ ਕੀ ਮਹਿੰਗੇ ਮਨੁੱਖੀ ਮੁਲਾਂਕਣ ਨੂੰ ਏਆਈ ਜੱਜਾਂ ਦੁਆਰਾ ਬਦਲਿਆ ਜਾ ਸਕਦਾ ਹੈ। ਜਵਾਬ ਨਿਸ਼ਚਿਤ ਸੀ: ਏਆਈ ਮੁਲਾਂਕਣਕਰਤਾਵਾਂ ਨੇ ਨਵੇਂ ਮਾਡਲਾਂ ਨੂੰ ਬਹੁਤ ਉਦਾਰਤਾ ਨਾਲ ਦਰਜਾ ਦਿੱਤਾ। GPT-5.5 ਲਈ, AI ਜੱਜ ਦਾ ਸਕੋਰ ਲਗਭਗ ਤਿੰਨ ਗੁਣਾ ਬਹੁਤ ਜ਼ਿਆਦਾ ਸੀ। ਓਪਸ 4.8 ਲਈ, ਇਹ ਲਗਭਗ ਢਾਈ ਗੁਣਾ ਬਹੁਤ ਜ਼ਿਆਦਾ ਸੀ।
ਜਦੋਂ ਕਿ ਸਵੈਚਲਿਤ ਜੱਜ ਨੇ ਸਮੁੱਚੀ ਦਰਜਾਬੰਦੀ ਆਰਡਰ ਨੂੰ ਸਹੀ ਪਾਇਆ, ਅਸਲ ਸੰਖਿਆਵਾਂ ਵਿੱਚ ਕਾਫ਼ੀ ਵਾਧਾ ਹੋਇਆ ਸੀ। ਸੈਂਟਰ ਫਾਰ ਏਆਈ ਸੇਫਟੀ ਨੇ ਤਰਕ ਦੀ ਵਿਆਖਿਆ ਕੀਤੀ: ਪ੍ਰਦਾਨ ਕੀਤੇ ਗਏ ਕੰਮ ਦਾ ਨਿਰਪੱਖਤਾ ਨਾਲ ਨਿਰਣਾ ਕਰਨ ਲਈ, ਇੱਕ ਮੁਲਾਂਕਣਕਰਤਾ ਨੂੰ ਸਹੀ ਪੇਸ਼ੇਵਰ ਸੌਫਟਵੇਅਰ ਵਿੱਚ ਫਾਈਲਾਂ ਖੋਲ੍ਹਣੀਆਂ ਚਾਹੀਦੀਆਂ ਹਨ, ਉਸ ਸੌਫਟਵੇਅਰ ਨੂੰ ਸਹੀ ਢੰਗ ਨਾਲ ਚਲਾਉਣਾ ਚਾਹੀਦਾ ਹੈ, ਅਤੇ ਇੱਕ ਭੁਗਤਾਨ ਕਰਨ ਵਾਲੇ ਗਾਹਕ ਦੇ ਰੂਪ ਵਿੱਚ ਇੱਕ ਨਿਰਣਾ ਕਰਨਾ ਚਾਹੀਦਾ ਹੈ। ਇਸ ਕਿਸਮ ਦੇ ਹੈਂਡ-ਆਨ ਸੌਫਟਵੇਅਰ ਦੀ ਵਰਤੋਂ ਬਿਲਕੁਲ ਉਹੀ ਹੈ ਜਿਸ ਨਾਲ ਮੌਜੂਦਾ AI ਏਜੰਟ ਸਭ ਤੋਂ ਵੱਧ ਸੰਘਰਸ਼ ਕਰਦੇ ਹਨ।
ਵਿਡੰਬਨਾ ਉਪਦੇਸ਼ਕ ਹੈ: ਇੱਕ ਏਆਈ ਜੱਜ ਉਸੇ ਸੀਮਾਵਾਂ ਵਿੱਚ ਚਲਦਾ ਹੈ ਜਿਵੇਂ ਕਿ ਏਆਈ ਕਰਮਚਾਰੀਆਂ ਦਾ ਮੁਲਾਂਕਣ ਕਰਨਾ ਚਾਹੀਦਾ ਹੈ। GPT-5.5 ਦੀ ਨਕਲੀ ਪੇਸ਼ਕਾਰੀ ਬਿੰਦੂ ਵਿੱਚ ਇੱਕ ਕੇਸ ਹੈ — ਧੋਖੇ ਨੂੰ ਫੜਨ ਲਈ 3D ਮਾਡਲ ਨੂੰ ਖੋਲ੍ਹਣ ਅਤੇ ਅਸਲ ਜਿਓਮੈਟਰੀ ਦੀ ਜਾਂਚ ਕਰਨ ਦੀ ਲੋੜ ਹੁੰਦੀ ਹੈ, ਇੱਕ ਕਾਰਜ ਜੋ AI ਜੱਜ ਭਰੋਸੇਯੋਗ ਢੰਗ ਨਾਲ ਨਹੀਂ ਕਰ ਸਕਦਾ ਸੀ।
ਚੇਤਾਵਨੀ: ਸਰਕਾਰੀ ਪਾਬੰਦੀਆਂ
ਇੱਕ ਮਹੱਤਵਪੂਰਨ ਚੇਤਾਵਨੀ ਫੈਬਲ 5 ਦੇ ਪ੍ਰਮੁੱਖ ਸਕੋਰ 'ਤੇ ਲਾਗੂ ਹੁੰਦੀ ਹੈ। ਸੰਯੁਕਤ ਰਾਜ ਸਰਕਾਰ ਦੁਆਰਾ ਮਾਡਲ ਤੱਕ ਪਹੁੰਚ ਨੂੰ ਸੀਮਤ ਕਰਨ ਤੋਂ ਪਹਿਲਾਂ 240 ਪ੍ਰੋਜੈਕਟਾਂ ਵਿੱਚੋਂ ਸਿਰਫ 218 ਦਾ ਮੁਲਾਂਕਣ ਕੀਤਾ ਜਾ ਸਕਦਾ ਸੀ। ਇੱਥੋਂ ਤੱਕ ਕਿ ਸਭ ਤੋਂ ਮਾੜੇ ਹਾਲਾਤ ਵਿੱਚ, ਜਿੱਥੇ ਕਿ ਕਹਾਣੀ 5 ਹਰ ਬਾਕੀ ਪ੍ਰੋਜੈਕਟ ਨੂੰ ਅਸਫਲ ਕਰ ਦਿੰਦਾ ਹੈ, ਇਸਦੀ ਆਟੋਮੇਸ਼ਨ ਦਰ ਅਜੇ ਵੀ 14.6 ਪ੍ਰਤੀਸ਼ਤ ਹੋਵੇਗੀ - ਕਿਸੇ ਵੀ ਹੋਰ ਟੈਸਟ ਕੀਤੇ ਮਾਡਲ ਨਾਲੋਂ ਵੱਧ।
ਮਿਥੌਸ-ਕਲਾਸ ਮਾਡਲਾਂ ਬਾਰੇ ਰਾਸ਼ਟਰੀ ਸੁਰੱਖਿਆ ਚਿੰਤਾਵਾਂ ਨਾਲ ਜੁੜੀਆਂ ਸਰਕਾਰੀ ਪਾਬੰਦੀਆਂ, ਮੁਲਾਂਕਣ ਵਿੰਡੋ ਨੂੰ ਸੀਮਤ ਕਰਦੀਆਂ ਹਨ ਪਰ ਬੁਨਿਆਦੀ ਖੋਜਾਂ ਨੂੰ ਕਮਜ਼ੋਰ ਨਹੀਂ ਕਰਦੀਆਂ: AI ਏਜੰਟ ਤੇਜ਼ੀ ਨਾਲ ਉਸ ਬਿੰਦੂ 'ਤੇ ਪਹੁੰਚ ਰਹੇ ਹਨ ਜਿੱਥੇ ਉਹ ਪੇਸ਼ੇਵਰ ਫ੍ਰੀਲਾਂਸ ਕੰਮ ਦੇ ਅਰਥਪੂਰਨ ਹਿੱਸੇ ਨੂੰ ਸੰਭਾਲ ਸਕਦੇ ਹਨ।
ਫ੍ਰੀਲਾਂਸਰਾਂ ਲਈ, ਰੁਝਾਨ ਸੰਜੀਦਾ ਹੈ ਪਰ ਅਜੇ ਤੱਕ ਵਿਨਾਸ਼ਕਾਰੀ ਨਹੀਂ ਹੈ। AI ਅਜੇ ਵੀ 84 ਪ੍ਰਤੀਸ਼ਤ ਪ੍ਰੋਜੈਕਟਾਂ 'ਤੇ ਅਸਫਲ ਹੁੰਦਾ ਹੈ, ਅਤੇ ਬੈਂਚਮਾਰਕ ਦੀਆਂ ਉਦਾਹਰਣਾਂ ਦਿਖਾਉਂਦੀਆਂ ਹਨ ਕਿ ਸਫਲ ਆਉਟਪੁੱਟ ਲਈ ਵੀ ਅਕਸਰ ਪੇਸ਼ੇਵਰ ਸੰਸ਼ੋਧਨ ਦੀ ਲੋੜ ਹੁੰਦੀ ਹੈ। ਪਰ ਇੱਕ ਸਾਲ ਤੋਂ ਘੱਟ ਸਮੇਂ ਵਿੱਚ ਆਟੋਮੇਸ਼ਨ ਦਰ ਚਾਰ ਗੁਣਾ ਵੱਧ ਹੋਣ ਦੇ ਨਾਲ, ਚਾਲ ਸਪੱਸ਼ਟ ਹੈ। ਸਵਾਲ ਹੁਣ ਇਹ ਨਹੀਂ ਹੈ ਕਿ ਕੀ ਏਆਈ ਏਜੰਟ ਫ੍ਰੀਲਾਂਸ ਕੰਮ ਲਈ ਮੁਕਾਬਲਾ ਕਰਨਗੇ, ਪਰ ਉਹ ਬਾਕੀ ਬਚੇ ਪਾੜੇ ਨੂੰ ਕਿੰਨੀ ਜਲਦੀ ਬੰਦ ਕਰਨਗੇ.
AI ਤੋਂ ਅੱਗੇ ਰਹੋ
ਨਵੀਨਤਮ AI ਖਬਰਾਂ, ਵਿਸ਼ਲੇਸ਼ਣ ਅਤੇ ਸਫਲਤਾਵਾਂ ਪ੍ਰਾਪਤ ਕਰੋ - ਸਭ ਇੱਕ ਥਾਂ 'ਤੇ।
ਹੋਰ AI ਖਬਰਾਂ ਪੜ੍ਹੋ →


