AMD ਅਤੇ Cerebras Systems ਨੇ AMD ਦੇ ਰੈਕ-ਸਕੇਲ Helios ਪਲੇਟਫਾਰਮ ਨੂੰ ਸੇਰੇਬ੍ਰਾਸ ਦੇ ਵੇਫਰ-ਸਕੇਲ ਇੰਜਣ (WSE) ਨਾਲ ਇੱਕ ਸਿੰਗਲ, ਵੱਖ-ਵੱਖ ਵਰਕਫਲੋ ਵਿੱਚ ਜੋੜਦੇ ਹੋਏ, ਇੱਕ ਨਵੀਂ ਕਿਸਮ ਦਾ AI ਅਨੁਮਾਨ ਬੁਨਿਆਦੀ ਢਾਂਚਾ ਬਣਾਉਣ ਲਈ ਇੱਕ ਤਕਨੀਕੀ ਭਾਈਵਾਲੀ ਦਾ ਪਰਦਾਫਾਸ਼ ਕੀਤਾ ਹੈ। 23 ਜੁਲਾਈ, 2026 ਨੂੰ AMD ਦੇ ਐਡਵਾਂਸਿੰਗ AI 2026 ਈਵੈਂਟ ਵਿੱਚ ਘੋਸ਼ਿਤ ਕੀਤਾ ਗਿਆ, ਸਹਿਯੋਗ ਲੇਟੈਂਸੀ ਅਤੇ ਥ੍ਰੁਪੁੱਟ ਅੜਚਨਾਂ 'ਤੇ ਸਿੱਧਾ ਉਦੇਸ਼ ਰੱਖਦਾ ਹੈ ਜਿਨ੍ਹਾਂ ਨੇ ਜਨਰੇਟਿਵ AI ਯੁੱਗ ਵਿੱਚ ਸਭ ਤੋਂ ਮਹਿੰਗੀਆਂ ਸਮੱਸਿਆਵਾਂ ਵਿੱਚੋਂ ਇੱਕ ਅਨੁਮਾਨ ਬਣਾਇਆ ਹੈ। ਉਦਯੋਗ ਦੇ ਇਸ ਤੇਜ਼ੀ ਨਾਲ ਵਧ ਰਹੇ ਕੋਨੇ ਬਾਰੇ ਤਾਜ਼ਾ ਜਾਣਕਾਰੀ ਲਈ, ਸਾਡੀ ਬ੍ਰੇਕਿੰਗ ਏਆਈ ਨਿਊਜ਼ ਕਵਰੇਜ ਦਾ ਅਨੁਸਰਣ ਕਰੋ।
ਮੁੱਖ ਵਿਚਾਰ ਇੱਕ ਚਿੱਪ ਨੂੰ ਸਭ ਕੁਝ ਕਰਨ ਲਈ ਮਜਬੂਰ ਕਰਨਾ ਬੰਦ ਕਰਨਾ ਹੈ। ਇੱਕ ਰਵਾਇਤੀ ਅਨੁਮਾਨ ਸਟੈਕ ਵਿੱਚ, ਇੱਕ ਸਿੰਗਲ GPU ਪਰਿਵਾਰ ਇੱਕ ਪ੍ਰੋਂਪਟ ਨੂੰ ਹਜ਼ਮ ਕਰਨ ਦੇ ਭਾਰੀ ਪ੍ਰੀਫਿਲ ਕੰਮ ਅਤੇ ਹਰੇਕ ਨਵਾਂ ਟੋਕਨ ਬਣਾਉਣ ਦੇ ਨਾਜ਼ੁਕ, ਕ੍ਰਮਵਾਰ ਕੰਮ ਦੋਵਾਂ ਨੂੰ ਸੰਭਾਲਦਾ ਹੈ। ਇਹ ਇੱਕ ਸਮਝੌਤਾ ਹੈ, ਕਿਉਂਕਿ ਦੋ ਨੌਕਰੀਆਂ ਦੀਆਂ ਬਹੁਤ ਵੱਖਰੀਆਂ ਮੰਗਾਂ ਹਨ. AMD ਅਤੇ Cerebras ਦਲੀਲ ਦਿੰਦੇ ਹਨ ਕਿ ਕੰਮ ਨੂੰ ਵੰਡਣਾ, ਇੱਕ ਤਕਨੀਕ ਜਿਸ ਨੂੰ ਵਿਸਤ੍ਰਿਤ ਅਨੁਮਾਨ ਵਜੋਂ ਜਾਣਿਆ ਜਾਂਦਾ ਹੈ, ਹਰੇਕ ਇੰਜਣ ਨੂੰ ਉਹ ਕਰਨ ਦਿੰਦਾ ਹੈ ਜਿਸ ਵਿੱਚ ਇਹ ਸਭ ਤੋਂ ਵਧੀਆ ਹੈ।
ਦੋ ਇੰਜਣ ਲੇਬਰ ਨੂੰ ਕਿਵੇਂ ਵੰਡਦੇ ਹਨ
AMD ਦੀ ਅਧਿਕਾਰਤ ਘੋਸ਼ਣਾ ਦੇ ਅਨੁਸਾਰ, AMD Helios ਉੱਚ-ਪ੍ਰਦਰਸ਼ਨ ਵਾਲੇ, ਸਕੇਲੇਬਲ ਥ੍ਰੁਪੁੱਟ ਇੰਜਣ ਦੇ ਤੌਰ 'ਤੇ ਕੰਮ ਕਰੇਗਾ, ਇੰਪੁੱਟ ਦੇ ਵੱਡੇ ਬੈਚਾਂ ਨੂੰ ਤੇਜ਼ੀ ਨਾਲ ਪ੍ਰਕਿਰਿਆ ਕਰਨ ਲਈ AMD Instinct GPUs 'ਤੇ ਡਰਾਇੰਗ ਕਰੇਗਾ। ਸੇਰੇਬਰਾਸ ਵੇਫਰ-ਸਕੇਲ ਇੰਜਣ, ਇਸ ਦੌਰਾਨ, ਅਲਟਰਾ-ਫਾਸਟ, ਅਲਟਰਾ-ਲੋ-ਲੇਟੈਂਸੀ ਡੀਕੋਡ ਅਤੇ ਟੋਕਨ ਜਨਰੇਸ਼ਨ ਨੂੰ ਸੰਭਾਲੇਗਾ। ਸੇਰੇਬ੍ਰਾਸ ਦੀਆਂ ਚਿਪਸ ਵਿਅਕਤੀਗਤ ਡਾਈਸ ਵਿੱਚ ਕੱਟਣ ਦੀ ਬਜਾਏ ਪੂਰੇ ਵੇਫਰਾਂ 'ਤੇ ਬਣਾਈਆਂ ਜਾਂਦੀਆਂ ਹਨ, ਉਹਨਾਂ ਨੂੰ ਬਹੁਤ ਜ਼ਿਆਦਾ ਆਨ-ਚਿੱਪ ਮੈਮੋਰੀ ਬੈਂਡਵਿਡਥ ਦਿੰਦੀਆਂ ਹਨ ਜੋ ਕਿ ਬਿਨਾਂ ਰੁਕੇ ਟੋਕਨਾਂ ਨੂੰ ਸਟ੍ਰੀਮ ਕਰਨ ਲਈ ਵਿਸ਼ੇਸ਼ ਤੌਰ 'ਤੇ ਅਨੁਕੂਲ ਹੁੰਦੀਆਂ ਹਨ।
ਕੰਪਨੀਆਂ ਦਾ ਕਹਿਣਾ ਹੈ ਕਿ ਦੋ ਕੰਪਿਊਟ ਇੰਜਣਾਂ ਨੂੰ ਜੋੜ ਕੇ, ਸੰਯੁਕਤ ਹੱਲ ਪ੍ਰਤੀ ਵਾਟ ਪ੍ਰਤੀ ਸਕਿੰਟ 5x ਉੱਚੇ ਟੋਕਨ ਪ੍ਰਦਾਨ ਕਰਨ ਦੀ ਉਮੀਦ ਹੈ, ਇੱਕ ਮੈਟ੍ਰਿਕ ਜੋ ਅਨੁਮਾਨ ਅਰਥ ਸ਼ਾਸਤਰ ਲਈ ਕੇਂਦਰੀ ਸਕੋਰਕਾਰਡ ਬਣ ਗਿਆ ਹੈ ਕਿਉਂਕਿ ਪ੍ਰਦਾਤਾ ਸਪੀਡ ਅਤੇ ਊਰਜਾ ਲਾਗਤਾਂ ਦੋਵਾਂ 'ਤੇ ਮੁਕਾਬਲਾ ਕਰਦੇ ਹਨ। ਇਸ ਅੰਕੜੇ ਦਾ ਹਵਾਲਾ AMD ਦੀ ਪ੍ਰੈਸ ਰਿਲੀਜ਼ ਵਿੱਚ ਦਿੱਤਾ ਗਿਆ ਸੀ ਅਤੇ ਟੌਮਜ਼ ਹਾਰਡਵੇਅਰ, ਇਨਵੈਸਟਿੰਗ ਡਾਟ ਕਾਮ, ਅਤੇ ਯਾਹੂ ਟੈਕ ਸਮੇਤ ਸਾਰੇ ਆਊਟਲੇਟਾਂ ਵਿੱਚ ਰਿਪੋਰਟ ਕੀਤੀ ਗਈ ਸੀ।
ਐਨਵੀਡੀਆ ਦੇ ਦਬਦਬੇ 'ਤੇ ਇੱਕ ਸ਼ਾਟ
ਭਾਈਵਾਲੀ ਇੱਕ ਰਣਨੀਤਕ ਸੰਕੇਤ ਵੀ ਹੈ। ਐਨਵੀਡੀਆ ਦਾ ਸੀਯੂਡੀਏ ਈਕੋਸਿਸਟਮ ਅਤੇ ਜੀਪੀਯੂ ਲਾਈਨਅੱਪ ਵਰਤਮਾਨ ਵਿੱਚ ਏਆਈ ਸਿਖਲਾਈ ਅਤੇ ਅਨੁਮਾਨ ਉੱਤੇ ਹਾਵੀ ਹੈ, ਅਤੇ ਚੁਣੌਤੀ ਦੇਣ ਵਾਲਿਆਂ ਨੇ ਤੇਜ਼ੀ ਨਾਲ ਸਿੱਟਾ ਕੱਢਿਆ ਹੈ ਕਿ ਇੱਕ ਸਿੰਗਲ ਆਰਕੀਟੈਕਚਰ ਉੱਤੇ ਮੌਜੂਦਾ ਸਿਰ ਨੂੰ ਹਰਾਉਣਾ ਮੁਸ਼ਕਲ ਹੈ। ਬਿਜ਼ਨਸ ਇਨਸਾਈਡਰ ਨੇ ਇਸ ਸੌਦੇ ਨੂੰ ਫਰੇਮ ਕੀਤਾ ਕਿਉਂਕਿ ਏਐਮਡੀ ਨੇ ਅਨੁਮਾਨ 'ਤੇ ਸੱਟਾ ਲਗਾ ਕੇ ਐਨਵੀਡੀਆ 'ਤੇ ਇੱਕ ਸ਼ਾਟ ਲਿਆ, ਏਆਈ ਕੰਪਿਊਟਿੰਗ ਦਾ ਪੜਾਅ ਸਭ ਤੋਂ ਤੇਜ਼ੀ ਨਾਲ ਵਧਣ ਦੀ ਉਮੀਦ ਕਰਦਾ ਹੈ ਕਿਉਂਕਿ ਮਾਡਲ ਵਿਕਾਸ ਤੋਂ ਉਤਪਾਦਨ ਵਿੱਚ ਜਾਂਦੇ ਹਨ।
ਏਐਮਡੀ ਲਈ, ਸੇਰੇਬ੍ਰਾਸ ਨਾਲ ਜੋੜੀ ਸਿਖਲਾਈ ਤੋਂ ਪਰੇ ਇਸਦੀ ਪ੍ਰਵਿਰਤੀ ਅਤੇ ਹੇਲੀਓਸ ਰੋਡਮੈਪ ਦੀ ਅਪੀਲ ਨੂੰ ਵਿਸ਼ਾਲ ਕਰਦੀ ਹੈ। ਸੇਰੇਬਰਾਸ ਲਈ, ਜੋ ਕਿ AMD (NASDAQ: AMD) ਦੇ ਨਾਲ ਟਿਕਰ CBRS ਦੇ ਅਧੀਨ Nasdaq 'ਤੇ ਵਪਾਰ ਕਰਦਾ ਹੈ, ਇੱਕ ਪ੍ਰਮੁੱਖ ਐਕਸਲੇਟਰ ਵਿਕਰੇਤਾ ਨਾਲ ਏਕੀਕ੍ਰਿਤ ਕਰਨਾ ਇਸਦੀ ਵੇਫਰ-ਸਕੇਲ ਤਕਨਾਲੋਜੀ ਨੂੰ ਵੱਡੇ ਉਦਯੋਗ ਅਤੇ ਕਲਾਉਡ ਤੈਨਾਤੀਆਂ ਵਿੱਚ ਇੱਕ ਸਾਫ਼ ਮਾਰਗ ਪ੍ਰਦਾਨ ਕਰਦਾ ਹੈ। ਸੇਰੇਬਰਾਸ ਨੇ ਆਪਣੇ ਖੁਦ ਦੇ ਡੇਟਾ ਸੈਂਟਰਾਂ ਵਿੱਚ ਏਐਮਡੀ ਹੇਲੀਓਸ ਨੂੰ ਤੈਨਾਤ ਕਰਨ ਦੀ ਯੋਜਨਾ ਬਣਾਈ ਹੈ, ਅਤੇ ਕੰਪਨੀਆਂ 2026 ਦੇ ਦੂਜੇ ਅੱਧ ਵਿੱਚ ਸੇਰੇਬ੍ਰਾਸ ਕਲਾਉਡ ਦੁਆਰਾ ਪਹਿਲਾਂ ਸਾਂਝੇ ਹੱਲ ਉਪਲਬਧ ਹੋਣ ਦੀ ਉਮੀਦ ਕਰਦੀਆਂ ਹਨ।
ਹੁਣ ਭੇਦਭਾਵ ਕਿਉਂ ਮਾਇਨੇ ਰੱਖਦਾ ਹੈ
ਅਨੁਮਾਨ ਲਾਗਤ ਏਆਈ ਉਦਯੋਗ ਲਈ ਇੱਕ ਪ੍ਰਭਾਸ਼ਿਤ ਦਬਾਅ ਬਿੰਦੂ ਬਣ ਗਈ ਹੈ। ਜਿਵੇਂ ਕਿ ਮਾਡਲ ਵੱਡੇ ਹੁੰਦੇ ਹਨ ਅਤੇ ਐਪਲੀਕੇਸ਼ਨਾਂ ਅਸਲ-ਸਮੇਂ ਦੇ ਜਵਾਬਾਂ ਦੀ ਮੰਗ ਕਰਦੀਆਂ ਹਨ, ਹਰੇਕ ਟੋਕਨ ਤਿਆਰ ਕਰਨ ਦਾ ਖਰਚਾ, ਅਤੇ ਲੇਟੈਂਸੀ ਉਪਭੋਗਤਾਵਾਂ ਨੂੰ ਇਸਦੀ ਉਡੀਕ ਕਰਨ ਦਾ ਅਨੁਭਵ, ਇਹ ਨਿਰਧਾਰਤ ਕਰ ਸਕਦਾ ਹੈ ਕਿ ਕੋਈ ਉਤਪਾਦ ਵਿਹਾਰਕ ਹੈ ਜਾਂ ਨਹੀਂ। ਵਿਸਤ੍ਰਿਤ ਅਨੁਮਾਨ ਪ੍ਰੀਫਿਲ ਅਤੇ ਡੀਕੋਡ ਨੂੰ ਵੱਖਰੇ ਵਰਕਲੋਡ ਵਜੋਂ ਮੰਨਦਾ ਹੈ ਜੋ ਹਰ ਇੱਕ ਨਾਲ ਸਭ ਤੋਂ ਵਧੀਆ ਮੇਲ ਖਾਂਦੇ ਹਾਰਡਵੇਅਰ ਲਈ ਰੂਟ ਕੀਤੇ ਜਾ ਸਕਦੇ ਹਨ, ਇੱਕ ਡਿਜ਼ਾਈਨ ਫਲਸਫਾ ਜਿਸ ਨੂੰ ਸੇਰੇਬ੍ਰਾਸ ਵਰਗੀਆਂ ਕੰਪਨੀਆਂ ਨੇ ਇੱਕ ਸਾਲ ਤੋਂ ਵੱਧ ਸਮੇਂ ਲਈ ਚੈਂਪੀਅਨ ਬਣਾਇਆ ਹੈ।
AMD-Cerebras ਘੋਸ਼ਣਾ ਸੁਝਾਅ ਦਿੰਦੀ ਹੈ ਕਿ ਪਹੁੰਚ ਇੱਕ ਵਿਦਰੋਹੀ ਵਿਚਾਰ ਤੋਂ ਇੱਕ ਉਦਯੋਗ-ਸਮਰਥਿਤ ਆਰਕੀਟੈਕਚਰ ਵੱਲ ਵਧ ਰਹੀ ਹੈ। ਇੱਕ ਲੇਟੈਂਸੀ ਸਪੈਸ਼ਲਿਸਟ ਦੇ ਨਾਲ ਇੱਕ ਥ੍ਰੁਪੁੱਟ ਸਪੈਸ਼ਲਿਸਟ ਨੂੰ ਜੋੜ ਕੇ, ਦੋਵੇਂ ਕੰਪਨੀਆਂ ਸੱਟਾ ਲਗਾ ਰਹੀਆਂ ਹਨ ਕਿ ਅਨੁਮਾਨ ਦਾ ਭਵਿੱਖ ਉਹਨਾਂ ਸਾਰਿਆਂ 'ਤੇ ਰਾਜ ਕਰਨ ਲਈ ਇੱਕ ਚਿੱਪ ਨਹੀਂ ਹੈ, ਪਰ ਵਿਸ਼ੇਸ਼ ਇੰਜਣਾਂ ਦੀ ਇੱਕ ਤਾਲਮੇਲ ਪ੍ਰਣਾਲੀ ਹੈ।
ਕੀ ਦੇਖਣਾ ਹੈ
ਕਈ ਸਵਾਲ ਬਾਕੀ ਹਨ। 5x ਟੋਕਨ-ਪ੍ਰਤੀ-ਸਕਿੰਟ-ਪ੍ਰਤੀ-ਵਾਟ ਦਾ ਅੰਕੜਾ ਇੱਕ ਤੀਜੀ-ਧਿਰ ਦੇ ਬੈਂਚਮਾਰਕ ਦੀ ਬਜਾਏ ਇੱਕ ਉਮੀਦ ਹੈ, ਅਤੇ ਅਸਲ-ਸੰਸਾਰ ਦੀ ਕਾਰਗੁਜ਼ਾਰੀ ਖਾਸ ਮਾਡਲਾਂ ਅਤੇ ਗਾਹਕਾਂ ਦੁਆਰਾ ਚਲਾਏ ਗਏ ਵਰਕਲੋਡ 'ਤੇ ਨਿਰਭਰ ਕਰੇਗੀ। ਸੇਰੇਬ੍ਰਾਸ ਕਲਾਉਡ ਲਾਂਚ ਤੋਂ ਪਰੇ ਕੀਮਤ ਅਤੇ ਉਪਲਬਧਤਾ ਦੇ ਵੇਰਵਿਆਂ ਦਾ ਖੁਲਾਸਾ ਨਹੀਂ ਕੀਤਾ ਗਿਆ ਹੈ, ਅਤੇ ਇਹ ਅਸਪਸ਼ਟ ਹੈ ਕਿ ਹੱਲ ਹੋਰ ਕਲਾਉਡ ਪ੍ਰਦਾਤਾਵਾਂ ਤੱਕ ਕਦੋਂ ਪਹੁੰਚ ਸਕਦਾ ਹੈ।
ਫਿਰ ਵੀ, ਸੌਦਾ ਏਆਈ ਹਾਰਡਵੇਅਰ ਵਿੱਚ ਇੱਕ ਵਿਆਪਕ ਤਬਦੀਲੀ ਨੂੰ ਦਰਸਾਉਂਦਾ ਹੈ: ਇਹ ਧਾਰਨਾ ਕਿ ਇੱਕ ਸਿੰਗਲ GPU ਆਰਕੀਟੈਕਚਰ AI ਪਾਈਪਲਾਈਨ ਦੇ ਹਰ ਪੜਾਅ ਦੀ ਸੇਵਾ ਕਰੇਗਾ। ਜੇਕਰ AMD ਅਤੇ Cerebras ਆਪਣੇ ਕੁਸ਼ਲਤਾ ਦਾਅਵਿਆਂ ਨੂੰ ਪੂਰਾ ਕਰ ਸਕਦੇ ਹਨ, ਤਾਂ ਵੱਖ-ਵੱਖ ਅਨੁਮਾਨ ਇਸ ਗੱਲ ਦਾ ਇੱਕ ਮਿਆਰੀ ਹਿੱਸਾ ਬਣ ਸਕਦੇ ਹਨ ਕਿ ਸਭ ਤੋਂ ਵੱਡੇ AI ਸਿਸਟਮ ਕਿਵੇਂ ਬਣਾਏ ਜਾਂਦੇ ਹਨ।
AI ਤੋਂ ਅੱਗੇ ਰਹੋ
AI ਹਾਰਡਵੇਅਰ ਲੈਂਡਸਕੇਪ ਵਿਸ਼ੇਸ਼ ਕੈਂਪਾਂ ਵਿੱਚ ਵੰਡਿਆ ਜਾ ਰਿਹਾ ਹੈ, ਅਤੇ ਲਾਗਤ, ਗਤੀ ਅਤੇ ਮੁਕਾਬਲੇ ਲਈ ਪ੍ਰਭਾਵ ਬਹੁਤ ਜ਼ਿਆਦਾ ਹਨ। ਹਰ ਵੱਡੇ ਸੌਦੇ, ਰੀਲੀਜ਼ ਅਤੇ ਬੈਂਚਮਾਰਕ ਨੂੰ ਜਾਰੀ ਰੱਖਣ ਲਈ AI Buzz Wire 'ਤੇ ਹੋਰ AI ਖਬਰਾਂ ਪੜ੍ਹੋ।


