ਐਡਵਾਂਸਡ ਮਾਈਕ੍ਰੋ ਡਿਵਾਈਸਾਂ ਨੇ ਟੋਰਾਂਟੋ-ਅਧਾਰਤ ਸਟਾਰਟਅੱਪ, ਜੋ ਕਿ ਆਰਟੀਫਿਸ਼ੀਅਲ ਇੰਟੈਲੀਜੈਂਸ ਮਾਡਲਾਂ ਨੂੰ ਸਿੱਧੇ ਸਿਲੀਕਾਨ ਵਿੱਚ ਹਾਰਡਵਾਇਰ ਕਰਦਾ ਹੈ, ਨੂੰ ਹਾਸਲ ਕਰਨ ਲਈ ਇੱਕ ਨਿਸ਼ਚਿਤ ਸਮਝੌਤੇ 'ਤੇ ਪਹੁੰਚ ਗਿਆ ਹੈ, ਜਿਸਦਾ ਉਦੇਸ਼ ਨਾਟਕੀ ਤੌਰ 'ਤੇ AI ਅਨੁਮਾਨ ਨੂੰ ਤੇਜ਼ ਕਰਨਾ ਹੈ। ਇਹ ਸੌਦਾ, 6 ਅਗਸਤ, 2026 ਨੂੰ ਘੋਸ਼ਿਤ ਕੀਤਾ ਗਿਆ ਸੀ, AMD ਦੁਆਰਾ ਸੇਰੇਬ੍ਰਾਸ ਨਾਲ ਇੱਕ ਵੱਖਰੇ ਸਮਝੌਤੇ 'ਤੇ ਹਸਤਾਖਰ ਕੀਤੇ ਜਾਣ ਤੋਂ ਕੁਝ ਹਫ਼ਤਿਆਂ ਬਾਅਦ ਆਇਆ ਹੈ ਅਤੇ AI ਹਾਰਡਵੇਅਰ ਵਿੱਚ Nvidia ਦੇ ਦਬਦਬੇ ਨੂੰ ਚੁਣੌਤੀ ਦੇਣ ਲਈ ਇੱਕ ਹਮਲਾਵਰ ਦਬਾਅ ਦਾ ਸੰਕੇਤ ਦਿੰਦਾ ਹੈ।
ਪ੍ਰਾਪਤੀ ਦਰਸਾਉਂਦੀ ਹੈ ਕਿ ਸੈਮੀਕੰਡਕਟਰ ਲੈਂਡਸਕੇਪ ਕਿੰਨੀ ਤੇਜ਼ੀ ਨਾਲ ਬਦਲ ਰਿਹਾ ਹੈ ਕਿਉਂਕਿ ਕੰਪਨੀਆਂ AI ਮਾਡਲਾਂ ਨੂੰ ਚਲਾਉਣ ਦੇ ਸਸਤੇ, ਤੇਜ਼ ਤਰੀਕਿਆਂ ਦਾ ਪਿੱਛਾ ਕਰਦੀਆਂ ਹਨ। ਖੇਤਰ ਨੂੰ ਮੁੜ ਆਕਾਰ ਦੇਣ ਵਾਲੀਆਂ ਚਿੱਪ ਵਾਰਾਂ ਦੇ ਚੱਲ ਰਹੇ AI ਉਦਯੋਗ ਕਵਰੇਜ ਲਈ, AI Buzz Wire ਹਰ ਵੱਡੀ ਚਾਲ ਦਾ ਅਨੁਸਰਣ ਕਰ ਰਿਹਾ ਹੈ।
ਤਾਲਾ ਅਸਲ ਵਿੱਚ ਕੀ ਕਰਦਾ ਹੈ
ਤਾਲਾਸ ਅਖੌਤੀ ਮੈਮੋਰੀ ਕੰਧ ਲਈ ਇੱਕ ਗੈਰ-ਰਵਾਇਤੀ ਪਹੁੰਚ ਅਪਣਾਉਂਦੇ ਹਨ - ਇੱਕ ਰੁਕਾਵਟ ਜਿੱਥੇ GPUs ਮੈਮੋਰੀ ਤੋਂ ਡੇਟਾ ਦੇ ਆਉਣ ਦੀ ਉਡੀਕ ਵਿੱਚ ਵਿਹਲੇ ਬੈਠਦੇ ਹਨ ਇਸ ਤੋਂ ਪਹਿਲਾਂ ਕਿ ਉਹ ਸੰਖਿਆਵਾਂ ਨੂੰ ਕੱਟਣਾ ਸ਼ੁਰੂ ਕਰ ਸਕਣ। ਇੱਕ ਵੱਖਰੇ ਮੈਮੋਰੀ ਬੈਂਕ ਤੋਂ ਮਾਡਲ ਦੇ ਵਜ਼ਨ ਪ੍ਰਾਪਤ ਕਰਨ ਦੀ ਬਜਾਏ, ਤਾਲਾਸ ਸਰੀਰਕ ਤੌਰ 'ਤੇ ਉਹਨਾਂ ਵਜ਼ਨਾਂ ਨੂੰ ਵਿਅਕਤੀਗਤ ਟਰਾਂਜ਼ਿਸਟਰਾਂ ਵਿੱਚ ਹਾਰਡਵਾਇਰ ਕਰਦਾ ਹੈ।
ਸਟਾਰਟਅਪ ਦੀ ਮਲਕੀਅਤ ਵਾਲਾ ਡਿਜੀਟਲ ਆਰਕੀਟੈਕਚਰ 4 ਬਿੱਟ ਡੇਟਾ ਸਟੋਰ ਕਰ ਸਕਦਾ ਹੈ ਅਤੇ ਇੱਕ ਸਿੰਗਲ ਟਰਾਂਜ਼ਿਸਟਰ ਦੀ ਵਰਤੋਂ ਕਰਕੇ ਗਣਿਤ ਦੀਆਂ ਕਾਰਵਾਈਆਂ ਨੂੰ ਚਲਾ ਸਕਦਾ ਹੈ। ਇਸਦੀ HC1 ਚਿੱਪ ਵਿੱਚ ਸ਼ੇਅਰਡ ਹਾਰਡਵੇਅਰ ਬਲਾਕ ਹਨ ਜੋ ਇੱਕ 4-ਬਿੱਟ ਮਾਡਲ ਵਜ਼ਨ ਲਈ ਸਾਰੇ 16 ਸੰਭਾਵਿਤ ਉਤਪਾਦਾਂ ਨੂੰ ਪੱਕੇ ਤੌਰ 'ਤੇ ਪ੍ਰੀ-ਕੰਪਿਊਟ ਕਰਦੇ ਹਨ। ਕਿਉਂਕਿ ਹਰ ਸੰਭਵ ਗਣਿਤਿਕ ਨਤੀਜਾ ਪਹਿਲਾਂ ਹੀ ਚਿੱਪ ਵਿੱਚ ਲਾਈਵ ਹੋ ਰਿਹਾ ਹੈ, ਵਿਅਕਤੀਗਤ ਟਰਾਂਜ਼ਿਸਟਰ ਇੱਕ ਕੈਲਕੁਲੇਟਰ ਦੀ ਬਜਾਏ ਇੱਕ ਭੌਤਿਕ ਰਾਊਟਰ ਵਜੋਂ ਕੰਮ ਕਰਦਾ ਹੈ।
AI ਮਾਡਲ ਦੇ ਹਰੇਕ ਖਾਸ ਭਾਰ ਨੂੰ ਇੱਕ ਸਿੰਗਲ ਮਾਸਕ ROM ਟਰਾਂਜ਼ਿਸਟਰ ਦੁਆਰਾ ਦਰਸਾਇਆ ਗਿਆ ਹੈ। ਨਿਰਮਾਣ ਦੇ ਦੌਰਾਨ, ਉਸ ਟਰਾਂਜ਼ਿਸਟਰ ਨੂੰ 16 ਪ੍ਰੀ-ਕੰਪਿਊਟਿਡ ਉਤਪਾਦ ਲਾਈਨਾਂ ਵਿੱਚੋਂ ਇੱਕ ਨਾਲ ਸਰੀਰਕ ਤੌਰ 'ਤੇ ਜੋੜਨ ਲਈ ਇੱਕ ਮਾਈਕਰੋਸਕੋਪਿਕ ਧਾਤ ਦੀ ਪਰਤ ਨੱਕੜੀ ਕੀਤੀ ਜਾਂਦੀ ਹੈ। ਜਦੋਂ ਡੇਟਾ ਚਿੱਪ ਰਾਹੀਂ ਵਹਿੰਦਾ ਹੈ, ਤਾਂ ਟਰਾਂਜ਼ਿਸਟਰ ਸਿਰਫ਼ ਸਹੀ ਪੂਰਵ-ਗਣਨਾ ਕੀਤੇ ਚੈਨਲ ਦੀ ਚੋਣ ਕਰਦਾ ਹੈ ਅਤੇ ਨਤੀਜਾ ਇੱਕ ਜੋੜਕ ਨੂੰ ਦਿੰਦਾ ਹੈ। ਸੰਖੇਪ ਰੂਪ ਵਿੱਚ, ਸਰਕਟ ਮੈਮੋਰੀ ਅਤੇ ਪ੍ਰੋਸੈਸਰ ਦੋਵਾਂ ਨੂੰ ਜੋੜਿਆ ਜਾਂਦਾ ਹੈ।
ਨਤੀਜਾ, ਕੰਪਨੀ ਦੇ ਅਨੁਸਾਰ, ਹੈਰਾਨ ਕਰਨ ਵਾਲਾ ਹੈ: HC1 ਚਿੱਪ ਪ੍ਰਤੀ ਉਪਭੋਗਤਾ ਪ੍ਰਤੀ ਸਕਿੰਟ ਲਗਭਗ 16,000 ਤੋਂ 17,000 ਟੋਕਨ ਪੈਦਾ ਕਰ ਸਕਦੀ ਹੈ। ਇਹ ਪਹੁੰਚ Groq LPU ਦੀ ਯਾਦ ਦਿਵਾਉਂਦੀ ਹੈ, ਜੋ ਕਿ ਇਸੇ ਤਰ੍ਹਾਂ ਮੈਮੋਰੀ ਦੀ ਰੁਕਾਵਟ ਨੂੰ ਬਾਈਪਾਸ ਕਰਨ ਲਈ AI ਮਾਡਲ ਦੇ ਭਾਰ ਨੂੰ ਸਿੱਧੇ ਫਾਸਟ ਔਨ-ਚਿੱਪ SRAM ਵਿੱਚ ਬੇਕ ਕਰਦਾ ਹੈ।
ਕੈਚ: ਇੱਕ ਮਾਡਲ ਲਈ ਬਣੀ ਇੱਕ ਚਿੱਪ
ਵਪਾਰ ਬੰਦ ਮਹੱਤਵਪੂਰਨ ਹੈ. ਕਿਉਂਕਿ ਮਾਡਲ ਦੇ ਵਜ਼ਨ ਸਰੀਰਕ ਤੌਰ 'ਤੇ ਸਿਲੀਕੋਨ ਵਿੱਚ ਨੱਕੇ ਹੋਏ ਹੁੰਦੇ ਹਨ, ਹਰ ਤਾਲਾਸ ਚਿੱਪ ਸਿਰਫ਼ ਉਸ ਖਾਸ AI ਮਾਡਲ ਲਈ ਕੰਮ ਕਰਦੀ ਹੈ ਜਿਸ ਲਈ ਇਸਨੂੰ ਡਿਜ਼ਾਈਨ ਕੀਤਾ ਗਿਆ ਸੀ। ਇਹ ਇੱਕ ਪ੍ਰੋਗਰਾਮੇਬਲ, ਆਮ-ਉਦੇਸ਼ ਐਕਸਲੇਟਰ ਨਹੀਂ ਹੈ। ਇਹ ਇਸਨੂੰ ਇੱਕ GPU ਤੋਂ ਇੱਕ ਬੁਨਿਆਦੀ ਤੌਰ 'ਤੇ ਵੱਖਰਾ ਪ੍ਰਸਤਾਵ ਬਣਾਉਂਦਾ ਹੈ, ਜੋ ਇਸਦੀ ਮੈਮੋਰੀ ਵਿੱਚ ਲੋਡ ਕੀਤੇ ਕਿਸੇ ਵੀ ਮਾਡਲ ਨੂੰ ਚਲਾ ਸਕਦਾ ਹੈ।
ਉਦਯੋਗ ਦੇ ਵਿਸ਼ਲੇਸ਼ਕਾਂ ਨੇ ਅੰਦਾਜ਼ਾ ਲਗਾਇਆ ਹੈ ਕਿ Taalas ਦੀ ਤਕਨਾਲੋਜੀ AMD ਦੇ ਵਿਆਪਕ ਰੈਕ-ਸਕੇਲ ਪ੍ਰਣਾਲੀਆਂ ਦੇ ਅੰਦਰ ਇੱਕ ਸਮਰਪਿਤ ਡੀਕੋਡ ਐਕਸਲੇਟਰ ਦੇ ਤੌਰ 'ਤੇ ਕੰਮ ਕਰ ਸਕਦੀ ਹੈ - ਦੂਜੇ, ਲੇਟੈਂਸੀ-ਸੰਵੇਦਨਸ਼ੀਲ ਪੜਾਅ ਦੇ ਅਨੁਮਾਨ ਨੂੰ ਸੰਭਾਲਦੀ ਹੈ - ਜਦੋਂ ਕਿ ਸੇਰੇਬ੍ਰਾਸ-ਪਾਵਰਡ ਹੈਲੀਓਸ ਸਿਸਟਮ ਵਰਗੇ ਵਧੇਰੇ ਲਚਕਦਾਰ ਹਾਰਡਵੇਅਰ ਪ੍ਰੀਫਿਲ ਪੜਾਅ ਨੂੰ ਹੈਂਡਲ ਕਰਦਾ ਹੈ। AMD ਨੇ ਅਜੇ ਤੱਕ ਇਸ ਗੱਲ ਦਾ ਵੇਰਵਾ ਨਹੀਂ ਦਿੱਤਾ ਹੈ ਕਿ Taalas ਦੇ ਚਿਪਸ ਇਸਦੇ ਉਤਪਾਦ ਰੋਡਮੈਪ ਵਿੱਚ ਕਿੱਥੇ ਸਲੋਟ ਹੋਣਗੇ.
ਤਾਲਾ ਕਿਸਨੇ ਬਣਾਇਆ
Taalas ਦੀ ਸਥਾਪਨਾ 2023 ਵਿੱਚ ਟੋਰਾਂਟੋ-ਸਥਾਪਿਤ, ਹੁਣ ਸੈਂਟਾ ਕਲਾਰਾ-ਅਧਾਰਤ AI ਚਿੱਪਮੇਕਰ, ਟੈਨਸਟੋਰੈਂਟ ਵਿਖੇ ਸਾਬਕਾ AMD ਕਰਮਚਾਰੀਆਂ ਅਤੇ ਨੇਤਾਵਾਂ ਦੀ ਤਿਕੜੀ ਦੁਆਰਾ ਕੀਤੀ ਗਈ ਸੀ। ਸੰਸਥਾਪਕ ਟੀਮ ਵਿੱਚ CEO Ljubisa Bajic, ਇੱਕ ਸਹਿ-ਸੰਸਥਾਪਕ ਅਤੇ ਸਾਬਕਾ ਮੁੱਖ ਕਾਰਜਕਾਰੀ, ਮੁੱਖ ਤਕਨਾਲੋਜੀ ਅਧਿਕਾਰੀ, ਅਤੇ Tenstorrent ਦੇ ਪ੍ਰਧਾਨ ਸ਼ਾਮਲ ਹਨ; ਸੀਓਓ ਲੇਜਲਾ ਬਾਜਿਕ; ਅਤੇ ਸੀਟੀਓ ਡਰੈਗੋ ਇਗਜਾਤੋਵਿਕ।
ਕੰਪਨੀ 2024 ਵਿੱਚ ਸਟੀਲਥ ਤੋਂ ਉੱਭਰ ਕੇ ਸਾਹਮਣੇ ਆਈ, ਜਿਸ ਵਿੱਚ ਕੁਆਇਟ ਕੈਪੀਟਲ ਅਤੇ ਅਨੁਭਵੀ ਸੈਮੀਕੰਡਕਟਰ ਨਿਵੇਸ਼ਕ ਪੀਅਰੇ ਲੈਮੰਡ ਤੋਂ $50 ਮਿਲੀਅਨ ਫੰਡਿੰਗ ਦਾ ਖੁਲਾਸਾ ਹੋਇਆ। ਇਸ ਤੋਂ ਪਹਿਲਾਂ 2026 ਵਿੱਚ ਇਸਨੇ ਇੱਕ ਸਮੂਹ ਤੋਂ ਵਾਧੂ $169 ਮਿਲੀਅਨ ਦੀ ਘੋਸ਼ਣਾ ਕੀਤੀ ਜਿਸ ਵਿੱਚ ਫਿਡੇਲਿਟੀ ਸ਼ਾਮਲ ਸੀ। Taalas ਨੇ ਦਾਅਵਾ ਕੀਤਾ ਹੈ ਕਿ ਇਹ ਇੱਕ ਉਦਯੋਗ ਦੇ ਮਿਆਰ ਦੇ ਮੁਕਾਬਲੇ ਦੋ ਮਹੀਨਿਆਂ ਵਿੱਚ ਇੱਕ ਨਵੀਂ ਕਸਟਮ ਚਿੱਪ ਲਾਂਚ ਕਰ ਸਕਦਾ ਹੈ, ਜੋ ਅਕਸਰ ਇੱਕ ਜਾਂ ਦੋ ਸਾਲਾਂ ਤੱਕ ਫੈਲਦਾ ਹੈ, ਅਤੇ ਸੱਟੇਬਾਜ਼ੀ ਕੀਤੀ ਹੈ ਕਿ ਇਹ ਸੌਫਟਵੇਅਰ-ਅਧਾਰਿਤ ਹਮਰੁਤਬਾ ਨਾਲੋਂ ਹਜ਼ਾਰ ਗੁਣਾ ਵਧੇਰੇ ਕੁਸ਼ਲ ਹਾਰਡਵੇਅਰ ਪੈਦਾ ਕਰ ਸਕਦਾ ਹੈ।
AMD ਪ੍ਰਾਪਤੀ ਦੀਆਂ ਵਿੱਤੀ ਸ਼ਰਤਾਂ ਦਾ ਖੁਲਾਸਾ ਨਹੀਂ ਕੀਤਾ ਗਿਆ ਸੀ। ਲੈਣ-ਦੇਣ ਬੰਦ ਹੋਣ ਦੀਆਂ ਸ਼ਰਤਾਂ ਅਤੇ ਰੈਗੂਲੇਟਰੀ ਪ੍ਰਵਾਨਗੀ ਦੇ ਅਧੀਨ ਰਹਿੰਦਾ ਹੈ।
AMD ਹੁਣ ਕਿਉਂ ਖਰੀਦ ਰਿਹਾ ਹੈ
AMD ਨੇ Taalas ਨੂੰ ਵਿਸ਼ੇਸ਼ AI ਇਨਫਰੈਂਸ ਸਿਲੀਕੋਨ ਵਿੱਚ ਇੱਕ ਪਾਇਨੀਅਰ ਵਜੋਂ ਦਰਸਾਇਆ ਜਿਸਦੀ ਤਕਨਾਲੋਜੀ AI ਇਨਫਰੈਂਸ ਡੇਟਾਫਲੋਜ਼ ਨੂੰ ਅਨੁਕੂਲ ਬਣਾਉਂਦੀ ਹੈ ਅਤੇ ਆਮ-ਉਦੇਸ਼ ਵਾਲੇ ਢਾਂਚੇ ਨਾਲ ਸਬੰਧਿਤ ਗਣਨਾ ਅਤੇ ਮੈਮੋਰੀ ਰੁਕਾਵਟਾਂ ਨੂੰ ਮਹੱਤਵਪੂਰਨ ਤੌਰ 'ਤੇ ਘਟਾਉਂਦੀ ਹੈ।
"Talas ਦੀ ਤਕਨਾਲੋਜੀ ਅਤੇ ਵਿਸ਼ਵ-ਪੱਧਰੀ ਇੰਜੀਨੀਅਰਿੰਗ ਟੀਮ ਵਿਭਿੰਨ ਅਨੁਮਾਨ ਪ੍ਰਦਰਸ਼ਨ ਅਤੇ ਕੁਸ਼ਲਤਾ ਪ੍ਰਦਾਨ ਕਰਕੇ ਸਾਡੇ AI ਪੋਰਟਫੋਲੀਓ ਨੂੰ ਮਜ਼ਬੂਤ ਕਰਦੀ ਹੈ," ਇਸਦੇ AI ਸਮੂਹ ਦੇ AMD ਸੀਨੀਅਰ ਉਪ-ਪ੍ਰਧਾਨ ਵਾਮਸੀ ਬੋਪਪਾਨਾ ਨੇ ਇੱਕ ਨਿਊਜ਼ ਰਿਲੀਜ਼ ਵਿੱਚ ਕਿਹਾ।
ਸੌਦਾ ਇੱਕ ਵਿਆਪਕ ਪੈਟਰਨ ਨੂੰ ਵਧਾਉਂਦਾ ਹੈ. ਸੇਰੇਬਰਾਸ ਨਾਲ ਏਐਮਡੀ ਦਾ ਪਹਿਲਾ ਸਮਝੌਤਾ ਬਾਅਦ ਦੇ ਵੇਫਰ-ਸਕੇਲ ਇੰਜਣ ਨੂੰ ਆਉਣ ਵਾਲੇ ਹੇਲੀਓਸ ਰੈਕ-ਸਕੇਲ ਸਿਸਟਮ ਵਿੱਚ ਏਕੀਕ੍ਰਿਤ ਕਰਦਾ ਹੈ, ਜੋ ਕਿ ਸਿਲੀਕਾਨ ਦੀ ਇੱਕ ਸਿੰਗਲ, ਆਪਸ ਵਿੱਚ ਜੁੜੀ ਸ਼ੀਟ ਉੱਤੇ ਬਹੁਤ ਜ਼ਿਆਦਾ ਮੈਮੋਰੀ ਅਤੇ ਗਣਨਾ ਕਰਦਾ ਹੈ। Taalas ਨੂੰ ਜੋੜਨਾ AMD ਨੂੰ ਇਸਦੇ ਆਪਣੇ Instinct GPUs ਅਤੇ ਸੇਰੇਬ੍ਰਾਸ ਸਾਂਝੇਦਾਰੀ ਦੇ ਨਾਲ, ਇਸਦੇ ਅਨੁਮਾਨ ਹਥਿਆਰਾਂ ਵਿੱਚ ਇੱਕ ਤੀਜਾ ਵੱਖਰਾ ਹਥਿਆਰ ਦਿੰਦਾ ਹੈ।
AMD ਲਈ, ਅਪੀਲ ਸਪੱਸ਼ਟ ਹੈ। ਐਨਵੀਡੀਆ ਨੇ ਆਪਣੇ GPU ਈਕੋਸਿਸਟਮ ਦੇ ਨਾਲ AI ਸਿਖਲਾਈ ਅਤੇ ਅਨੁਮਾਨਾਂ 'ਤੇ ਹਾਵੀ ਹੋਣਾ ਜਾਰੀ ਰੱਖਿਆ ਹੈ, ਅਤੇ ਚੁਣੌਤੀਆਂ ਨੇ ਆਮ-ਉਦੇਸ਼ ਵਾਲੇ ਗਣਨਾ 'ਤੇ ਮੁਕਾਬਲਾ ਕਰਨ ਲਈ ਸੰਘਰਸ਼ ਕੀਤਾ ਹੈ। ਬੁਨਿਆਦੀ ਤੌਰ 'ਤੇ ਵੱਖ-ਵੱਖ ਆਰਕੀਟੈਕਚਰ - ਵੇਫਰ-ਸਕੇਲ ਇੰਜਣਾਂ, ਹਾਰਡਵਾਇਰਡ ਮਾਡਲ ਸਿਲੀਕੋਨ - AMD ਨੂੰ ਹਾਸਲ ਕਰਕੇ ਇਹ ਸੱਟੇਬਾਜ਼ੀ ਕਰ ਰਿਹਾ ਹੈ ਕਿ ਵਿਸ਼ੇਸ਼ ਹਾਰਡਵੇਅਰ ਮੁਨਾਫ਼ੇ ਵਾਲੇ ਸਥਾਨਾਂ ਨੂੰ ਤਿਆਰ ਕਰੇਗਾ ਜੋ Nvidia ਦੇ ਇੱਕ-ਆਕਾਰ-ਫਿੱਟ-ਸਾਰੇ GPUs ਕੁਸ਼ਲਤਾ ਨਾਲ ਕੰਮ ਨਹੀਂ ਕਰ ਸਕਦੇ ਹਨ।
ਸ਼ਿਫਟਿੰਗ ਇਨਫਰੈਂਸ ਮਾਰਕੀਟ
ਪ੍ਰਾਪਤੀ ਇੱਕ ਵਿਆਪਕ ਉਦਯੋਗਿਕ ਤਬਦੀਲੀ ਨੂੰ ਵੀ ਬੋਲਦੀ ਹੈ। ਜਿਵੇਂ ਕਿ AI ਮਾਡਲ ਵੱਡੇ ਹੁੰਦੇ ਹਨ ਅਤੇ ਅਨੁਮਾਨ ਦੀ ਲਾਗਤ ਗੁਬਾਰੇ ਵਿੱਚ ਹੁੰਦੀ ਹੈ, ਉਹਨਾਂ ਨੂੰ ਆਮ-ਉਦੇਸ਼ ਵਾਲੇ GPUs 'ਤੇ ਚਲਾਉਣ ਦਾ ਅਰਥ ਸ਼ਾਸਤਰ ਦਬਾਅ ਹੇਠ ਆ ਰਿਹਾ ਹੈ। ਵਿਸ਼ੇਸ਼ ਅਨੁਮਾਨ ਚਿਪਸ ਉੱਚ-ਵਾਲੀਅਮ ਤੈਨਾਤੀਆਂ ਲਈ ਨਾਟਕੀ ਲਾਗਤ ਘਟਾਉਣ ਦਾ ਵਾਅਦਾ ਕਰਦੇ ਹਨ, ਜਿੱਥੇ ਇੱਕੋ ਮਾਡਲ ਨੂੰ ਲੱਖਾਂ ਵਾਰ ਚਲਾਇਆ ਜਾਂਦਾ ਹੈ।
ਜੇਕਰ AMD ਟਾਲਸ ਦੀ ਹਾਰਡਵਾਇਰਡ ਪਹੁੰਚ ਦਾ ਸਫਲਤਾਪੂਰਵਕ ਵਪਾਰੀਕਰਨ ਕਰ ਸਕਦਾ ਹੈ, ਤਾਂ ਇਹ ਕਲਾਉਡ ਪ੍ਰਦਾਤਾਵਾਂ ਅਤੇ ਉੱਦਮਾਂ ਨੂੰ ਰਵਾਇਤੀ GPUs ਦੀ ਲਾਗਤ ਅਤੇ ਲੇਟੈਂਸੀ ਦੇ ਇੱਕ ਹਿੱਸੇ 'ਤੇ ਪ੍ਰਸਿੱਧ ਮਾਡਲਾਂ ਨੂੰ ਚਲਾਉਣ ਦਾ ਇੱਕ ਤਰੀਕਾ ਪ੍ਰਦਾਨ ਕਰ ਸਕਦਾ ਹੈ - ਬਸ਼ਰਤੇ ਉਹ ਇੱਕ ਸਿੰਗਲ ਮਾਡਲ ਦੇ ਆਲੇ ਦੁਆਲੇ ਬਣੇ ਸਿਲੀਕਾਨ ਲਈ ਵਚਨਬੱਧ ਹੋਣ ਲਈ ਤਿਆਰ ਹੋਣ।
ਚਿੱਪ ਵਾਰਾਂ ਤੋਂ ਅੱਗੇ ਰਹੋ
AI ਹਾਰਡਵੇਅਰ ਦੀ ਸਰਵਉੱਚਤਾ ਦੀ ਲੜਾਈ ਤੇਜ਼ ਹੋ ਰਹੀ ਹੈ, ਹਰ ਪ੍ਰਾਪਤੀ ਸ਼ਕਤੀ ਦੇ ਸੰਤੁਲਨ ਨੂੰ ਮੁੜ ਆਕਾਰ ਦੇਣ ਦੇ ਨਾਲ. ਅਗਲੀ ਪੀੜ੍ਹੀ ਦੀ ਬੁੱਧੀ ਨੂੰ ਚਲਾਉਣ ਵਾਲੇ ਸਿਲੀਕਾਨ ਵਿੱਚ ਡੂੰਘੇ ਗੋਤਾਖੋਰੀ ਲਈ ਸਾਡੇ ਨਵੀਨਤਮ AI ਵਿਕਾਸ ਦਾ ਪਾਲਣ ਕਰੋ।
ਹੋਰ AI ਖਬਰਾਂ ਪੜ੍ਹੋ →