ਮੈਟਾ ਨੇ MTIA 400 'ਤੇ ਪਰਦਾ ਵਾਪਸ ਖਿੱਚ ਲਿਆ ਹੈ, ਇਸਦਾ ਪਹਿਲਾ ਕਸਟਮ ਐਕਸਲੇਟਰ ਵੱਡੇ ਭਾਸ਼ਾ ਦੇ ਮਾਡਲਾਂ ਨੂੰ ਸਿਖਲਾਈ ਦੇਣਾ ਹੈ - ਇੱਕ ਅਸਾਧਾਰਨ ਮੋੜ ਦੇ ਨਾਲ। ਸਲਾਨਾ ਹੌਟ ਚਿਪਸ ਸੈਮੀਕੰਡਕਟਰ ਕਾਨਫਰੰਸ ਵਿੱਚ ਇਸ ਹਫ਼ਤੇ ਵਿਸਤ੍ਰਿਤ ਚਿਪ, ਡੂੰਘੀ ਸਿਖਲਾਈ ਦੇ ਸਿਫਾਰਿਸ਼ਕਰਤਾ ਦੇ ਵਰਕਲੋਡ ਨੂੰ ਵੀ ਲੈ ਕੇ ਜਾਵੇਗੀ ਜੋ ਮੈਟਾ ਦੀ ਪੂਰੀ AI ਅਭਿਲਾਸ਼ਾ ਨੂੰ ਫੰਡ ਦੇਣ ਵਾਲੇ ਵਿਗਿਆਪਨਾਂ ਦੀ ਸੇਵਾ ਕਰਦੇ ਹਨ।

ਰਜਿਸਟਰ, ਜਿਸ ਨੇ ਸਭ ਤੋਂ ਪਹਿਲਾਂ ਪੂਰੇ ਤਕਨੀਕੀ ਖੁਲਾਸੇ ਦੀ ਰਿਪੋਰਟ ਕੀਤੀ, ਨੇ ਡਿਜ਼ਾਈਨ ਨੂੰ "ਸਪਲਿਟ ਸ਼ਖਸੀਅਤ" ਕਿਹਾ: ਇੱਕ ਪਾਸੇ ਇੱਕ ਫਰੰਟੀਅਰ-ਸਿਖਲਾਈ ਚਿੱਪ, ਦੂਜੇ ਪਾਸੇ ਇੱਕ ਵਿਗਿਆਪਨ-ਸੇਵਾ ਕਰਨ ਵਾਲਾ ਇੰਜਣ। ਇਹ ਅਜੇ ਤੱਕ ਸਭ ਤੋਂ ਸਪੱਸ਼ਟ ਸੰਕੇਤ ਹੈ ਕਿ ਮੈਟਾ ਆਪਣੇ AI ਭਵਿੱਖ ਨੂੰ ਆਪਣੇ ਸਿਲੀਕਾਨ 'ਤੇ ਚਲਾਉਣ ਦਾ ਇਰਾਦਾ ਰੱਖਦਾ ਹੈ। ਨਵੀਨਤਮ AI ਵਿਕਾਸ ਚਿੱਪ ਉਦਯੋਗ ਨੂੰ ਆਕਾਰ ਦੇਣ ਬਾਰੇ ਹੋਰ ਜਾਣਨ ਲਈ, AI Buzz Wire ਦਾ ਅਨੁਸਰਣ ਕਰੋ।

ਏਆਈ ਨੂੰ ਕਿਉਂ ਸਿਖਲਾਈ ਦਿਓ ਅਤੇ ਇੱਕੋ ਚਿੱਪ 'ਤੇ ਵਿਗਿਆਪਨਾਂ ਨੂੰ ਸਰਵ ਕਰੋ?

ਕਸਟਮ ਏਆਈ ਐਕਸਲੇਟਰ ਬਣਾਉਣ ਵਾਲੀਆਂ ਜ਼ਿਆਦਾਤਰ ਕੰਪਨੀਆਂ ਅਨੁਮਾਨ ਨਾਲ ਸ਼ੁਰੂ ਹੁੰਦੀਆਂ ਹਨ। ਕਲੱਸਟਰ ਛੋਟੇ ਹਨ, ਚਿਪਸ ਸਧਾਰਨ ਹਨ, ਅਤੇ ਕੰਮ ਚੰਗੀ ਤਰ੍ਹਾਂ ਸਮਝਿਆ ਜਾਂਦਾ ਹੈ। ਮੈਟਾ ਪਹਿਲਾਂ LLM ਸਿਖਲਾਈ ਨੂੰ ਨਿਸ਼ਾਨਾ ਬਣਾ ਕੇ ਇਸ ਰੁਝਾਨ ਨੂੰ ਰੋਕ ਰਿਹਾ ਹੈ - ਉਦਯੋਗ ਵਿੱਚ ਸਭ ਤੋਂ ਵੱਧ ਗਣਨਾ-ਸਹਿਤ ਵਰਕਲੋਡ, ਜਿਸ ਨੂੰ ਅਕਸਰ ਦਸਾਂ ਜਾਂ ਸੈਂਕੜੇ ਹਜ਼ਾਰਾਂ ਐਕਸਲੇਟਰਾਂ ਦੀ ਲੋੜ ਹੁੰਦੀ ਹੈ।

ਸਮਝੌਤਾ ਦੂਜਾ ਕੰਮ ਦਾ ਬੋਝ ਹੈ। DLRM ਅਨੁਮਾਨ - ਡੂੰਘੀ ਸਿਖਲਾਈ ਦਾ ਸਿਫ਼ਾਰਸ਼ ਕਰਨ ਵਾਲਾ ਮਾਡਲ ਜੋ ਇਹ ਫੈਸਲਾ ਕਰਦਾ ਹੈ ਕਿ ਉਪਭੋਗਤਾ ਕਿਹੜੇ ਵਿਗਿਆਪਨ ਅਤੇ ਪੋਸਟਾਂ ਨੂੰ ਦੇਖਦੇ ਹਨ - ਮੁੱਖ ਤੌਰ 'ਤੇ ਗਣਨਾ-ਬਾਊਂਡ ਦੀ ਬਜਾਏ ਮੈਮੋਰੀ-ਬਾਊਂਡ ਹੁੰਦਾ ਹੈ, ਮਤਲਬ ਕਿ ਚਿੱਪ ਦੀ ਸਿਖਲਾਈ ਫਾਇਰਪਾਵਰ ਦਾ ਜ਼ਿਆਦਾਤਰ ਹਿੱਸਾ ਵਿਗਿਆਪਨ ਸੇਵਾ ਦੌਰਾਨ ਵਿਹਲਾ ਰਹਿੰਦਾ ਹੈ। ਪਰ ਮੈਟਾ ਨੇ ਕੰਪਿਊਟ 'ਤੇ ਅਰਬਾਂ ਡਾਲਰ ਬਰਨ ਕਰਨ ਦੇ ਨਾਲ, ਇੱਕ ਚਿੱਪ ਪੁੱਲ ਡਬਲ ਡਿਊਟੀ ਲਗਾਉਣਾ ਇੱਕ ਵਿਵਹਾਰਕ ਹੇਜ ਹੈ, ਖਾਸ ਕਰਕੇ ਜਦੋਂ ਦੋ ਵਰਤੋਂ ਦੇ ਮਾਮਲਿਆਂ ਵਿੱਚੋਂ ਇੱਕ ਸਿੱਧੇ ਤੌਰ 'ਤੇ ਮਾਲੀਆ ਪੈਦਾ ਕਰਦਾ ਹੈ।

MTIA 400 ਦੇ ਅੰਦਰ: 3nm ਚਿਪਲੇਟਸ ਅਤੇ ਬ੍ਰੌਡਕਾਮ ਆਈ.ਪੀ

ਮੈਟਾ ਦੀ ਹੌਟ ਚਿਪਸ ਪੇਸ਼ਕਾਰੀ ਦੇ ਅਨੁਸਾਰ, ਜਿਵੇਂ ਕਿ ਰਜਿਸਟਰ ਅਤੇ ਸਰਵ ਦਿ ਹੋਮ ਦੁਆਰਾ ਵਿਸ਼ਲੇਸ਼ਣ ਕੀਤਾ ਗਿਆ ਹੈ:

  • ਮਲਟੀ-ਡਾਈ ਆਰਕੀਟੈਕਚਰ: ਦੋ ਕੰਪਿਊਟ ਡਾਈਜ਼, ਦੋ I/O ਡਾਈਜ਼, ਅਤੇ ਇੱਕ SoC ਡਾਈ ਹੈਂਡਲਿੰਗ ਹੋਸਟ ਕਨੈਕਟੀਵਿਟੀ ਅਤੇ ਵਰਕਲੋਡ ਆਰਕੈਸਟਰੇਸ਼ਨ
  • ਪ੍ਰਕਿਰਿਆ ਨੋਡ: ਕੰਪਿਊਟ ਚਿਪਲੇਟਸ 3nm ਪ੍ਰਕਿਰਿਆ ਤਕਨਾਲੋਜੀ 'ਤੇ ਬਣਾਏ ਗਏ ਹਨ, ਸੰਭਵ ਤੌਰ 'ਤੇ TSMC ਤੋਂ
  • ਕੰਪਿਊਟ: ਪ੍ਰਤੀ ਚਿਪਲੇਟ ਪ੍ਰੋਸੈਸਿੰਗ ਐਲੀਮੈਂਟਸ ਦਾ 6x8 ਗਰਿੱਡ, 1.7 GHz 'ਤੇ MXFP4 ਕੰਪਿਊਟ ਦੇ ਸੰਯੁਕਤ 12 petaFLOPS ਪ੍ਰਦਾਨ ਕਰਦਾ ਹੈ।
  • ਮੈਮੋਰੀ: ਅੱਠ 36 GB HBM3e ਸਟੈਕ — ਲਗਭਗ 9.2 TB/s ਬੈਂਡਵਿਡਥ ਦੇ ਨਾਲ ਕੁੱਲ 288 GB
  • ਇੰਟਰਕਨੈਕਟ: RDMA ਉੱਤੇ ਚਿੱਪ-ਟੂ-ਚਿੱਪ ਬੈਂਡਵਿਡਥ ਦਾ 1.2 TB/s, ਸੰਭਾਵਤ ਤੌਰ 'ਤੇ ਈਥਰਨੈੱਟ ਨੂੰ ਬ੍ਰੌਡਕਾਮ ਦੀ ਸ਼ਮੂਲੀਅਤ ਦਿੱਤੀ ਗਈ ਹੈ

Broadcom ਦੇ ਫਿੰਗਰਪ੍ਰਿੰਟਸ ਹਰ ਜਗ੍ਹਾ ਹਨ. ਰਜਿਸਟਰ ਨੋਟ ਕਰਦਾ ਹੈ ਕਿ ਐਕਸਲੇਟਰ ਲਗਭਗ ਨਿਸ਼ਚਤ ਤੌਰ 'ਤੇ ਚਿੱਪ ਡਿਜ਼ਾਈਨਰ ਦੇ XPU IP ਦੀ ਵਰਤੋਂ ਕਰਕੇ ਬਣਾਇਆ ਗਿਆ ਸੀ - ਇੱਕ ਵਿਹਾਰਕ ਵਿਕਲਪ ਜੋ ਮੈਟਾ ਨੂੰ ਐਕਸਲੇਟਰ ਡਿਜ਼ਾਈਨ ਦੇ ਬੇਮਿਸਾਲ ਹਿੱਸਿਆਂ ਨੂੰ ਆਊਟਸੋਰਸ ਕਰਦੇ ਹੋਏ ਵਿਭਿੰਨਤਾ 'ਤੇ ਫੋਕਸ ਕਰਨ ਦਿੰਦਾ ਹੈ।

ਇਹ ਐਨਵੀਡੀਆ ਅਤੇ ਏਐਮਡੀ ਦੇ ਵਿਰੁੱਧ ਕਿਵੇਂ ਸਟੈਕ ਕਰਦਾ ਹੈ

ਪ੍ਰਦਰਸ਼ਨ ਤਸਵੀਰ ਸੂਖਮ ਹੈ. ਆਮ ਤੌਰ 'ਤੇ ਸਿਖਲਾਈ ਲਈ ਵਰਤੇ ਜਾਂਦੇ ਉੱਚ ਸਟੀਕਸ਼ਨਾਂ 'ਤੇ, MTIA 400 ਐਨਵੀਡੀਆ ਦੇ ਉੱਚ-ਵਿਸ਼ੇਸ਼ ਬਲੈਕਵੈਲ ਐਕਸਲੇਟਰਾਂ ਨਾਲੋਂ ਲਗਭਗ 20% ਤੇਜ਼ ਹੈ ਜਦੋਂ ਕਿ ਸਮਾਨ ਸ਼ਕਤੀ ਖਿੱਚਦੀ ਹੈ। ਇਸਦੀ ਮੈਮੋਰੀ ਬੈਂਡਵਿਡਥ ਐਨਵੀਡੀਆ ਅਤੇ ਏਐਮਡੀ ਦੇ ਪਿਛਲੀ ਪੀੜ੍ਹੀ ਦੇ ਹਿੱਸਿਆਂ ਨਾਲੋਂ ਲਗਭਗ 15% ਬਿਹਤਰ ਹੈ।

ਪਰ ਨਵੀਂ ਪੀੜ੍ਹੀ ਦੇ ਵਿਰੁੱਧ, ਇਹ ਪਾੜਾ ਤੇਜ਼ੀ ਨਾਲ ਵਧਦਾ ਹੈ: MTIA 400 Nvidia ਦੇ Rubin ਅਤੇ AMD ਦੇ Instinct MI455X ਨਾਲੋਂ ਕ੍ਰਮਵਾਰ 3x ਅਤੇ 3.3x ਹੌਲੀ ਹੈ, ਅਤੇ ਇਹ ਉਹਨਾਂ ਨਵੇਂ GPUs ਦੀ ਅੱਧੀ ਤੋਂ ਵੀ ਘੱਟ ਮੈਮੋਰੀ ਬੈਂਡਵਿਡਥ ਦੀ ਪੇਸ਼ਕਸ਼ ਕਰਦਾ ਹੈ। ਇਹ ਘਾਟ ਬਿਲਕੁਲ ਇਸੇ ਲਈ ਹੈ ਕਿ ਮੇਟਾ ਇੱਕ ਅਨੁਮਾਨ ਚਿੱਪ ਦੀ ਬਜਾਏ ਇੱਕ ਸਿਖਲਾਈ ਚਿੱਪ ਦੇ ਤੌਰ ਤੇ ਹਿੱਸੇ ਨੂੰ ਪੋਜੀਸ਼ਨ ਕਰ ਰਿਹਾ ਹੈ - ਟੋਕਨਾਂ ਦੀ ਸੇਵਾ ਕਰਨ ਲਈ, ਇਸ ਵਿੱਚ ਬਹੁਤ ਤੇਜ਼ ਵਿਕਲਪ ਹਨ।

ਸਿਸਟਮ ਪੱਧਰ 'ਤੇ, ਉਦਯੋਗ ਦੇ ਮਿਆਰੀ ਰੈਕਾਂ ਦੀ ਸਮਾਨਤਾ ਹੈਰਾਨੀਜਨਕ ਹੈ। ਹਰੇਕ ਕੰਪਿਊਟ ਬਲੇਡ ਇੱਕ PCIe ਸਵਿੱਚ, ਇੱਕ x86 CPU, ਅਤੇ ਇੱਕ ਸਕੇਲ-ਆਊਟ NIC ਨਾਲ ਚਾਰ MTIA 400 ਐਕਸੀਲੇਟਰ ਜੋੜਦਾ ਹੈ। ਇੱਕ ਪੂਰੇ ਰੈਕ ਵਿੱਚ 18 ਕੰਪਿਊਟ ਬਲੇਡ ਅਤੇ ਅੱਠ ਸਵਿੱਚ ਬਲੇਡ ਹੁੰਦੇ ਹਨ - ਇੱਕ ਸਿੰਗਲ ਯੂਨੀਫਾਈਡ ਡੋਮੇਨ ਵਿੱਚ 72 ਐਕਸੀਲੇਟਰ, ਇੱਕ ਸੰਰਚਨਾ ਜੋ Nvidia ਦੇ NVL72 ਅਤੇ AMD ਦੇ Helios ਰੈਕ ਡਿਜ਼ਾਈਨ ਨੂੰ ਦਰਸਾਉਂਦੀ ਹੈ। ਮੈਟਾ ਦੀਆਂ ਸਲਾਈਡਾਂ ਕਲੱਸਟਰ ਸੀਲਿੰਗਾਂ ਨੂੰ ਨਿਰਧਾਰਤ ਕੀਤੇ ਬਿਨਾਂ "ਮਲਟੀ-ਹਜ਼ਾਰ ਐਕਸਲੇਟਰ ਸਕੇਲਿੰਗ" ਦਾ ਵਾਅਦਾ ਕਰਦੀਆਂ ਹਨ।

ਰੋਡਮੈਪ: ਅਗਲੇ ਸਾਲ MTIA 450

MTIA 400 ਲਾਈਨ ਦਾ ਅੰਤ ਨਹੀਂ ਹੈ। ਮੇਟਾ ਨੇ ਮਾਰਚ ਵਿੱਚ ਖੁਲਾਸਾ ਕੀਤਾ ਕਿ ਇਹ ਚਾਰ ਨਵੀਆਂ MTIA ਪੀੜ੍ਹੀਆਂ ਵਿੱਚ ਛੇ-ਮਹੀਨੇ ਦੇ ਰੀਲੀਜ਼ ਕੈਡੈਂਸ ਦੀ ਯੋਜਨਾ ਬਣਾ ਰਿਹਾ ਹੈ, ਅਤੇ ਅਗਲਾ ਸਟਾਪ MTIA 450 ਹੈ - ਇੱਕ ਅਨੁਮਾਨ-ਅਨੁਕੂਲ ਰੂਪ ਵਿੱਚ ਮੈਮੋਰੀ ਬੈਂਡਵਿਡਥ ਨੂੰ ਦੁੱਗਣਾ ਕਰਨ ਦੀ ਉਮੀਦ ਹੈ, ਸੰਭਵ ਤੌਰ 'ਤੇ HBM4 ਨੂੰ ਅਪਣਾ ਕੇ। ਇਹ ਚਿੱਪ ਅਗਲੇ ਸਾਲ ਉਤਪਾਦਨ ਲਈ ਤਿਆਰ ਹੈ ਅਤੇ ਇਹ LLM-ਅਧਾਰਿਤ ਸਿਫ਼ਾਰਿਸ਼ ਵਰਕਲੋਡਾਂ ਨੂੰ ਚਲਾਉਣ ਲਈ ਚੰਗੀ ਤਰ੍ਹਾਂ ਅਨੁਕੂਲ ਹੋਣੀ ਚਾਹੀਦੀ ਹੈ।

ਤਰੱਕੀ ਦੇ ਬਾਵਜੂਦ, ਰਜਿਸਟਰ ਦਾ ਵਿਸ਼ਲੇਸ਼ਣ ਧੁੰਦਲਾ ਹੈ: ਮੈਟਾ ਦਾ ਇਨ-ਹਾਊਸ ਸਿਲੀਕਾਨ ਕਿਸੇ ਵੀ ਸਮੇਂ ਜਲਦੀ ਹੀ AMD ਜਾਂ Nvidia GPUs ਨੂੰ ਨਹੀਂ ਬਦਲੇਗਾ। Meta Superintelligence Labs ਲਗਭਗ ਨਿਸ਼ਚਿਤ ਤੌਰ 'ਤੇ ਅਜੇ ਵੀ ਰਵਾਇਤੀ GPUs 'ਤੇ ਸਰਹੱਦੀ ਮਾਡਲਾਂ ਨੂੰ ਸਿਖਲਾਈ ਦੇ ਰਹੀ ਹੈ, ਅਤੇ ਐਪਲੀਕੇਸ਼ਨ-ਵਿਸ਼ੇਸ਼ ਹਾਰਡਵੇਅਰ ਚੰਗੀ ਤਰ੍ਹਾਂ ਸਮਝੇ ਗਏ, ਸਥਿਰ ਵਰਕਲੋਡਾਂ ਲਈ ਸਭ ਤੋਂ ਅਨੁਕੂਲ ਰਹਿੰਦਾ ਹੈ।

ਇਹ ਮਾਇਨੇ ਕਿਉਂ ਰੱਖਦਾ ਹੈ

MTIA 400 ਦੋ ਕਾਰਨਾਂ ਕਰਕੇ ਮਹੱਤਵਪੂਰਨ ਹੈ। ਪਹਿਲਾਂ, ਇਹ ਇੱਕ ਹਾਈਪਰਸਕੇਲਰ ਦਿਖਾਉਂਦਾ ਹੈ ਜੋ ਆਸਾਨ ਅਨੁਮਾਨ ਜਿੱਤਣ ਦੀ ਬਜਾਏ ਸਭ ਤੋਂ ਔਖੇ ਕੰਮ ਦੇ ਬੋਝ - ਸਰਹੱਦੀ ਸਿਖਲਾਈ - 'ਤੇ ਹਮਲਾ ਕਰਨ ਲਈ ਤਿਆਰ ਹੈ। ਦੂਜਾ, ਡਿਜ਼ਾਈਨ ਦਾ ਵਿਗਿਆਪਨ-ਸੇਵਾ ਕਰਨ ਵਾਲਾ ਪੱਖ ਅਰਥ ਸ਼ਾਸਤਰ ਦੀ ਯਾਦ ਦਿਵਾਉਂਦਾ ਹੈ: ਕਸਟਮ ਸਿਲੀਕਾਨ 'ਤੇ ਕੈਪੈਕਸ ਦਾ ਹਰ ਡਾਲਰ ਇਤਿਹਾਸ ਦੇ ਸਭ ਤੋਂ ਵੱਧ ਲਾਭਕਾਰੀ ਵਿਗਿਆਪਨ ਕਾਰੋਬਾਰ ਦੁਆਰਾ ਅੰਡਰਰਾਈਟ ਕੀਤਾ ਜਾਂਦਾ ਹੈ। ਜੇਕਰ ਮੈਟਾ ਵਪਾਰੀ GPUs ਤੋਂ ਆਪਣੀ ਸਿਖਲਾਈ ਅਤੇ ਸਿਫ਼ਾਰਿਸ਼ ਵਰਕਲੋਡ ਦੇ ਇੱਕ ਹਿੱਸੇ ਨੂੰ ਵੀ ਬਦਲ ਸਕਦਾ ਹੈ, ਤਾਂ ਇਸਦੇ ਪੈਮਾਨੇ 'ਤੇ ਬਚਤ ਅਰਬਾਂ ਵਿੱਚ ਮਾਪੀ ਜਾਵੇਗੀ।

ਸਰੋਤ: Meta's Hot Chips 2026 ਪੇਸ਼ਕਾਰੀ, The Register, and ServeTheHome.

---

AI ਤੋਂ ਅੱਗੇ ਰਹੋ

ਨਵੀਨਤਮ AI ਖਬਰਾਂ, ਵਿਸ਼ਲੇਸ਼ਣ ਅਤੇ ਸਫਲਤਾਵਾਂ ਪ੍ਰਾਪਤ ਕਰੋ - ਸਭ ਇੱਕ ਥਾਂ 'ਤੇ।

ਹੋਰ AI ਖਬਰਾਂ ਪੜ੍ਹੋ →