ਜਿਵੇਂ ਕਿ ਆਰਟੀਫੀਸ਼ੀਅਲ ਇੰਟੈਲੀਜੈਂਸ ਸਿੰਗਲ-ਟਰਨ ਚੈਟਬੋਟਸ ਤੋਂ ਆਟੋਨੋਮਸ ਏਜੰਟਾਂ ਵੱਲ ਬਦਲਦੀ ਹੈ ਜੋ ਲਗਾਤਾਰ ਚਲਦੇ ਹਨ, NVIDIA ਇਸ ਪਲ ਨੂੰ ਪੂਰਾ ਕਰਨ ਲਈ ਆਪਣੇ ਓਪਨ ਮਾਡਲ ਲਾਈਨਅਪ ਦਾ ਵਿਸਤਾਰ ਕਰ ਰਿਹਾ ਹੈ। 11 ਅਗਸਤ, 2026 ਨੂੰ, ਕੰਪਨੀ ਨੇ ਨੀਮੋਟ੍ਰੋਨ 3.5 ਲਾਈਟਨਿੰਗ ਦਾ ਪਰਦਾਫਾਸ਼ ਕੀਤਾ, ਇੱਕ 30-ਬਿਲੀਅਨ-ਪੈਰਾਮੀਟਰ ਮਿਸ਼ਰਣ-ਦਾ-ਮਾਹਰਾਂ ਦਾ ਮਾਡਲ, ਇਹ ਲੰਬੇ ਸਮੇਂ ਤੋਂ ਚੱਲ ਰਹੇ ਏਜੰਟਿਕ AI ਵਰਕਲੋਡ ਲਈ ਆਪਣੀ ਕਲਾਸ ਵਿੱਚ ਸਭ ਤੋਂ ਵੱਧ ਕੁਸ਼ਲਤਾ ਵਾਲਾ ਮਾਡਲ ਹੈ। ਕਾਰੀ ਬ੍ਰਿਸਕੀ ਦੁਆਰਾ NVIDIA ਬਲੌਗ 'ਤੇ ਵਿਸਤ੍ਰਿਤ ਰੀਲੀਜ਼, NeMo Switchyard ਦੇ ਨਾਲ ਆਉਂਦੀ ਹੈ, ਇੱਕ ਓਪਨ ਸੋਰਸ ਰੂਟਿੰਗ ਲਾਇਬ੍ਰੇਰੀ ਜੋ ਹਰੇਕ ਕੰਮ ਨੂੰ ਆਪਣੇ ਆਪ ਸਭ ਤੋਂ ਸਮਰੱਥ ਅਤੇ ਲਾਗਤ-ਪ੍ਰਭਾਵਸ਼ਾਲੀ ਮਾਡਲ ਵੱਲ ਸੇਧਿਤ ਕਰਨ ਲਈ ਤਿਆਰ ਕੀਤੀ ਗਈ ਹੈ। ਨਵੀਨਤਮ AI ਉਦਯੋਗ ਕਵਰੇਜ ਲਈ, ਏਜੰਟਿਕ AI ਸਟੈਕ ਦੇ ਰੂਪ ਧਾਰਣ ਦੇ ਨਾਲ-ਨਾਲ ਪਾਲਣਾ ਕਰੋ।
ਇੱਕ ਮਾਡਲ ਹਮੇਸ਼ਾ-ਚਾਲੂ ਏਜੰਟਾਂ ਲਈ ਬਣਾਇਆ ਗਿਆ ਹੈ
ਆਧੁਨਿਕ ਏਜੰਟ ਪ੍ਰਣਾਲੀਆਂ ਤੇਜ਼ੀ ਨਾਲ ਕੰਮ ਕਰਦੀਆਂ ਹਨ ਜਿਵੇਂ ਕਿ NVIDIA "ਮਾਡਲਾਂ ਦੀਆਂ ਪ੍ਰਣਾਲੀਆਂ" ਜਾਂ ਮਾਡਲਾਂ ਦੇ ਜੋੜਾਂ ਵਜੋਂ ਵਰਣਨ ਕਰਦਾ ਹੈ। ਇੱਕ ਫਰੰਟੀਅਰ ਤਰਕਸ਼ੀਲ ਮਾਡਲ ਜਿਵੇਂ ਕਿ Nemotron 3 Ultra ਜਾਂ GPT-5.6 ਇੱਕ ਵਰਕਫਲੋ ਦੀ ਯੋਜਨਾ ਬਣਾ ਸਕਦਾ ਹੈ ਅਤੇ ਆਰਕੇਸਟ੍ਰੇਟ ਕਰ ਸਕਦਾ ਹੈ, ਜਦੋਂ ਕਿ ਛੋਟੇ ਵਿਸ਼ੇਸ਼ ਮਾਡਲ ਕੋਡ ਸਮੀਖਿਆ, ਟੂਲ ਵਰਤੋਂ, ਸੁਰੱਖਿਆ ਚੇਤਾਵਨੀ ਨਿਗਰਾਨੀ, ਜਾਂ ਬਿਲਿੰਗ ਸਵਾਲਾਂ ਦੇ ਜਵਾਬ ਦੇਣ ਵਰਗੇ ਨਿਸ਼ਾਨੇ ਵਾਲੇ ਕੰਮਾਂ ਨੂੰ ਸੰਭਾਲਦੇ ਹਨ। ਨਿਮੋਟ੍ਰੋਨ 3.5 ਲਾਈਟਨਿੰਗ ਉਸ ਦੂਜੇ ਟੀਅਰ ਲਈ ਉਦੇਸ਼-ਬਣਾਇਆ ਗਿਆ ਹੈ: ਉੱਚ-ਆਵਾਜ਼ ਵਾਲੇ, ਵਿਸ਼ੇਸ਼ ਕਾਰਜ ਜੋ ਹਮੇਸ਼ਾ-ਚਾਲੂ ਏਜੰਟਾਂ ਨੂੰ ਸ਼ਕਤੀ ਦਿੰਦੇ ਹਨ।
NVIDIA ਦੇ ਅਨੁਸਾਰ, ਮਾਡਲ 4 ਗੁਣਾ ਤੇਜ਼ ਆਉਟਪੁੱਟ ਸਪੀਡ ਤੱਕ ਪ੍ਰਦਾਨ ਕਰਦਾ ਹੈ, ਜਿਸ ਨਾਲ ਇਸਦੀ ਕਲਾਸ ਵਿੱਚ ਦੂਜੇ ਮਾਡਲਾਂ ਦੇ ਮੁਕਾਬਲੇ ਲਗਭਗ 30% ਤੇਜ਼ੀ ਨਾਲ ਏਜੰਟਿਕ ਕੰਮ ਪੂਰਾ ਹੁੰਦਾ ਹੈ। NVIDIA ਦੇ ਆਪਣੇ ਪਿੰਚਬੈਂਚ ਬੈਂਚਮਾਰਕ ਕਥਿਤ ਤੌਰ 'ਤੇ ਇਹ ਪ੍ਰਦਰਸ਼ਿਤ ਕਰਦੇ ਹਨ ਕਿ Nemotron 3.5 Lightning ਆਪਣੇ ਸਾਥੀਆਂ ਨਾਲੋਂ ਵਧੇਰੇ ਤੇਜ਼ੀ ਨਾਲ ਕਾਰਜਾਂ ਨੂੰ ਪੂਰਾ ਕਰਦੇ ਹੋਏ ਸਰਹੱਦੀ-ਪੱਧਰ ਦੀ ਸ਼ੁੱਧਤਾ ਨੂੰ ਕਾਇਮ ਰੱਖਦੀ ਹੈ। ਮਾਡਲ ਨੂੰ ਨੇਮੋਟ੍ਰੋਨ ਗੱਠਜੋੜ ਦੇ ਯੋਗਦਾਨ ਨਾਲ ਵਿਕਸਤ ਕੀਤਾ ਗਿਆ ਸੀ, ਜਿਸ ਦੇ ਮੈਂਬਰਾਂ ਨੇ ਮਾਡਲ ਨੂੰ ਅੱਗੇ ਵਧਾਉਣ ਵਿੱਚ ਮਦਦ ਲਈ ਮੁਲਾਂਕਣ ਵਿਧੀਆਂ, ਅਨੁਮਾਨ ਸਾਫਟਵੇਅਰ, ਅਤੇ ਡੇਟਾਸੈਟ ਪ੍ਰਦਾਨ ਕੀਤੇ ਸਨ।
ਕਿਉਂਕਿ ਇਹ ਖੁੱਲ੍ਹਾ ਅਤੇ ਅਨੁਕੂਲਿਤ ਹੈ, ਸੰਸਥਾਵਾਂ ਵਿਸ਼ੇਸ਼ ਕਾਰਜਾਂ ਲਈ ਸ਼ੁੱਧਤਾ ਨੂੰ ਬਿਹਤਰ ਬਣਾਉਣ ਲਈ NVIDIA NeMo ਨਾਲ ਆਪਣੇ ਖੁਦ ਦੇ ਡੋਮੇਨ ਡੇਟਾ, ਟੂਲਸ ਅਤੇ ਵਰਕਫਲੋਜ਼ 'ਤੇ Nemotron 3.5 Lightning ਨੂੰ ਪੋਸਟ-ਟ੍ਰੇਨ ਕਰ ਸਕਦੀਆਂ ਹਨ। NVIDIA Nemotron-RL-Agentic-Terminal-Pivot ਨੂੰ ਵੀ ਜਾਰੀ ਕਰ ਰਿਹਾ ਹੈ, ਇੱਕ ਏਜੰਟਿਕ ਰੀਨਫੋਰਸਮੈਂਟ ਲਰਨਿੰਗ ਡੇਟਾਸੈਟ ਜੋ ਕੋਡਿੰਗ ਏਜੰਟ ਸਮਰੱਥਾਵਾਂ ਲਈ ਮਾਡਲ ਨੂੰ ਸਿਖਲਾਈ ਤੋਂ ਬਾਅਦ ਲਈ ਵਰਤਿਆ ਜਾਂਦਾ ਹੈ।
ਕਿਤੇ ਵੀ ਚੱਲਣਾ, ਕਿਨਾਰੇ ਤੋਂ ਕਲਾਉਡ ਤੱਕ
ਨਿਮੋਟ੍ਰੋਨ 3.5 ਲਾਈਟਨਿੰਗ ਦੇ ਕੇਂਦਰੀ ਵਿਕਰੀ ਬਿੰਦੂਆਂ ਵਿੱਚੋਂ ਇੱਕ ਤੈਨਾਤੀ ਲਚਕਤਾ ਹੈ। ਇਹ ਮਾਡਲ ਸਥਾਨਕ AI ਸਿਸਟਮਾਂ 'ਤੇ ਚੱਲ ਸਕਦਾ ਹੈ - ਜਿਸ ਵਿੱਚ NVIDIA RTX PCs, NVIDIA DGX Spark, NVIDIA DGX ਸਟੇਸ਼ਨ, ਅਤੇ NVIDIA Jetson ਸ਼ਾਮਲ ਹਨ — ਸੰਗਠਨਾਂ ਨੂੰ ਮੌਜੂਦਾ ਬੁਨਿਆਦੀ ਢਾਂਚੇ ਦੇ ਨਿਵੇਸ਼ਾਂ ਨੂੰ ਵੱਧ ਤੋਂ ਵੱਧ ਕਰਨ ਦਿੰਦੇ ਹਨ। ਇਹ ਐਂਟਰਪ੍ਰਾਈਜ਼ ਵਰਤੋਂ ਦੇ ਮਾਮਲਿਆਂ ਲਈ ਕਿਨਾਰੇ AI ਡਿਵਾਈਸਾਂ, NVIDIA RTX PRO ਵਰਕਸਟੇਸ਼ਨਾਂ, ਡੇਟਾ ਸੈਂਟਰਾਂ ਅਤੇ ਕਲਾਉਡ ਵਾਤਾਵਰਣਾਂ ਵਿੱਚ ਵੀ ਸਕੇਲ ਕਰ ਸਕਦਾ ਹੈ। ਇਹ ਲਚਕੀਲਾਪਣ ਸੰਵੇਦਨਸ਼ੀਲ ਡੇਟਾ ਨੂੰ ਸੰਭਾਲਣ ਵਾਲੀਆਂ ਸੰਸਥਾਵਾਂ ਲਈ ਮਹੱਤਵਪੂਰਣ ਹੈ ਜੋ ਕਿ ਆਨ-ਪ੍ਰਾਇਮਿਸ ਵਿੱਚ ਰਹਿਣਾ ਚਾਹੀਦਾ ਹੈ।
ਜਿਵੇਂ ਕਿ ਹਰ Nemotron ਲਾਂਚ ਦੇ ਨਾਲ, NVIDIA ਕਹਿੰਦਾ ਹੈ ਕਿ ਇਹ ਲਾਇਸੈਂਸਿੰਗ ਪਰਮਿਟਾਂ ਦੇ ਰੂਪ ਵਿੱਚ ਸਿਖਲਾਈ ਡੇਟਾ ਅਤੇ ਤਕਨੀਕਾਂ ਨੂੰ ਪ੍ਰਕਾਸ਼ਿਤ ਕਰਦਾ ਹੈ, ਜੋ ਕਿ ਹੋਰ ਮਾਡਲਾਂ ਦੀ ਖੋਜਯੋਗਤਾ, ਆਡਿਟਿੰਗ ਅਤੇ ਸਿਖਲਾਈ ਦੀ ਆਗਿਆ ਦਿੰਦਾ ਹੈ। ਪਾਰਦਰਸ਼ਤਾ ਪ੍ਰਤੀ ਇਹ ਵਚਨਬੱਧਤਾ ਇੱਕ ਪ੍ਰਤੀਯੋਗੀ ਵਿਭਿੰਨਤਾ ਬਣ ਗਈ ਹੈ ਕਿਉਂਕਿ ਉੱਦਮ ਮਾਲਕੀ ਵਿਕਲਪਾਂ ਦੇ ਵਿਰੁੱਧ ਖੁੱਲੇ ਮਾਡਲਾਂ ਨੂੰ ਤੋਲਦੇ ਹਨ ਜੋ ਉਹਨਾਂ ਨੂੰ ਕਿਵੇਂ ਬਣਾਇਆ ਗਿਆ ਸੀ ਵਿੱਚ ਘੱਟ ਦਿੱਖ ਦੀ ਪੇਸ਼ਕਸ਼ ਕਰਦੇ ਹਨ।
NeMo Switchyard: ਮਾਡਲਾਂ ਦੇ ਸਿਸਟਮਾਂ ਲਈ ਸਮਾਰਟ ਰੂਟਿੰਗ
ਜੇਕਰ ਨਿਮੋਟ੍ਰੋਨ 3.5 ਲਾਈਟਨਿੰਗ ਵਰਕ ਹਾਰਸ ਹੈ, ਤਾਂ ਨੇਮੋ ਸਵਿਚਯਾਰਡ ਡਿਸਪੈਚਰ ਹੈ। ਓਪਨ ਸੋਰਸ ਲਾਇਬ੍ਰੇਰੀ ਰੂਟ ਖਾਸ ਲੋੜਾਂ ਦੇ ਆਧਾਰ 'ਤੇ, ਕਿਸੇ ਏਜੰਟ ਵਰਕਫਲੋ ਦੇ ਹਰੇਕ ਪੜਾਅ ਲਈ ਆਪਣੇ ਆਪ ਸਭ ਤੋਂ ਸਮਰੱਥ ਅਤੇ ਕੁਸ਼ਲ ਮਾਡਲ ਲਈ ਪ੍ਰੋਂਪਟ ਕਰਦੇ ਹਨ। ਕੁਝ ਮਾਡਲ ਕੋਡਿੰਗ ਲਈ ਬਿਹਤਰ ਹੁੰਦੇ ਹਨ, ਕੁਝ ਤਰਕ ਲਈ, ਕੁਝ ਹਲਕੇ ਕੰਮਾਂ ਲਈ, ਅਤੇ ਕੁਝ ਵਧੇਰੇ ਗੋਪਨੀਯਤਾ ਅਤੇ ਕੁਸ਼ਲਤਾ ਲਈ ਸਥਾਨਕ ਤੌਰ 'ਤੇ ਚਲਾਉਣ ਲਈ ਅਨੁਕੂਲ ਹੁੰਦੇ ਹਨ। ਇੱਕ ਸਿੰਗਲ ਡਿਫਾਲਟ ਮਾਡਲ 'ਤੇ ਭਰੋਸਾ ਕਰਨ ਦਾ ਮਤਲਬ ਹੋ ਸਕਦਾ ਹੈ ਜ਼ਿਆਦਾ ਖਰਚ ਕਰਨਾ ਜਾਂ ਗੁਣਵੱਤਾ ਦਾ ਬਲੀਦਾਨ ਕਰਨਾ; ਰੂਟਿੰਗ ਨੂੰ ਹੱਥੀਂ ਪ੍ਰਬੰਧਿਤ ਕਰਨਾ, ਇਸ ਦੌਰਾਨ, ਏਕੀਕਰਣ ਦਾ ਕੰਮ ਬਣ ਜਾਂਦਾ ਹੈ ਜੋ ਇੱਕ ਤੈਨਾਤੀ ਨੂੰ ਹੌਲੀ ਕਰ ਸਕਦਾ ਹੈ।
ਏਜੰਟ ਐਪਲੀਕੇਸ਼ਨ ਡਿਵੈਲਪਰ ਆਪਣੀਆਂ ਤਰਜੀਹਾਂ ਜਿਵੇਂ ਕਿ ਗੁਣਵੱਤਾ, ਲੇਟੈਂਸੀ, ਅਤੇ ਲਾਗਤ ਲੋੜਾਂ ਨਾਲ ਮੇਲ ਕਰਨ ਲਈ ਵੱਖ-ਵੱਖ ਰਾਊਟਿੰਗ ਐਲਗੋਰਿਦਮ ਨਾਲ ਰਾਊਟਰ ਨੂੰ ਟਿਊਨ ਜਾਂ ਸੋਧ ਸਕਦੇ ਹਨ। NVIDIA ਦੇ ਅੰਦਰੂਨੀ ਮਾਪਦੰਡ ਦਰਸਾਉਂਦੇ ਹਨ ਕਿ NeMo Switchyard ਇਕੱਲੇ ਓਪਸ 4.8 ਦੇ ਲਗਭਗ ਇੱਕ ਤਿਹਾਈ ਤੱਕ ਕੰਮ ਪੂਰਾ ਕਰਨ ਦੀ ਲਾਗਤ ਨੂੰ ਘਟਾਉਂਦੇ ਹੋਏ ਫਰੰਟੀਅਰ-ਪੱਧਰ ਦੀ ਸ਼ੁੱਧਤਾ ਨੂੰ ਬਰਕਰਾਰ ਰੱਖਦਾ ਹੈ — ਵੱਡੀ ਗਿਣਤੀ ਵਿੱਚ ਏਜੰਟ ਕਾਰਜ ਚਲਾਉਣ ਵਾਲੀਆਂ ਸੰਸਥਾਵਾਂ ਲਈ ਇੱਕ ਸ਼ਾਨਦਾਰ ਕੁਸ਼ਲਤਾ ਲਾਭ।
ਕੰਪਨੀ ਨੇ ਸਹਿਭਾਗੀ ਏਕੀਕਰਣ ਦੀ ਇੱਕ ਸਤਰ ਨੂੰ ਉਜਾਗਰ ਕੀਤਾ। ਬੂਮੀ ਨੇ 100% ਡੋਮੇਨ-ਰੂਟਿੰਗ ਸ਼ੁੱਧਤਾ ਦੀ ਰਿਪੋਰਟ ਕੀਤੀ ਅਤੇ 59% ਟ੍ਰੈਫਿਕ ਨੂੰ 5x ਤੇਜ਼ ਫਾਈਨ-ਟਿਊਨਡ ਮਾਡਲ ਲਈ ਭੇਜਿਆ। ਇੱਕ ਰਸਮੀ ਤਸਦੀਕ ਵਰਤੋਂ ਕੇਸ 'ਤੇ ਕੈਡੈਂਸ ਨੇ ਕੁਸ਼ਲਤਾ ਵਿੱਚ 9.9% ਸੁਧਾਰ ਕੀਤਾ ਹੈ। ਕੋਗਨੀਸ਼ਨ ਨੇ ਸਵਿਚਯਾਰਡ ਨੂੰ ਡੇਵਿਨ ਡੈਸਕਟੌਪ ਵਿੱਚ ਏਕੀਕ੍ਰਿਤ ਕੀਤਾ, ਫਰੰਟੀਅਰਕੋਡ ਮੇਨ 'ਤੇ ਨਜ਼ਦੀਕੀ-ਸਰਹੱਦੀ ਕਾਰਗੁਜ਼ਾਰੀ ਨੂੰ ਪ੍ਰਾਪਤ ਕਰਦੇ ਹੋਏ 28% ਦੀ ਔਸਤ ਲਾਗਤ ਨੂੰ ਘਟਾਇਆ। LangChain ਨੇ 145 ਮਲਟੀ-ਟਰਨ ਡੀਪ ਏਜੰਟ ਟਾਸਕਾਂ ਵਿੱਚ ਸਿਰਫ 7% ਕਾਲਾਂ ਨੂੰ ਇੱਕ ਫਰੰਟੀਅਰ ਮਾਡਲ ਲਈ ਰੂਟ ਕਰਕੇ 74% ਘੱਟ ਲਾਗਤ ਦੀ ਰਿਪੋਰਟ ਕੀਤੀ। LiteLLM ਆਪਣੀ ਪ੍ਰੌਕਸੀ ਲੇਅਰ ਵਿੱਚ ਇੱਕ ਪਲੱਗ-ਇਨ ਵਜੋਂ NeMo Switchyard ਨੂੰ ਜੋੜ ਰਿਹਾ ਹੈ, ਅਤੇ Kong ਹੁਣ Kong AI ਗੇਟਵੇ ਰਾਹੀਂ ਮੂਲ ਰੂਪ ਵਿੱਚ ਰੂਟਿੰਗ ਪ੍ਰਦਾਨ ਕਰਦਾ ਹੈ। ਖਾਸ ਤੌਰ 'ਤੇ, ਨੂਸ ਰਿਸਰਚ ਨੇ ਡਿਵੈਲਪਰਾਂ ਨੂੰ ਏਜੰਟ ਕੁਸ਼ਲਤਾ ਲਈ ਇੱਕ ਆਸਾਨ-ਟੂ-ਸੰਰਚਨਾ ਰੂਟਿੰਗ ਸਿਸਟਮ ਦੇਣ ਲਈ ਹਰਮੇਸ ਵਿੱਚ NeMo Switchyard ਨੂੰ ਏਕੀਕ੍ਰਿਤ ਕੀਤਾ।
ਉਦਯੋਗ ਅਪਣਾਉਣ ਅਤੇ ਵੱਡੀ ਤਸਵੀਰ
ਸਾਰੇ ਉਦਯੋਗਾਂ ਵਿੱਚ ਏਆਈ ਲੀਡਰ ਪਹਿਲਾਂ ਹੀ ਆਪਣੇ ਕੰਮ ਦੇ ਬੋਝ ਲਈ ਨੇਮੋਟ੍ਰੋਨ 3.5 ਲਾਈਟਨਿੰਗ ਨੂੰ ਅਨੁਕੂਲਿਤ ਕਰ ਰਹੇ ਹਨ। CrowdStrike ਇਸਨੂੰ ਸਾਈਬਰ ਸੁਰੱਖਿਆ ਲਈ ਲਾਗੂ ਕਰ ਰਿਹਾ ਹੈ, ਹਾਰਵੇ ਇਸਨੂੰ ਕਾਨੂੰਨੀ ਸੇਵਾਵਾਂ ਲਈ ਵਰਤ ਰਿਹਾ ਹੈ, ਅਤੇ CodeRabbit ਇਸਨੂੰ ਕੋਡ ਸਮੀਖਿਆ ਲਈ ਤੈਨਾਤ ਕਰ ਰਿਹਾ ਹੈ। ਲੀਲਾ ਸਾਇੰਸਿਜ਼ ਭੌਤਿਕ ਅਤੇ ਜੀਵਨ ਵਿਗਿਆਨਾਂ ਵਿੱਚ ਏਜੰਟੀ ਕਾਰਜਾਂ ਲਈ ਤਰਕ ਸਮਰੱਥਾ ਨੂੰ ਬਿਹਤਰ ਬਣਾਉਣ ਵਿੱਚ ਮਦਦ ਕਰ ਰਿਹਾ ਹੈ, ਜਦੋਂ ਕਿ ਫਾਸਟੀਨੋ ਲੈਬਜ਼ ਨੇ ਮਾਡਲ ਨੂੰ ਅਨੁਕੂਲਿਤ ਕੀਤਾ ਹੈ ਅਤੇ ਸਾਫਟਵੇਅਰ ਵਿਕਾਸ, ਵਿੱਤ, ਅਤੇ ਸਿਹਤ ਸੰਭਾਲ ਵਰਕਲੋਡ ਲਈ ਪ੍ਰਮੁੱਖ ਸ਼ੁੱਧਤਾਵਾਂ ਦੀ ਰਿਪੋਰਟ ਕੀਤੀ ਹੈ।
ਰੀਲੀਜ਼ ਇੱਕ ਵਿਆਪਕ ਉਦਯੋਗਿਕ ਰੁਝਾਨ ਨੂੰ ਦਰਸਾਉਂਦੀ ਹੈ: ਜਿਵੇਂ ਕਿ ਏਜੰਟ AI ਪਰਿਪੱਕ ਹੁੰਦਾ ਹੈ, ਕੋਈ ਵੀ ਮਾਡਲ ਸਵੀਕਾਰਯੋਗ ਕੀਮਤ 'ਤੇ ਸਭ ਕੁਝ ਵਧੀਆ ਨਹੀਂ ਕਰ ਸਕਦਾ ਹੈ। ਭਵਿੱਖ ਸਮੂਹਾਂ ਦਾ ਹੈ — ਸਰਹੱਦੀ ਯੋਜਨਾਕਾਰ ਵਿਸ਼ੇਸ਼ ਕਰਮਚਾਰੀਆਂ ਦੇ ਫਲੀਟਾਂ ਦਾ ਤਾਲਮੇਲ ਕਰਨ ਵਾਲੇ — ਅਤੇ ਟੂਲਿੰਗ ਜੋ ਉਹਨਾਂ ਨੂੰ ਆਪਸ ਵਿੱਚ ਜੋੜਦੇ ਹਨ। NVIDIA ਦੀ ਸ਼ਰਤ ਇਹ ਹੈ ਕਿ ਓਪਨ ਮਾਡਲ ਅਤੇ ਬੁੱਧੀਮਾਨ ਰੂਟਿੰਗ ਉੱਦਮਾਂ ਨੂੰ ਉਹਨਾਂ ਪ੍ਰਣਾਲੀਆਂ ਨੂੰ ਇੱਕ ਸਿੰਗਲ ਪ੍ਰਦਾਤਾ ਦੇ ਸਟੈਕ ਵਿੱਚ ਲਾਕ ਕੀਤੇ ਬਿਨਾਂ ਇਕੱਠੇ ਕਰਨ ਦੇਵੇਗੀ।
AI ਤੋਂ ਅੱਗੇ ਰਹੋ
NVIDIA ਦਾ Nemotron 3.5 ਲਾਈਟਨਿੰਗ ਅਤੇ NeMo Switchyard ਸਿਗਨਲ ਜਿੱਥੇ ਏਜੰਟ AI ਅੱਗੇ ਹੈ: ਤੇਜ਼, ਸਸਤਾ, ਵਧੇਰੇ ਪਾਰਦਰਸ਼ੀ, ਅਤੇ ਕਿਤੇ ਵੀ ਤੈਨਾਤ ਕਰਨ ਯੋਗ। ਮਾਡਲ ਰੀਲੀਜ਼ਾਂ ਅਤੇ ਲੈਂਡਸਕੇਪ ਨੂੰ ਮੁੜ ਆਕਾਰ ਦੇਣ ਵਾਲੇ ਐਂਟਰਪ੍ਰਾਈਜ਼ ਟੂਲਸ ਨਾਲ ਜੁੜੇ ਰਹਿਣ ਲਈ, ਸਾਡੀ ਬ੍ਰੇਕਿੰਗ ਏਆਈ ਨਿਊਜ਼ ਦੀ ਪੜਚੋਲ ਕਰੋ।
ਹੋਰ AI ਖਬਰਾਂ ਪੜ੍ਹੋ →