Apabila kecerdasan buatan beralih daripada chatbot satu pusingan kepada ejen autonomi yang berjalan secara berterusan, NVIDIA sedang mengembangkan barisan model terbukanya untuk memenuhi masa ini. Pada 11 Ogos 2026, syarikat itu telah melancarkan Nemotron 3.5 Lightning, model campuran pakar 30 bilion parameter yang digelar sebagai model kecekapan tertinggi dalam kelasnya untuk beban kerja AI agenik yang berjalan lama. Keluaran, diperincikan pada blog NVIDIA oleh Kari Briski, tiba bersama NeMo Switchyard, perpustakaan penghalaan sumber terbuka yang direka untuk mengarahkan setiap tugas kepada model yang paling berkebolehan dan kos efektif secara automatik. Untuk [liputan industri AI] terbaharu (https://aibuzzwire.news), ikuti semasa timbunan AI ejenik terbentuk.
Model Dibina untuk Ejen Sentiasa Dihidupkan
Sistem agenik moden semakin beroperasi seperti yang digambarkan oleh NVIDIA sebagai "sistem model" atau kumpulan model. Model penaakulan sempadan seperti Nemotron 3 Ultra atau GPT-5.6 mungkin merancang dan mengatur aliran kerja, manakala model khusus yang lebih kecil mengendalikan tugas yang disasarkan seperti semakan kod, penggunaan alat, pemantauan amaran keselamatan atau menjawab soalan pengebilan. Nemotron 3.5 Lightning direka khas untuk peringkat kedua itu: tugasan kelantangan tinggi dan khusus yang memberi kuasa kepada ejen sentiasa aktif.
Menurut NVIDIA, model ini menyampaikan sehingga 4x kelajuan keluaran lebih pantas, membawa kepada kira-kira 30% lebih cepat penyiapan tugas agenik berbanding model lain dalam kelasnya. Penanda aras PinchBench NVIDIA sendiri dilaporkan menunjukkan bahawa Nemotron 3.5 Lightning mengekalkan ketepatan peringkat sempadan sambil menyelesaikan tugas dengan lebih cepat daripada rakan sebayanya. Model ini dibangunkan dengan sumbangan daripada Gabungan Nemotron, yang ahlinya menyediakan metodologi penilaian, perisian inferens dan set data untuk membantu memajukan model.
Kerana ia terbuka dan boleh disesuaikan, organisasi boleh melatih selepas Nemotron 3.5 Lightning dengan NVIDIA NeMo pada data domain, alatan dan aliran kerja mereka sendiri untuk meningkatkan ketepatan untuk tugas khusus. NVIDIA juga mengeluarkan Nemotron-RL-Agentic-Terminal-Pivot, set data pembelajaran pengukuhan agen yang digunakan untuk melatih selepas model untuk keupayaan ejen pengekodan.
Berjalan Di Mana-mana, Dari Edge ke Awan
Salah satu titik jualan utama Nemotron 3.5 Lightning ialah fleksibiliti penggunaan. Model ini boleh dijalankan pada sistem AI tempatan — termasuk PC NVIDIA RTX, NVIDIA DGX Spark, Stesen DGX NVIDIA dan NVIDIA Jetson — membenarkan organisasi memaksimumkan pelaburan infrastruktur sedia ada. Ia juga boleh menskalakan merentasi peranti AI tepi, stesen kerja NVIDIA RTX PRO, pusat data dan persekitaran awan untuk kes penggunaan perusahaan. Fleksibiliti itu penting bagi organisasi yang mengendalikan data sensitif yang mesti kekal di premis.
Seperti setiap pelancaran Nemotron, NVIDIA mengatakan ia menerbitkan sebanyak mungkin data dan teknik latihan sebagai permit pelesenan, yang membolehkan kebolehkesanan, pengauditan dan latihan model lain. Komitmen terhadap ketelusan ini telah menjadi pembeza kompetitif kerana perusahaan menimbang model terbuka berbanding alternatif proprietari yang menawarkan kurang keterlihatan tentang cara ia dibina.
NeMo Switchyard: Penghalaan Pintar untuk Sistem Model
Jika Nemotron 3.5 Lightning adalah kuda kerja, NeMo Switchyard ialah penghantar. Laluan perpustakaan sumber terbuka menggesa kepada model yang paling berkebolehan dan cekap untuk setiap langkah aliran kerja ejen secara automatik, berdasarkan keperluan khusus. Sesetengah model adalah lebih baik untuk pengekodan, beberapa untuk penaakulan, beberapa untuk tugas yang ringan dan sesetengahnya dioptimumkan untuk dijalankan secara setempat untuk privasi dan kecekapan yang lebih baik. Bergantung pada model lalai tunggal boleh bermakna berbelanja berlebihan atau mengorbankan kualiti; mengurus penghalaan secara manual, sementara itu, menjadi kerja penyepaduan yang boleh melambatkan penggunaan.
Pembangun aplikasi ejen boleh menala atau mengubah suai penghala dengan algoritma penghalaan yang berbeza untuk memadankan keutamaan mereka, seperti keperluan kualiti, kependaman dan kos. Penanda aras dalaman NVIDIA menunjukkan bahawa NeMo Switchyard mengekalkan ketepatan peringkat sempadan sambil mengurangkan kos penyiapan tugas kepada hampir satu pertiga daripada Opus 4.8 sahaja — peningkatan kecekapan yang ketara untuk organisasi yang menjalankan sejumlah besar tugas ejen.
Syarikat itu menyerlahkan rentetan integrasi rakan kongsi. Boomi melaporkan 100% ketepatan penghalaan domain dan menghantar 59% trafik kepada model diperhalusi 5x lebih pantas. Irama meningkatkan kecekapan sebanyak 9.9% pada kes penggunaan pengesahan rasmi. Kognisi menyepadukan Switchyard ke Devin Desktop, mencapai prestasi berhampiran sempadan pada FrontierCode Utama sambil mengurangkan kos min sebanyak 28%. LangChain melaporkan 74% kos lebih rendah merentas 145 tugasan Agen Dalam berbilang pusingan dengan menghalakan hanya 7% panggilan ke model sempadan. LiteLLM menambah NeMo Switchyard sebagai pemalam pada lapisan proksinya, dan Kong kini menyampaikan penghalaan secara asli melalui Kong AI Gateway. Terutamanya, Nous Research menyepadukan NeMo Switchyard ke dalam Hermes untuk memberikan pembangun sistem penghalaan yang mudah dikonfigurasikan untuk kecekapan ejen.
Penggunaan Industri dan Gambaran Lebih Besar
Pemimpin AI merentas industri sudah menyesuaikan Nemotron 3.5 Lightning untuk beban kerja mereka. CrowdStrike menggunakannya untuk keselamatan siber, Harvey menggunakannya untuk perkhidmatan undang-undang, dan CodeRabbit menggunakannya untuk semakan kod. Lila Sciences membantu meningkatkan keupayaan penaakulan untuk tugas agen merentas sains fizikal dan hayat, manakala Fastino Labs memperibadikan model dan melaporkan ketepatan utama untuk pembangunan perisian, kewangan dan beban kerja penjagaan kesihatan.
Keluaran ini menggariskan trend industri yang lebih luas: apabila AI ejenik semakin matang, tiada model tunggal boleh melakukan segala-galanya dengan baik pada kos yang boleh diterima. Masa depan adalah milik kumpulan - perancang sempadan yang menyelaraskan armada pekerja khusus - dan peralatan yang mengikat mereka bersama. Pertaruhan NVIDIA ialah model terbuka dan penghalaan pintar akan membenarkan perusahaan memasang sistem tersebut tanpa mengunci diri mereka ke dalam susunan penyedia tunggal.
Kekal Mendahului AI
Isyarat Nemotron 3.5 Lightning dan NeMo Switchyard NVIDIA di mana AI agen menuju ke arah: lebih pantas, lebih murah, lebih telus dan boleh digunakan di mana-mana sahaja. Untuk mengikuti keluaran model dan alatan perusahaan yang membentuk semula landskap, terokai [berita terbaharu AI] kami(https://aibuzzwire.news).
Baca lebih banyak berita AI →