Ketika kecerdasan buatan beralih dari chatbot satu putaran ke agen otonom yang berjalan terus-menerus, NVIDIA memperluas jajaran model terbukanya untuk memenuhi momen tersebut. Pada tanggal 11 Agustus 2026, perusahaan ini meluncurkan Nemotron 3.5 Lightning, model campuran pakar dengan 30 miliar parameter yang disebutnya sebagai model dengan efisiensi tertinggi di kelasnya untuk beban kerja AI agen yang berjalan lama. Rilis ini, yang dirinci di blog NVIDIA oleh Kari Briski, hadir bersama NeMo Switchyard, pustaka perutean sumber terbuka yang dirancang untuk mengarahkan setiap tugas ke model yang paling mumpuni dan hemat biaya secara otomatis. Untuk [cakupan industri AI] terbaru(https://aibuzzwire.news), ikuti perkembangan tumpukan AI agen mulai terbentuk.
Model yang Dibuat untuk Agen yang Selalu Aktif
Sistem agen modern semakin beroperasi seperti yang digambarkan NVIDIA sebagai "sistem model" atau ansambel model. Model penalaran terdepan seperti Nemotron 3 Ultra atau GPT-5.6 mungkin merencanakan dan mengatur alur kerja, sementara model khusus yang lebih kecil menangani tugas yang ditargetkan seperti peninjauan kode, penggunaan alat, pemantauan peringatan keamanan, atau menjawab pertanyaan penagihan. Nemotron 3.5 Lightning dibuat khusus untuk tingkat kedua: tugas khusus bervolume tinggi yang mendukung agen yang selalu aktif.
Menurut NVIDIA, model ini memberikan kecepatan output hingga 4x lebih cepat, sehingga menghasilkan sekitar 30% lebih cepat penyelesaian tugas agen dibandingkan dengan model lain di kelasnya. Tolok ukur PinchBench milik NVIDIA dilaporkan menunjukkan bahwa Nemotron 3.5 Lightning mempertahankan akurasi tingkat terdepan sambil menyelesaikan tugas lebih cepat dibandingkan rekan-rekannya. Model ini dikembangkan dengan kontribusi dari Koalisi Nemotron, yang anggotanya menyediakan metodologi evaluasi, perangkat lunak inferensi, dan kumpulan data untuk membantu memajukan model.
Karena terbuka dan dapat disesuaikan, organisasi dapat melakukan pasca-pelatihan Nemotron 3.5 Lightning dengan NVIDIA NeMo pada data domain, alat, dan alur kerja mereka sendiri guna meningkatkan akurasi untuk tugas-tugas khusus. NVIDIA juga merilis Nemotron-RL-Agentic-Terminal-Pivot, kumpulan data pembelajaran penguatan agen yang digunakan untuk pasca-pelatihan model kemampuan agen pengkodean.
Berjalan Di Mana Saja, Dari Edge hingga Cloud
Salah satu nilai jual utama Nemotron 3.5 Lightning adalah fleksibilitas penerapan. Model ini dapat berjalan pada sistem AI lokal — termasuk PC NVIDIA RTX, NVIDIA DGX Spark, NVIDIA DGX Station, dan NVIDIA Jetson — sehingga memungkinkan organisasi memaksimalkan investasi infrastruktur yang ada. Ini juga dapat diperluas ke seluruh perangkat AI edge, stasiun kerja NVIDIA RTX PRO, pusat data, dan lingkungan cloud untuk kasus penggunaan perusahaan. Fleksibilitas tersebut penting bagi organisasi yang menangani data sensitif yang harus tetap berada di lokasi.
Seperti halnya setiap peluncuran Nemotron, NVIDIA mengatakan bahwa mereka menerbitkan data dan teknik pelatihan sebanyak izin lisensi, yang memungkinkan ketertelusuran, audit, dan pelatihan model lainnya. Komitmen terhadap transparansi ini telah menjadi pembeda kompetitif ketika perusahaan mempertimbangkan model terbuka dibandingkan dengan alternatif kepemilikan yang kurang memberikan visibilitas tentang bagaimana model tersebut dibangun.
NeMo Switchyard: Perutean Cerdas untuk Sistem Model
Jika Nemotron 3.5 Lightning adalah pekerja kerasnya, NeMo Switchyard adalah operatornya. Pustaka sumber terbuka merutekan permintaan ke model yang paling mampu dan efisien untuk setiap langkah alur kerja agen secara otomatis, berdasarkan kebutuhan spesifik. Beberapa model lebih baik untuk pengkodean, beberapa untuk penalaran, beberapa untuk tugas ringan, dan beberapa dioptimalkan untuk dijalankan secara lokal demi privasi dan efisiensi yang lebih baik. Mengandalkan satu model default dapat berarti mengeluarkan uang terlalu banyak atau mengorbankan kualitas; mengelola perutean secara manual, sementara itu, menjadi pekerjaan integrasi yang dapat memperlambat penerapan.
Pengembang aplikasi agen dapat menyetel atau memodifikasi router dengan algoritme perutean berbeda agar sesuai dengan prioritas mereka, seperti persyaratan kualitas, latensi, dan biaya. Tolok ukur internal NVIDIA menunjukkan bahwa NeMo Switchyard mempertahankan akurasi tingkat terdepan sekaligus mengurangi biaya penyelesaian tugas hingga hampir sepertiga dari Opus 4.8 saja — peningkatan efisiensi yang luar biasa bagi organisasi yang menjalankan tugas agen dalam jumlah besar.
Perusahaan menyoroti serangkaian integrasi mitra. Boomi melaporkan akurasi perutean domain 100% dan mengirimkan 59% lalu lintas ke model yang disempurnakan 5x lebih cepat. Irama meningkatkan efisiensi sebesar 9,9% pada kasus penggunaan verifikasi formal. Cognition mengintegrasikan Switchyard ke dalam Devin Desktop, mencapai kinerja mendekati batas pada FrontierCode Main sekaligus memangkas biaya rata-rata sebesar 28%. LangChain melaporkan biaya 74% lebih rendah di 145 tugas Agen Dalam multi-putaran dengan hanya merutekan 7% panggilan ke model perbatasan. LiteLLM menambahkan NeMo Switchyard sebagai plug-in ke lapisan proxy-nya, dan Kong kini mengirimkan perutean secara asli melalui Kong AI Gateway. Khususnya, Nous Research mengintegrasikan NeMo Switchyard ke dalam Hermes untuk memberi pengembang sistem perutean yang mudah dikonfigurasi untuk efisiensi agen.
Adopsi Industri dan Gambaran Lebih Besar
Para pemimpin AI di berbagai industri telah menyesuaikan Nemotron 3.5 Lightning untuk beban kerja mereka. CrowdStrike menerapkannya pada keamanan siber, Harvey menggunakannya untuk layanan hukum, dan CodeRabbit menerapkannya untuk peninjauan kode. Lila Sciences membantu meningkatkan kemampuan penalaran untuk tugas-tugas agen di bidang ilmu fisika dan kehidupan, sementara Fastino Labs menyesuaikan model dan melaporkan akurasi terdepan untuk beban kerja pengembangan perangkat lunak, keuangan, dan perawatan kesehatan.
Rilis ini menggarisbawahi tren industri yang lebih luas: seiring dengan semakin matangnya AI agen, tidak ada satu model pun yang dapat melakukan semuanya dengan baik dengan biaya yang terjangkau. Masa depan adalah milik kelompok – perencana garis depan yang mengoordinasikan armada pekerja khusus – dan peralatan yang menyatukan mereka. Taruhan NVIDIA adalah bahwa model terbuka dan perutean cerdas akan memungkinkan perusahaan merakit sistem tersebut tanpa mengunci diri mereka ke dalam satu tumpukan penyedia.
Tetap Terdepan dalam AI
Nemotron 3.5 Lightning dan NeMo Switchyard dari NVIDIA memberi sinyal arah AI agen: lebih cepat, lebih murah, lebih transparan, dan dapat diterapkan di mana saja. Untuk mengikuti rilis model dan alat perusahaan yang membentuk kembali lanskap, jelajahi berita AI terkini.
Baca berita AI selengkapnya →