Terwijl kunstmatige intelligentie verschuift van single-turn chatbots naar autonome agenten die continu actief zijn, breidt NVIDIA zijn open modellenreeks uit om aan het moment te voldoen. Op 11 augustus 2026 onthulde het bedrijf Nemotron 3.5 Lightning, een mengsel van experts met 30 miljard parameters dat het het hoogst efficiënte model in zijn klasse noemt voor langlopende agentische AI-workloads. De release, gedetailleerd beschreven op de NVIDIA-blog door Kari Briski, komt samen met NeMo Switchyard, een open source routing-bibliotheek die is ontworpen om elke taak automatisch naar het meest capabele en kosteneffectieve model te leiden. Voor de laatste dekking van de AI-industrie, volgt u mee terwijl de agentische AI-stack vorm krijgt.
Een model dat is gebouwd voor agenten die altijd actief zijn
Moderne agentische systemen werken steeds meer als wat NVIDIA beschrijft als "systemen van modellen" of modelensembles. Een grensverleggend redeneermodel zoals Nemotron 3 Ultra of GPT-5.6 zou een workflow kunnen plannen en orkestreren, terwijl kleinere gespecialiseerde modellen gerichte taken uitvoeren zoals codebeoordeling, toolgebruik, monitoring van beveiligingswaarschuwingen of het beantwoorden van factureringsvragen. Nemotron 3.5 Lightning is speciaal gebouwd voor dat tweede niveau: gespecialiseerde taken met grote volumes die agenten die altijd aan staan, aandrijven.
Volgens NVIDIA levert het model een tot 4x hogere uitvoersnelheid, wat leidt tot ruwweg 30% snellere voltooiing van agentische taken vergeleken met andere modellen in zijn klasse. NVIDIA's eigen PinchBench-benchmarks tonen naar verluidt aan dat Nemotron 3.5 Lightning grensoverschrijdende nauwkeurigheid handhaaft en tegelijkertijd taken sneller voltooit dan zijn soortgenoten. Het model is ontwikkeld met bijdragen van de Nemotron Coalition, waarvan de leden evaluatiemethodologieën, inferentiesoftware en datasets leverden om het model vooruit te helpen.
Omdat het open en aanpasbaar is, kunnen organisaties Nemotron 3.5 Lightning achteraf trainen met NVIDIA NeMo op hun eigen domeingegevens, tools en workflows om de nauwkeurigheid voor gespecialiseerde taken te verbeteren. NVIDIA brengt ook Nemotron-RL-Agentic-Terminal-Pivot uit, een dataset voor het leren van agentische versterking die wordt gebruikt om het model na te trainen voor de mogelijkheden van codeeragenten.
Overal actief, van edge tot cloud
Een van de centrale verkoopargumenten van Nemotron 3.5 Lightning is implementatieflexibiliteit. Het model kan draaien op lokale AI-systemen – waaronder NVIDIA RTX-pc’s, NVIDIA DGX Spark, NVIDIA DGX Station en NVIDIA Jetson – waardoor organisaties hun bestaande infrastructuurinvesteringen kunnen maximaliseren. Het kan ook worden geschaald naar edge AI-apparaten, NVIDIA RTX PRO-werkstations, datacenters en cloudomgevingen voor zakelijke toepassingen. Die flexibiliteit is van belang voor organisaties die omgaan met gevoelige gegevens die on-premise moeten blijven.
Zoals bij elke Nemotron-lancering zegt NVIDIA dat het zoveel trainingsgegevens en -technieken publiceert als de licenties toestaan, wat traceerbaarheid, auditing en training van andere modellen mogelijk maakt. Deze toewijding aan transparantie is een concurrentiedifferentiator geworden, omdat bedrijven open modellen afwegen tegen propriëtaire alternatieven die minder inzicht bieden in de manier waarop ze zijn gebouwd.
NeMo Switchyard: slimme routering voor systemen van modellen
Als Nemotron 3.5 Lightning het werkpaard is, is NeMo Switchyard de coördinator. De open source-bibliotheek stuurt aanwijzingen automatisch door naar het meest capabele en efficiënte model voor elke stap van de workflow van een agent, op basis van specifieke behoeften. Sommige modellen zijn beter voor coderen, sommige voor redeneren, sommige voor lichtgewicht taken, en sommige zijn geoptimaliseerd om lokaal te draaien voor meer privacy en efficiëntie. Vertrouwen op één enkel standaardmodel kan betekenen dat u te veel geld uitgeeft of kwaliteit opoffert; Het handmatig beheren van routing wordt ondertussen integratiewerk dat een implementatie kan vertragen.
Ontwikkelaars van agentapplicaties kunnen de router afstemmen of aanpassen met verschillende routeringsalgoritmen om aan hun prioriteiten te voldoen, zoals kwaliteit, latentie en kostenvereisten. Uit de interne benchmarks van NVIDIA blijkt dat NeMo Switchyard nauwkeurigheid op grensniveau handhaaft, terwijl de kosten voor het voltooien van taken worden verlaagd tot bijna een derde van alleen Opus 4.8 – een opvallende efficiëntiewinst voor organisaties die grote aantallen agenttaken uitvoeren.
Het bedrijf benadrukte een reeks partnerintegraties. Boomi rapporteerde 100% nauwkeurigheid van domeinrouting en stuurde 59% van het verkeer naar een 5x sneller, verfijnd model. Cadence verbeterde de efficiëntie met 9,9% bij een formele verificatie-use case. Cognition integreerde Switchyard in Devin Desktop, waardoor prestaties op FrontierCode Main bijna grensverleggend waren, terwijl de gemiddelde kosten met 28% werden verlaagd. LangChain rapporteerde 74% lagere kosten voor 145 multi-turn Deep Agents-taken door slechts 7% van de oproepen naar een grensmodel te routeren. LiteLLM voegt NeMo Switchyard toe als plug-in aan zijn proxylaag, en Kong levert nu native routering via de Kong AI Gateway. Met name Nous Research integreerde NeMo Switchyard in Hermes om ontwikkelaars een eenvoudig te configureren routeringssysteem te bieden voor de efficiëntie van agenten.
Industrie-adoptie en het grotere geheel
AI-leiders in verschillende sectoren passen Nemotron 3.5 Lightning al aan hun werklasten aan. CrowdStrike past het toe op cyberbeveiliging, Harvey gebruikt het voor juridische diensten en CodeRabbit zet het in voor codebeoordeling. Lila Sciences helpt het redeneervermogen voor agentische taken in de natuurwetenschappen en de levenswetenschappen te verbeteren, terwijl Fastino Labs het model heeft aangepast en toonaangevende nauwkeurigheid heeft gerapporteerd voor softwareontwikkeling, financiën en werklasten in de gezondheidszorg.
De release onderstreept een bredere trend in de sector: naarmate agentische AI volwassener wordt, kan geen enkel model alles goed doen tegen acceptabele kosten. De toekomst is aan ensembles – grensplanners die vloten van gespecialiseerde werknemers coördineren – en aan de instrumenten die hen met elkaar verbinden. NVIDIA's gok is dat open modellen en intelligente routing bedrijven in staat zullen stellen deze systemen samen te stellen zonder zichzelf op te sluiten in de stapel van één enkele provider.
Blijf AI een stap voor
NVIDIA's Nemotron 3.5 Lightning en NeMo Switchyard geven aan waar agentic AI naartoe gaat: sneller, goedkoper, transparanter en overal inzetbaar. Om op de hoogte te blijven van de modelreleases en bedrijfstools die het landschap opnieuw vormgeven, kunt u ons breaking AI news verkennen.
Lees meer AI-nieuws →