När artificiell intelligens övergår från envarvs chatbots till autonoma agenter som körs kontinuerligt, utökar NVIDIA sitt sortiment av öppna modeller för att möta ögonblicket. Den 11 augusti 2026 presenterade företaget Nemotron 3.5 Lightning, en blandning av experter med 30 miljarder parametrar som den kallar den högst effektiva modellen i sin klass för långvariga agenta AI-arbetsbelastningar. Releasen, som beskrivs i NVIDIA-bloggen av Kari Briski, kommer tillsammans med NeMo Switchyard, ett routingbibliotek med öppen källkod designat för att styra varje uppgift till den mest kapabla och kostnadseffektiva modellen automatiskt. För den senaste AI-branschens täckning, följ med när den agentiska AI-stacken tar form.

En modell byggd för alltid-på-agenter

Moderna agentsystem fungerar allt mer som vad NVIDIA beskriver som "system av modeller" eller modellensembler. En frontierresonemangsmodell som Nemotron 3 Ultra eller GPT-5.6 kan planera och organisera ett arbetsflöde, medan mindre specialiserade modeller hanterar riktade uppgifter som kodgranskning, verktygsanvändning, övervakning av säkerhetsvarningar eller svar på faktureringsfrågor. Nemotron 3.5 Lightning är specialbyggd för den andra nivån: högvolym, specialiserade uppgifter som driver alltid-på-agenter.

Enligt NVIDIA levererar modellen upp till 4x snabbare utmatningshastighet, vilket leder till ungefär 30 % snabbare slutförande av agentuppdrag jämfört med andra modeller i sin klass. NVIDIAs egna PinchBench-riktmärken visar enligt uppgift att Nemotron 3.5 Lightning bibehåller gränsöverskridande noggrannhet samtidigt som de slutför uppgifter snabbare än sina kamrater. Modellen utvecklades med bidrag från Nemotron Coalition, vars medlemmar tillhandahållit utvärderingsmetoder, inferensmjukvara och datauppsättningar för att hjälpa till att utveckla modellen.

Eftersom det är öppet och anpassningsbart kan organisationer efterträna Nemotron 3.5 Lightning med NVIDIA NeMo på sina egna domändata, verktyg och arbetsflöden för att förbättra noggrannheten för specialiserade uppgifter. NVIDIA släpper också Nemotron-RL-Agentic-Terminal-Pivot, en datauppsättning för inlärning av agenter som används för att efterträna modellen för kodningsagentkapacitet.

Kör var som helst, från Edge till Cloud

En av de centrala försäljningsargumenten för Nemotron 3.5 Lightning är distributionsflexibilitet. Modellen kan köras på lokala AI-system – inklusive NVIDIA RTX-datorer, NVIDIA DGX Spark, NVIDIA DGX Station och NVIDIA Jetson – vilket låter organisationer maximera befintliga infrastrukturinvesteringar. Den kan även skala över avancerade AI-enheter, NVIDIA RTX PRO-arbetsstationer, datacenter och molnmiljöer för företagsanvändning. Den flexibiliteten är viktig för organisationer som hanterar känslig information som måste förbli på plats.

Som med varje Nemotron-lansering, säger NVIDIA att de publicerar lika mycket av träningsdata och tekniker som licenstillstånd, vilket möjliggör spårbarhet, revision och utbildning av andra modeller. Detta engagemang för transparens har blivit en konkurrenskraftig skillnad eftersom företag väger öppna modeller mot proprietära alternativ som ger mindre insyn i hur de byggdes.

NeMo Switchyard: Smart Routing för system av modeller

Om Nemotron 3.5 Lightning är arbetshästen är NeMo Switchyard avsändaren. Biblioteket med öppen källkod leder automatiskt till den mest kapabla och effektiva modellen för varje steg i ett agentarbetsflöde, baserat på specifika behov. Vissa modeller är bättre för kodning, vissa för resonemang, vissa för lätta uppgifter och vissa är optimerade för att köras lokalt för större integritet och effektivitet. Att förlita sig på en enda standardmodell kan innebära överutgifter eller att offra kvalitet; att hantera routing manuellt blir samtidigt integrationsarbete som kan sakta ner en distribution.

Agentapplikationsutvecklare kan ställa in eller modifiera routern med olika routingalgoritmer för att matcha deras prioriteringar, såsom kvalitet, latens och kostnadskrav. NVIDIAs interna riktmärken visar att NeMo Switchyard bibehåller gränsöverskridande noggrannhet samtidigt som kostnaderna för slutförande av uppgifter minskar till nästan en tredjedel av Opus 4.8 enbart - en slående effektivitetsvinst för organisationer som kör ett stort antal agentuppgifter.

Företaget lyfte fram en rad partnerintegrationer. Boomi rapporterade 100 % exakthet för domändirigering och skickade 59 % av trafiken till en 5 gånger snabbare finjusterad modell. Cadence förbättrade effektiviteten med 9,9 % på ett formellt verifieringsanvändningsfall. Cognition integrerade Switchyard i Devin Desktop, vilket uppnådde gränsöverskridande prestanda på FrontierCode Main samtidigt som den genomsnittliga kostnaden minskade med 28 %. LangChain rapporterade 74% lägre kostnad för 145 multi-turn Deep Agents-uppgifter genom att dirigera endast 7% av samtalen till en frontier-modell. LiteLLM lägger till NeMo Switchyard som en plug-in till sitt proxylager, och Kong levererar nu routing via Kong AI Gateway. Nous Research integrerade NeMo Switchyard i Hermes för att ge utvecklare ett lättkonfigurerat routingsystem för agenteffektivitet.

Industriadoption och den större bilden

AI-ledare inom olika branscher anpassar redan Nemotron 3.5 Lightning för sina arbetsbelastningar. CrowdStrike tillämpar det på cybersäkerhet, Harvey använder det för juridiska tjänster och CodeRabbit distribuerar det för kodgranskning. Lila Sciences hjälper till att förbättra resonemangskapaciteten för agentuppgifter inom fysik och biovetenskap, medan Fastino Labs anpassade modellen och rapporterade ledande noggrannheter för mjukvaruutveckling, ekonomi och sjukvårdsbelastningar.

Releasen understryker en bredare branschtrend: när agent AI mognar kan ingen enskild modell göra allt bra till en acceptabel kostnad. Framtiden tillhör ensembler – gränsplanerare som koordinerar flottor av specialiserade arbetare – och verktygen som binder dem samman. NVIDIA:s satsning är att öppna modeller och intelligent routing gör att företag kan montera dessa system utan att låsa sig i en enda leverantörs stack.

Ligg före AI

NVIDIAs Nemotron 3.5 Lightning och NeMo Switchyard signalerar vart agent AI är på väg: snabbare, billigare, mer transparent och kan användas var som helst. För att hålla jämna steg med modellreleaserna och företagsverktygen som omformar landskapet, utforska våra brytande AI-nyheter.

Läs mer AI-nyheter →