Models
NVIDIA Nemotron 3.5 Lightning und NeMo Switchyard - Smarter Model-Routing fuer Agenten
NVIDIA erweitert seine Nemotron-3-Familie um zwei signifikante Releases: Nemotron 3.5 Lightning, ein 30-Milliarden-Parameter MoE-Modell fuer hochvolumige Agenten-Workflows, und NeMo Switchyard, eine Open-Source-Routing-Bibliothek fuer intelligente Modellverteilung.
Nemotron 3.5 Lightning - Klein, schnell, agentic
Das Modell ist fuer spezialisierte Aufgaben in groesseren Multi-Agent-Systemen ausgelegt – Code-Review, Tool-Use, Security-Monitoring und aehnliche wiederkehrende Tasks. Laut NVIDIA liefert es bis zu 4x schnellere Output-Geschwindigkeit und 30% schnellere Agenten-Task-Completion im Vergleich zu Konkurrenten der gleichen Klasse. Dabei ist es voll anpassbar: Unternehmen koennen es mit NeMo auf eigene Domains post-train.
Einsatzpartner bereits aktiv: CrowdStrike (Cybersecurity), Harvey (Legal), CodeRabbit (Code-Review), Lila Sciences (Life Sciences) und Fastino Labs (Finanzen/Gesundheit). Das Modell laeuft lokal auf RTX-PCs, DGX Spark, DGX Station und Jetson – oder eben in der Cloud.
NeMo Switchyard - Smartes Model-Routing
Das interessantere Release ist NeMo Switchyard: Eine Routing-Library, die Prompts automatisch an das faehigste und effizienteste Modell fuer jeweiligen Task-Schritt leitet. Statt teure Frontier-Modelle fuer jeden Aufruf zu nutzen, route Switchyard nur komplexe Anfragen dorthin und leitet den Rest an schnellere, guenstigere Modelle.
Interne Benchmarks zeigen: Switchyard haelt Frontier-Level-Genauigkeit bei nur ein Drittel der Kosten eines reinen Opus-4.8-Einsatzes. Partner wie LangChain (74% Kostensenkung), Ramp (58% Kosten / 33% Runtime reduziert) und Cognition (28% Kostensenkung bei Devin) bestaetigen das in der Praxis.
Verfuegbarkeit: Nemotron 3.5 Lightning auf HuggingFace, ModelScope, OpenRouter und build.nvidia.com. NeMo Switchyard auf GitHub.