NVIDIA Nemotron 3 Ultra setzt neue Maßstäbe im Bereich KI-Agenten. In Kombination mit der LangChain Deep Agents Plattform erzielt das Modell benchmarkführende Ergebnisse zu einem Bruchteil der Kosten herkömmlicher Closed-Source-Alternativen. Unternehmen profitieren von einem vollständig offenen Stack, den sie selbst hosten und anpassen können.
Die Optimierung durch LangChain zeigt eindrücklich, dass leistungsstarke Agenten keine teuren proprietären Modelle erfordern. Stattdessen entscheidet das Engineering des Umfelds über Geschwindigkeit, Genauigkeit und Kosteneffizienz.
Harness Engineering statt Fine-Tuning
Das LangChain Team hat NVIDIA Nemotron 3 Ultra gegen die öffentliche Deep Agents Benchmark-Suite getestet. Anschließend analysierten die Entwickler die Ausführungsspuren, um präzise zu identifizieren, wo das Modell Punkte verlor.
Statt das Modell neu zu trainieren, passten sie den Harness an. Änderungen an System-Prompts, Tool-Beschreibungen und Middleware führten zu signifikanten Leistungssprüngen. Dieser optimierte Profil ist ab sofort direkt über LangChain verfügbar.
Das Ergebnis: Nemotron 3 Ultra erreicht die höchste Genauigkeit unter allen Open-Source-Modellen und kommt auf Augenhöhe mit den besten Closed-Source-Konkurrenten. Gleichzeitig liegt der Durchsatz höher und die Inferenzkosten pro Run um das Zehnfache niedriger.
Ein offener Stack für Unternehmen
Mit NemoClaw for LangChain Deep Agents bündelt NVIDIA eine offene Referenzarchitektur für Unternehmen. Das Blueprint kombiniert den für Nemotron 3 Ultra optimierten LangChain Deep Agents Code mit der NVIDIA OpenShell Secure Runtime.
Diese Dreifaltigkeit aus offenem Modell, offenem Harness und offener Secure Runtime ermöglicht es Firmen, den gesamten Stack End-to-End zu kontrollieren. Anpassungen erfolgen um die eigene Expertise herum, nicht um fremde Lizenzbedingungen.
Vorteile für Enterprise-Agenten
Während KI-Assistenten bisher primär Fragen beantworten, übernehmen Agenten zunehmend aktive Aufgaben in Kernsystemen. Genau hier gewinnt Offenheit an strategischer Bedeutung.
Unternehmen können die Infrastruktur in eigenen Rechenzentren, privaten Clouds oder hybrid betreiben. Governance, Sicherheit und Weiterentwicklung bleiben vollständig in der Hand des Unternehmens.
Erste Unternehmen und Partner im Einsatz
Bereits setzen Abridge, Amdocs und Box spezialisierte Agenten direkt in ihren Plattformen ein. Der globale Systemintegrator EY erweitert zudem seine NVIDIA-Implementierungskapazitäten rund um die NemoClaw Blueprints.
EY unterstützt Kunden dabei, spezialisierte Agenten über hochwertige Workflows hinweg anzupassen, zu evaluieren und zu governen. Die Kombination aus Open-Source-Technologie und professioneller Implementierung beschleunigt die Transformation merklich.
Schneller Einstieg für Entwickler
Entwickler können Nemotron 3 Ultra über gehostete Plattformen wie Baseten, Crusoe Cloud, DeepInfra, Fireworks, Nebius und Together AI direkt nutzen. LangChain stellt das optimierte Deep Agents Harness direkt zur Verfügung.
Wer individuelle Agenten von Grund auf aufbauen möchte, nutzt NemoClaw for LangChain Deep Agents als soliden Ausgangspunkt. So entsteht eine vollständig offene, kostengünstige und leistungsstarke Agenteninfrastruktur.
Quelle
Originalbeitrag und weitere Details finden Sie im NVIDIA Blog.