Zum Inhalt springen
Alle Modelle im Vergleich

Platz 26 im Vergleich

Nemotron 3 Super

NVIDIA · USA · veröffentlicht 11. März 2026

82 % Gesamtbewertung

NVIDIAs offenes Hybrid-Modell aus Mamba, Transformer und Mixture-of-Experts, gezielt für agentische Abläufe. Von 120 Milliarden Parametern sind nur 12 Milliarden je Anfrage aktiv, dazu liegen die Trainingsdaten offen.

Zur offiziellen Modellseite

Bewertung im Detail

Gesamtnote aus 3 gewichteten Dimensionen. Wie wir bewerten

Leistung (55 %) 85 %
DSGVO- und EU-Eignung (30 %) 78 %
Lizenz-Offenheit (15 %) 82 %

Fähigkeitsprofil

Wo Nemotron 3 Super stark ist, über 6 Säulen auf einer Skala von 0 bis 100. Die gestrichelte Linie ist der Median aller 32 Modelle im Vergleich. Wie die Säulen entstehen

Coding 80* Mathe & Logik 80* Wissen 78* Deutsch 76* Agentik 92 Kontext 88*
Nemotron 3 Super Median aller Modelle * redaktionelle Einschätzung (kein belegter Benchmark)
Fähigkeitsprofil von Nemotron 3 Super, Werte von 0 bis 100
SäuleWertGrundlage
Programmierung80redaktionelle Einschätzung
Mathematik & Logik80redaktionelle Einschätzung
Wissen78redaktionelle Einschätzung
Deutsch & Sprache76redaktionelle Einschätzung
Agentik & Werkzeuge92benchmarkbelegt
Langer Kontext88redaktionelle Einschätzung
Agentik & Werkzeuge 92
Werkzeuge selbständig aufrufen und mehrstufige Abläufe steuern
Langer Kontext · Einschätzung 88
nutzbare Leistung über sehr lange Eingaben, nicht nur die Fenstergröße
Programmierung · Einschätzung 80
Code schreiben und debuggen, ganze Repositories über viele Schritte bearbeiten
Mathematik & Logik · Einschätzung 80
mehrstufiges Rechnen und logisches Schließen mit prüfbarer Lösung
Wissen · Einschätzung 78
Fach- und Allgemeinwissen über viele Domänen hinweg
Deutsch & Sprache · Einschätzung 76
Sprachverständnis und Mehrsprachigkeit, mit Blick auf Deutsch

Stärkste Säule: Agentik & Werkzeuge. Belegte Werte stammen aus den dokumentierten Benchmarks unten (baseline-korrigiert normalisiert), mit "Einschätzung" markierte Säulen sind eine redaktionelle Einordnung, weil kein vergleichbarer Benchmark vorlag. Details zur Methodik stehen auf der Übersichtsseite.

Steckbrief

Architektur
Hybrid (Mamba, Transformer, MoE)
Parameter
120 Mrd. gesamt, 12 Mrd. aktiv je Token
Kontextfenster
1 Mio. Token
Lizenz
NVIDIA Nemotron Open Model LicenseOffene Gewichte samt Trainingsdaten und -rezepten, aber eigene NVIDIA-Lizenz, nicht so permissiv wie MIT oder Apache 2.0.
Eingabe
Text
Lokaler Betrieb
Eine RTX PRO 6000 (96 GB, FP8) oder H100
Bei EU-Hostern
SeltenKein EU-Hoster bestätigt, Betrieb auf dem eigenen Server; NVIDIA-Cloud in den USA

Benchmarks

Die folgenden Werte sind Hersteller-Angaben. Eine unabhängige Verifikation lag zum Stand dieser Seite nicht vor.

85,6 PinchBench (Agentic AI)
1 Mio. Token Kontextfenster
5× Vorgänger Durchsatz

Nemotron 3 Super ist NVIDIAs offenes Modell für agentische Abläufe. Die hybride Architektur kombiniert Mamba-2, Transformer-Attention und Mixture-of-Experts: Mamba verarbeitet lange Sequenzen mit linearer statt quadratischer Komplexität und macht so das native 1-Million-Kontextfenster praktikabel, die Transformer-Schichten verknüpfen an den Stellen, auf die es ankommt, jedes Token mit jedem. Von 120 Milliarden Parametern sind nur 12 Milliarden je Token aktiv. Auf dem PinchBench-Benchmark für agentische Steuerung erreicht es 85,6, den besten Wert unter allen offenen Modellen.

NVIDIA veröffentlicht neben den Gewichten auch Trainingsdaten und -rezepte, womit sich ein Trainingslauf nachbauen lässt. Die Lizenz ist allerdings eine eigene NVIDIA Nemotron Open Model License und damit weniger permissiv als MIT oder Apache 2.0. Die volle 120B-Version braucht eine leistungsfähige GPU; mit FP8-Quantisierung passt sie auf eine RTX PRO 6000 mit 96 GB, eine H100 ist nur bei hohem Durchsatz nötig. Ein europäischer Hoster ist nicht bestätigt, die NVIDIA-Cloud läuft in den USA. Der DSGVO-konforme Betrieb entsteht über eigene Hardware.

Wofür es taugt

  • Bestes offenes Modell für Agentic AI (PinchBench 85,6)
  • Natives 1-Million-Kontextfenster durch Mamba-Architektur
  • Offene Gewichte samt Trainingsdaten und -rezepten

Wo es hakt

  • Eigene NVIDIA-Lizenz, weniger permissiv als MIT oder Apache
  • Volle 120B-Version braucht eine leistungsfähige GPU
  • Kein EU-Hoster bestätigt, NVIDIA-Cloud in den USA

Quelle: NVIDIA-Modellkarte und NVIDIA Developer Blog, März 2026 · Stand der Recherche 21. August 2026 · die Bewertung ist eine redaktionelle Einschätzung von gewusst:KI