Stand: 30. September 2026 · Source-first Referenz64 dokumentierte Open-Weight-Modelle · Keine bezahlten Rankings
OpenWeightModelle.dePassendes Modell finden
✓ Redaktionell geprüftPrüfdatum: 30. September 2026
ModelPassport · Reasoning

Nemotron 3 Super 120B-A12B

Nemotron 3 Super kombiniert 120B Gesamtparameter mit 12B aktiven Parametern, sehr langem Kontext und einer hybriden Mamba-/MoE-/Attention-Architektur. NVIDIA richtet es auf Agenten, RAG und langlaufende Unternehmensworkloads aus.

🇺🇸NVIDIA120B gesamt · 12B aktivTextNVIDIA Nemotron Open Model License
ReasoningSchwerpunkt
🇺🇸 USAAnbieterland
Primärquelle verlinktQuellenstatus
30. September 2026letzte Prüfung
Kurz erklärt

Nemotron 3 Super kombiniert 120B Gesamtparameter mit 12B aktiven Parametern, sehr langem Kontext und einer hybriden Mamba-/MoE-/Attention-Architektur. NVIDIA richtet es auf Agenten, RAG und langlaufende Unternehmensworkloads aus. Für die Praxis wird das Modell als Server / High-End Workstation eingeordnet; veröffentlicht ist es unter NVIDIA Nemotron Open Model License.

ModelPassport 1.1

Standardisierte Referenzdaten

Modell-IDOWM-0061
Anbieter🇺🇸 NVIDIA
AnbieterlandUSA
FamilieNemotron 3
Parameterklasse120B gesamt · 12B aktiv
ArchitekturLatentMoE · Mamba-2 + Attention
ModalitätText
LizenzNVIDIA Nemotron Open Model License
Lokale EinordnungServer / High-End Workstation
Datenschutz-PotenzialEigener Datenpfad möglich*

Was ist Nemotron 3 Super 120B-A12B?

Nemotron 3 Super 120B-A12B gehört zur Familie Nemotron 3 des Anbieters NVIDIA. Als Anbieterland kennzeichnet OpenWeightModelle 🇺🇸 USA. Die Flagge beschreibt den Anbieter – nicht Trainingsdaten, Rechenzentrum oder Nutzerstandort.

Die Variante wird als 120B gesamt · 12B aktiv eingeordnet und verarbeitet Text. Der redaktionelle Schwerpunkt liegt auf Reasoning.

Typische Einsatzgebiete

  • Agenten und Tool-Nutzung
  • RAG
  • Long-Context Reasoning

Diese Einordnung ist keine Rangliste. Für reale Projekte sollten Modellqualität, Latenz, Lizenz, Infrastruktur, Datenschutz und Betriebskosten gemeinsam bewertet werden.

Hardware und lokale Nutzung

Praxisorientierung: Offizielle Modellkarte nennt mindestens 1× B200 oder 1× DGX Spark für die NVFP4-Variante.

Wichtig: Parameterzahl und aktive Parameter sind nicht identisch mit dem Speicherbedarf. Gewichtformat, Quantisierung, KV-Cache, Kontext, Batch-Größe und Offloading beeinflussen die tatsächliche Hardwareanforderung.
Datenschutz / DSGVO

DSGVO-Einordnung

Self-Hosting kann einen datenschutzfreundlichen Betrieb erleichtern, ist aber kein DSGVO-Konformitätsnachweis. Weil die Gewichte verfügbar sind, kann der Inferenzpfad grundsätzlich selbst betrieben und auf EU-Infrastruktur gelegt werden. Ob der konkrete Einsatz DSGVO-konform ist, hängt vom gesamten Datenfluss, der Rechtsgrundlage, Zweckbindung, Datenminimierung, Sicherheit, Löschkonzepten, eingebundenen Dienstleistern und möglichen Drittlandtransfers ab.

DSGVO & Datensouveränität ausführlich erklärt →

Lizenz

Die offizielle Modellquelle nennt NVIDIA Nemotron Open Model License. Open Weight bedeutet nicht automatisch Open Source. Für Weitergabe, kommerzielle Nutzung, gehostete Dienste und Modell-Derivate ist immer der vollständige aktuelle Lizenztext maßgeblich.

Deployment

Die praktische Infrastrukturklasse lautet Server / High-End Workstation. Kleine Varianten können sich für lokale Geräte eignen; große Dense- oder MoE-Modelle benötigen häufig dedizierte GPU-Server, Multi-GPU-Systeme oder Cluster.

Offizielle Quelle

Häufige Fragen

Kann Nemotron 3 Super 120B-A12B lokal laufen?

Die Einordnung lautet „Server / High-End Workstation“. Der tatsächliche Bedarf hängt insbesondere von Quantisierung, Kontext und Runtime ab.

Welche Lizenz gilt?

Die verlinkte Primärquelle nennt NVIDIA Nemotron Open Model License. Für produktive Nutzung sollte der vollständige aktuelle Lizenztext geprüft werden.