Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.
NVIDIA Nemotron 3 Ultra
Offenes MoE-Modell mit 550B Parametern für Orchestrierung, Forschung, Code und Langzeit-Agenten.
Das Wesentliche
Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.
Dokumentierte maximale Erzeugungsgrenze.
Verifizierte Verfügbarkeitskanäle.
Primäre Funktionsfamilie und verifizierte Spezialisierungen.
Deklarierte Bedingungen für API, Gewichte oder Self-Hosting.
Limits und Integration
| API-ID | nemotron-3-ultra |
|---|---|
| Modelltyp | Text und Begründung · Code |
| Zugangsmodell | API und offene Gewichte |
| Lizenz | Offene NVIDIA-Lizenz |
| Einsatz | NIM, lokal oder private Cloud |
| Veröffentlichung | 2026 |
| Wissensstichtag | Nicht veröffentlicht |
| Eingang | Text |
| Ausfahrt | Text |
| Kontextfenster | 1.000.000 Tokens |
| maximale Leistung | Nicht veröffentlicht |
| Argumentation | Agentisches Reasoning |
| Veröffentlichte Tools | Funktionen · NVIDIA NIM |
| Strukturierte Ausflüge | Nicht zutreffend oder nicht veröffentlicht |
| Stapelverarbeitung | Nicht veröffentlicht |
| Prompt-Cache | Nicht veröffentlicht |
| Feinabstimmung | Veröffentlichte Gewichte, Daten und Rezepte |
| Verifizierte Plattformen | NVIDIA NIM · Hugging Face |
Unternehmensagenten, Code und beschleunigte Bereitstellung unter eigener Kontrolle.
Die Größe erfordert mehrere GPUs; vergleiche die Gesamtkosten pro Aufgabe und nicht nur die Geschwindigkeit pro Token.
Was es kann
Orientierung
Unternehmensagenten, Code und beschleunigte Bereitstellung unter eigener Kontrolle.
Kontext
1.000.000 tokens · Nicht veröffentlicht
Tools und Integration
Funktionen · NVIDIA NIM
Zugang
NVIDIA NIM und Gewichte
Dokumentierte Kosten
| Konzept | Wert | Einheit/Zustand |
|---|---|---|
| Standardeingabe | Nicht veröffentlicht | Standardtarif der API |
| Eingabe aus dem Cache | Nicht veröffentlicht | Lesen wiederverwendeter Präfixe |
| Schreiben oder Speichern im Cache | Nicht veröffentlicht | Die Bedingung variiert je nach Anbieter |
| Standardausgabe | Nicht veröffentlicht | Kann Reasoning-Tokens enthalten |
| Batch-Eingabe | Nicht veröffentlicht | Asynchrone Verarbeitung |
| Batch-Ausgabe | Nicht veröffentlicht | Asynchrone Verarbeitung |
Siehe die Primärquelle: Die Abrechnungseinheit hängt vom Modelltyp und Zugangsweg ab.
i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.
So lesen Sie die Ergebnisse
Ein öffentlicher Benchmark bietet Orientierung, ersetzt jedoch keine Bewertung mit deinen Daten, Tools, deinem Budget und deiner Fehlertoleranz.
| Benchmark | Ergebnis | Metrik | Quelle |
|---|---|---|---|
| Coste en SWE-bench | Bis zu −30 % | Veröffentlichte Kosten pro abgeschlossener Aufgabe | Quelle öffnen ↗ |
Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.
Chronologie
NVIDIA Nemotron 3 Ultra
In den verifizierten Katalog von Inferama aufgenommene Version.