N
NVIDIA / nemotron-3-ultra

NVIDIA Nemotron 3 Ultra

Offenes MoE-Modell mit 550B Parametern für Orchestrierung, Forschung, Code und Langzeit-Agenten.

01 / ZUSAMMENFASSUNG

Das Wesentliche

ORIENTIERUNGOffene Langzeit-Agenten

Primäre Verwendung angegeben oder vorsichtig aus offizieller Dokumentation abgeleitet.

KONTEXT1.000.000 Tokens

Maximale Eingabekapazität bei Veröffentlichung durch die Quelle.

AUSFAHRTNicht veröffentlicht

Dokumentierte maximale Erzeugungsgrenze.

ZUGANGNVIDIA NIM und Gewichte

Verifizierte Verfügbarkeitskanäle.

MODELLTYPText und Begründung · Code

Primäre Funktionsfamilie und verifizierte Spezialisierungen.

LIZENZOffene NVIDIA-Lizenz

Deklarierte Bedingungen für API, Gewichte oder Self-Hosting.

02 / TECHNISCHES DATENBLATT

Limits und Integration

API-IDnemotron-3-ultra
ModelltypText und Begründung · Code
ZugangsmodellAPI und offene Gewichte
LizenzOffene NVIDIA-Lizenz
EinsatzNIM, lokal oder private Cloud
Veröffentlichung2026
WissensstichtagNicht veröffentlicht
EingangText
AusfahrtText
Kontextfenster1.000.000 Tokens
maximale LeistungNicht veröffentlicht
ArgumentationAgentisches Reasoning
Veröffentlichte ToolsFunktionen · NVIDIA NIM
Strukturierte AusflügeNicht zutreffend oder nicht veröffentlicht
StapelverarbeitungNicht veröffentlicht
Prompt-CacheNicht veröffentlicht
FeinabstimmungVeröffentlichte Gewichte, Daten und Rezepte
Verifizierte PlattformenNVIDIA NIM · Hugging Face
EIGNET SICH BESSER FÜR

Unternehmensagenten, Code und beschleunigte Bereitstellung unter eigener Kontrolle.

SOLLTE BEOBACHTET WERDEN

Die Größe erfordert mehrere GPUs; vergleiche die Gesamtkosten pro Aufgabe und nicht nur die Geschwindigkeit pro Token.

03 / FÄHIGKEITEN

Was es kann

01

Orientierung

Unternehmensagenten, Code und beschleunigte Bereitstellung unter eigener Kontrolle.

02

Kontext

1.000.000 tokens · Nicht veröffentlicht

03

Tools und Integration

Funktionen · NVIDIA NIM

04

Zugang

NVIDIA NIM und Gewichte

Eingabemodalitäten
Text
04 / PREISE

Dokumentierte Kosten

KonzeptWertEinheit/Zustand
StandardeingabeNicht veröffentlichtStandardtarif der API
Eingabe aus dem CacheNicht veröffentlichtLesen wiederverwendeter Präfixe
Schreiben oder Speichern im CacheNicht veröffentlichtDie Bedingung variiert je nach Anbieter
StandardausgabeNicht veröffentlichtKann Reasoning-Tokens enthalten
Batch-EingabeNicht veröffentlichtAsynchrone Verarbeitung
Batch-AusgabeNicht veröffentlichtAsynchrone Verarbeitung

Siehe die Primärquelle: Die Abrechnungseinheit hängt vom Modelltyp und Zugangsweg ab.

i Die Preise ändern sich und können von Level, Region oder Kontextlänge abhängen. Überprüfen Sie die Quelle, bevor Sie eine Entscheidung treffen.

05 / BEWERTUNGEN

So lesen Sie die Ergebnisse

“

Ein öffentlicher Benchmark bietet Orientierung, ersetzt jedoch keine Bewertung mit deinen Daten, Tools, deinem Budget und deiner Fehlertoleranz.

BenchmarkErgebnisMetrikQuelle
Coste en SWE-benchBis zu −30 %Veröffentlichte Kosten pro abgeschlossener AufgabeQuelle öffnen ↗

Inferama hebt nur dann ein „bestes Ergebnis“ hervor, wenn Metrik, Testsatz, Konfiguration und Datum einen gleichwertigen Vergleich ermöglichen. Die Zahlen des Lieferanten werden als Angaben aus eigener Quelle dargestellt.

06 / VERSIONEN

Chronologie

NVIDIA Nemotron 3 Ultra

In den verifizierten Katalog von Inferama aufgenommene Version.

ANALYSE

Verwandte Analysen

07 / QUELLEN

Rückverfolgbarkeit