N
NVIDIA / nemotron-3-ultra

NVIDIA Nemotron 3 Ultra

Modèle MoE ouvert de 550B paramètres pour l’orchestration, la recherche, le code et les agents de longue durée.

01 / RÉSUMÉ

L'essentiel

ORIENTATIONAgents ouverts de longue durée

Utilisation principale déclarée ou déduite avec prudence de la documentation officielle.

CONTEXTE1 000 000 tokens

Capacité d'entrée maximale une fois publiée par la source.

SORTIENon publié

Limite de génération maximale documentée.

ACCÈSNVIDIA NIM et poids

Canaux de disponibilité vérifiés.

TYPE DE MODÈLETexte et raisonnement · Code

Famille fonctionnelle principale et spécialités vérifiées.

LICENCELicence ouverte NVIDIA

Conditions déclarées pour l’API, les poids ou l’auto-hébergement.

02 / FICHE TECHNIQUE

Limites et intégration

ID d’APInemotron-3-ultra
Type de modèleTexte et raisonnement · Code
Mode d’accèsAPI et poids ouverts
LicenceLicence ouverte NVIDIA
DéploiementNIM, local ou cloud privé
Lancement2026
Date limite des connaissancesNon publié
EntréeTexte
SortieTexte
Fenêtre contextuelle1 000 000 tokens
puissance maximaleNon publié
RaisonnementRaisonnement agentique
Outils publiésFonctions · NVIDIA NIM
Sorties structuréesNon applicable ou non publié
Traitement par lotsNon publié
Cache de promptsNon publié
Ajustement finPoids, données et recettes publiés
Plateformes vérifiéesNVIDIA NIM · Hugging Face
CONVIENT MIEUX À

Agents d’entreprise, code et déploiement accéléré sous contrôle propre.

À SURVEILLER

La taille nécessite plusieurs GPU ; comparez le coût total par tâche, et pas seulement la vitesse par token.

03 / CAPACITÉS

Ce qu’il peut faire

01

Orientation

Agents d’entreprise, code et déploiement accéléré sous contrôle propre.

02

Contexte

1.000.000 tokens · Non publié

03

Outils et intégration

Fonctions · NVIDIA NIM

04

Accès

NVIDIA NIM et poids

Modalités d’entrée
Texte
04 / TARIFS

Coût documenté

ConceptValeurUnité/état
Entrée standardNon publiéTarif API standard
Entrée en cacheNon publiéLecture de préfixes réutilisés
Écriture ou stockage de cacheNon publiéLa condition varie selon le fournisseur
Sortie standardNon publiéPeut inclure des tokens de raisonnement
Entrée par lotsNon publiéTraitement asynchrone
Sortie par lotsNon publiéTraitement asynchrone

Consultez la source primaire : l’unité de facturation dépend du type de modèle et du canal d’accès.

i Les prix changent et peuvent dépendre du niveau, de la région ou de la durée du contexte. Vérifiez la source avant de prendre une décision.

05 / ÉVALUATIONS

Comment lire les résultats

“

Un benchmark public fournit une orientation, mais ne remplace pas une évaluation avec vos données, outils, budget et tolérance à l’erreur.

BenchmarkRésultatMétriqueSource
Coste en SWE-benchJusqu’à −30 %Coût par tâche terminée publiéVoir la source ↗

Inferama ne met en évidence un « meilleur résultat » que lorsque la métrique, l'ensemble de test, la configuration et la date permettent une comparaison équivalente. Les chiffres du fournisseur sont présentés comme des affirmations provenant de sa propre source.

06 / VERSIONS

Chronologie

NVIDIA Nemotron 3 Ultra

Version intégrée au catalogue vérifié d’Inferama.

ANALYSE

Analyses connexes

07 / SOURCES

Traçabilité