Utilisation principale déclarée ou déduite avec prudence de la documentation officielle.
NVIDIA Nemotron 3 Ultra
Modèle MoE ouvert de 550B paramètres pour l’orchestration, la recherche, le code et les agents de longue durée.
L'essentiel
Capacité d'entrée maximale une fois publiée par la source.
Limite de génération maximale documentée.
Canaux de disponibilité vérifiés.
Famille fonctionnelle principale et spécialités vérifiées.
Conditions déclarées pour l’API, les poids ou l’auto-hébergement.
Limites et intégration
| ID d’API | nemotron-3-ultra |
|---|---|
| Type de modèle | Texte et raisonnement · Code |
| Mode d’accès | API et poids ouverts |
| Licence | Licence ouverte NVIDIA |
| Déploiement | NIM, local ou cloud privé |
| Lancement | 2026 |
| Date limite des connaissances | Non publié |
| Entrée | Texte |
| Sortie | Texte |
| Fenêtre contextuelle | 1 000 000 tokens |
| puissance maximale | Non publié |
| Raisonnement | Raisonnement agentique |
| Outils publiés | Fonctions · NVIDIA NIM |
| Sorties structurées | Non applicable ou non publié |
| Traitement par lots | Non publié |
| Cache de prompts | Non publié |
| Ajustement fin | Poids, données et recettes publiés |
| Plateformes vérifiées | NVIDIA NIM · Hugging Face |
Agents d’entreprise, code et déploiement accéléré sous contrôle propre.
La taille nécessite plusieurs GPU ; comparez le coût total par tâche, et pas seulement la vitesse par token.
Ce qu’il peut faire
Orientation
Agents d’entreprise, code et déploiement accéléré sous contrôle propre.
Contexte
1.000.000 tokens · Non publié
Outils et intégration
Fonctions · NVIDIA NIM
Accès
NVIDIA NIM et poids
Coût documenté
| Concept | Valeur | Unité/état |
|---|---|---|
| Entrée standard | Non publié | Tarif API standard |
| Entrée en cache | Non publié | Lecture de préfixes réutilisés |
| Écriture ou stockage de cache | Non publié | La condition varie selon le fournisseur |
| Sortie standard | Non publié | Peut inclure des tokens de raisonnement |
| Entrée par lots | Non publié | Traitement asynchrone |
| Sortie par lots | Non publié | Traitement asynchrone |
Consultez la source primaire : l’unité de facturation dépend du type de modèle et du canal d’accès.
i Les prix changent et peuvent dépendre du niveau, de la région ou de la durée du contexte. Vérifiez la source avant de prendre une décision.
Comment lire les résultats
Un benchmark public fournit une orientation, mais ne remplace pas une évaluation avec vos données, outils, budget et tolérance à l’erreur.
| Benchmark | Résultat | Métrique | Source |
|---|---|---|---|
| Coste en SWE-bench | Jusqu’à −30 % | Coût par tâche terminée publié | Voir la source ↗ |
Inferama ne met en évidence un « meilleur résultat » que lorsque la métrique, l'ensemble de test, la configuration et la date permettent une comparaison équivalente. Les chiffres du fournisseur sont présentés comme des affirmations provenant de sa propre source.
Chronologie
NVIDIA Nemotron 3 Ultra
Version intégrée au catalogue vérifié d’Inferama.