N
NVIDIA / nemotron-3-ultra

NVIDIA Nemotron 3 Ultra

Modelo MoE abierto de 550B parámetros para orquestación, investigación, código y agentes de larga duración.

01 / RESUMEN

Lo esencial

ORIENTACIÓNAgentes abiertos de larga duración

Uso principal declarado o inferido con cautela desde la documentación oficial.

CONTEXTO1.000.000 tokens

Capacidad máxima de entrada cuando la fuente la publica.

SALIDANo publicado

Límite máximo de generación documentado.

ACCESONVIDIA NIM y pesos

Canales de disponibilidad verificados.

TIPO DE MODELOTexto y razonamiento · Código

Familia funcional principal y especialidades verificadas.

LICENCIALicencia abierta de NVIDIA

Condiciones declaradas para API, pesos o despliegue propio.

02 / FICHA TÉCNICA

Límites e integración

ID de APInemotron-3-ultra
Tipo de modeloTexto y razonamiento · Código
Modelo de accesoAPI y pesos abiertos
LicenciaLicencia abierta de NVIDIA
DespliegueNIM, local o nube privada
Lanzamiento2026
Corte de conocimientoNo publicado
EntradaTexto
SalidaTexto
Ventana de contexto1.000.000 tokens
Salida máximaNo publicado
RazonamientoRazonamiento agentivo
Herramientas publicadasFunciones · NVIDIA NIM
Salidas estructuradasNo aplica o no publicado
Procesamiento por lotesNo publicado
Caché de promptsNo publicado
Ajuste finoPesos, datos y recetas publicados
Plataformas verificadasNVIDIA NIM · Hugging Face
ENCAJA MEJOR EN

Agentes empresariales, código y despliegue acelerado bajo control propio.

CONVIENE VIGILAR

El tamaño requiere varias GPU; compara coste total por tarea y no solo velocidad por token.

03 / CAPACIDADES

Qué puede hacer

01

Orientación

Agentes empresariales, código y despliegue acelerado bajo control propio.

02

Contexto

1.000.000 tokens · No publicado

03

Herramientas e integración

Funciones · NVIDIA NIM

04

Acceso

NVIDIA NIM y pesos

Modalidades de entrada
Texto
04 / PRECIOS

Coste documentado

ConceptoValorUnidad / condición
Entrada estándarNo publicadoTarifa estándar de API
Entrada en cachéNo publicadoLectura de prefijos reutilizados
Escritura o almacenamiento de cachéNo publicadoLa condición varía según proveedor
Salida estándarNo publicadoPuede incluir tokens de razonamiento
Entrada por lotesNo publicadoProcesamiento asíncrono
Salida por lotesNo publicadoProcesamiento asíncrono

Consulta la fuente primaria: la unidad de facturación depende del tipo de modelo y del canal de acceso.

i Los precios cambian y pueden depender del nivel, la región o la longitud del contexto. Revisa la fuente antes de tomar una decisión.

05 / EVALUACIONES

Cómo leer los resultados

“

Un benchmark público orienta, pero no sustituye una evaluación con tus datos, herramientas, presupuesto y tolerancia al error.

BenchmarkResultadoMétricaFuente
Coste en SWE-benchHasta −30 %Coste por tarea completada publicadoVer fuente ↗

Inferama solo destaca un «mejor resultado» cuando la métrica, el conjunto de prueba, la configuración y la fecha permiten una comparación equivalente. Las cifras del proveedor se presentan como afirmaciones de su propia fuente.

06 / VERSIONES

Cronología

NVIDIA Nemotron 3 Ultra

Versión incorporada al catálogo verificado de Inferama.

ANÁLISIS

Análisis relacionados

07 / FUENTES

Trazabilidad