N
NVIDIA / nemotron-3-ultra

NVIDIA Nemotron 3 Ultra

Modelo MoE aberto de 550B parâmetros para orquestração, investigação, código e agentes de longa duração.

01 / RESUMO

O essencial

ORIENTAÇÃOAgentes abertos de longa duração

Uso primário declarado ou inferido com cautela a partir da documentação oficial.

CONTEXTO1.000.000 tokens

Capacidade máxima de entrada quando publicada pela fonte.

SAÍDANão publicado

Limite máximo de geração documentado.

ACESSONVIDIA NIM e pesos

Canais de disponibilidade verificados.

TIPO DE MODELOTexto e raciocínio · Código

Família funcional principal e especialidades verificadas.

LICENÇALicença aberta da NVIDIA

Condições declaradas para API, pesos ou alojamento próprio.

02 / FICHA TÉCNICA

Limites e integração

ID de APInemotron-3-ultra
Tipo de modeloTexto e raciocínio · Código
Modelo de acessoAPI e pesos abertos
LicençaLicença aberta da NVIDIA
ImplantaçãoNIM, local ou nuvem privada
Lançamento2026
Data de corte do conhecimentoNão publicado
EntradaTexto
SaídaTexto
Janela de contexto1.000.000 tokens
saída máximaNão publicado
RaciocínioRaciocínio agentivo
Ferramentas publicadasFunções · NVIDIA NIM
Passeios EstruturadosNão aplicável ou não publicado
Processamento em loteNão publicado
Cache de promptsNão publicado
Ajuste finoPesos, dados e receitas publicados
Plataformas verificadasNVIDIA NIM · Hugging Face
ADEQUA-SE MELHOR A

Agentes empresariais, código e implementação acelerada sob controlo próprio.

CONVÉM MONITORIZAR

A dimensão requer várias GPU; compara o custo total por tarefa e não apenas a velocidade por token.

03 / CAPACIDADES

O que pode fazer

01

Orientação

Agentes empresariais, código e implementação acelerada sob controlo próprio.

02

Contexto

1.000.000 tokens · Não publicado

03

Ferramentas e integração

Funções · NVIDIA NIM

04

Acesso

NVIDIA NIM e pesos

Modalidades de entrada
Texto
04 / PREÇOS

Custo documentado

ConceitoValorUnidade/condição
Entrada padrãoNão publicadoTarifa padrão da API
Entrada em cacheNão publicadoLeitura de prefixos reutilizados
Escrita ou armazenamento em cacheNão publicadoA condição varia consoante o fornecedor
Saída padrãoNão publicadoPode incluir tokens de raciocínio
Entrada por lotesNão publicadoProcessamento assíncrono
Saída por lotesNão publicadoProcessamento assíncrono

Consulta a fonte primária: a unidade de faturação depende do tipo de modelo e do canal de acesso.

i Os preços mudam e podem depender do nível, região ou duração do contexto. Verifique a fonte antes de tomar uma decisão.

05 / AVALIAÇÕES

Como ler os resultados

“

Um benchmark público orienta, mas não substitui uma avaliação com os teus dados, ferramentas, orçamento e tolerância ao erro.

BenchmarkResultadoMétricaFonte
Coste en SWE-benchAté −30 %Custo por tarefa concluída publicadoVer fonte ↗

O Inferama só destaca o “melhor resultado” quando a métrica, o conjunto de testes, a configuração e a data permitem uma comparação equivalente. Os números do fornecedor são apresentados como declarações de sua própria fonte.

06 / VERSÕES

Cronologia

NVIDIA Nemotron 3 Ultra

Versão incorporada no catálogo verificado da Inferama.

ANÁLISE

Análises relacionadas

07 / FONTES

Rastreabilidade