Uso primário declarado ou inferido com cautela a partir da documentação oficial.
GPT‑4.1
Modelo sem raciocínio de contexto longo, útil como referência histórica para código, seguimento de instruções e latência previsível.
O essencial
Capacidade máxima de entrada quando publicada pela fonte.
Limite máximo de geração documentado.
Canais de disponibilidade verificados.
Família funcional principal e especialidades verificadas.
Condições declaradas para API, pesos ou alojamento próprio.
Limites e integração
| ID de API | gpt-4.1 |
|---|---|
| Tipo de modelo | Código · Texto e raciocínio |
| Modelo de acesso | Proprietário pago |
| Licença | Proprietária |
| Implantação | API alojada |
| Lançamento | 14 ABR 2025 |
| Data de corte do conhecimento | Não publicado |
| Entrada | Texto · Imagem |
| Saída | Texto |
| Janela de contexto | 1.047.576 tokens |
| saída máxima | 32.768 tokens |
| Raciocínio | Sem raciocínio configurável |
| Ferramentas publicadas | Funções · Ferramentas da Responses API |
| Passeios Estruturados | Compatível |
| Processamento em lote | Não publicado |
| Cache de prompts | Não publicado |
| Ajuste fino | Não publicado |
| Plataformas verificadas | OpenAI API |
Código e seguimento de instruções quando é necessário um modelo sem raciocínio.
A OpenAI posiciona-o atrás das gerações GPT‑5; verifica a atualidade antes de uma nova integração.
O que pode fazer
Orientação
Código e seguimento de instruções quando é necessário um modelo sem raciocínio.
Contexto
1.047.576 tokens · 32.768 tokens
Ferramentas e integração
Funções · Ferramentas da Responses API
Acesso
OpenAI API
Custo documentado
| Conceito | Valor | Unidade/condição |
|---|---|---|
| Entrada padrão | Não publicado | Tarifa padrão da API |
| Entrada em cache | Não publicado | Leitura de prefixos reutilizados |
| Escrita ou armazenamento em cache | Não publicado | A condição varia consoante o fornecedor |
| Saída padrão | Não publicado | Pode incluir tokens de raciocínio |
| Entrada por lotes | Não publicado | Processamento assíncrono |
| Saída por lotes | Não publicado | Processamento assíncrono |
Consulta a fonte primária: a unidade de faturação depende do tipo de modelo e do canal de acesso.
i Os preços mudam e podem depender do nível, região ou duração do contexto. Verifique a fonte antes de tomar uma decisão.
Como ler os resultados
Um benchmark público orienta, mas não substitui uma avaliação com os teus dados, ferramentas, orçamento e tolerância ao erro.
| Benchmark | Resultado | Métrica | Fonte |
|---|---|---|---|
| SWE-bench Verified | 54,6 % | Problemas resolvidos publicados | Ver fonte ↗ |
O Inferama só destaca o “melhor resultado” quando a métrica, o conjunto de testes, a configuração e a data permitem uma comparação equivalente. Os números do fornecedor são apresentados como declarações de sua própria fonte.
Cronologia
GPT‑4.1
Versão incorporada no catálogo verificado da Inferama.