ORGANIZAÇÃO VERIFICADA

OpenAI

Consulte os modelos documentados, as avaliações publicadas e as fontes primárias associadas a esta organização.

01 / MODELOS

Catálogo verificado

FRONTEIRA GENERALISTA

GPT‑6 Astra

Modelo de fronteira generalista orientado para tarefas complexas, uso de ferramentas e trabalho profissional de alta exigência.

16 SET 2026
FRONTEIRA GENERALISTA

GPT‑5.6 Sol

Trabalho complexo, código e agentes com ferramentas.

16 SET 2026
EQUILÍBRIO CUSTO/CAPACIDADE

GPT‑5.6 Terra

Tarefas que equilibram qualidade, velocidade e custo.

16 SET 2026
ALTA EFICIÊNCIA

GPT‑5.6 Luna

Alto volume, subagentes e extração estruturada.

16 SET 2026
FRONTEIRA ANTERIOR

GPT‑5.5

Geração anterior da OpenAI para código e trabalho profissional, mantida para comparar migrações e custos.

18 SET 2026
SEM RACIOCÍNIO · CONTEXTO LONGO

GPT‑4.1

Modelo sem raciocínio de contexto longo, útil como referência histórica para código, seguimento de instruções e latência previsível.

18 SET 2026
RACIOCÍNIO ABERTO

gpt‑oss‑120b

Modelo de raciocínio com pesos abertos para execução local ou privada; cabe numa GPU H100 segundo a OpenAI.

18 SET 2026
GERAÇÃO E EDIÇÃO VISUAL

GPT‑Image‑2.5 Sunburst

Modelo principal da OpenAI para gerar e editar imagens com instruções complexas e produção visual de elevada qualidade.

18 SET 2026
VÍDEO COM ÁUDIO SINCRONIZADO

Sora 2 Pro

Modelo histórico de vídeo com áudio sincronizado, útil para comparar a evolução da família Sora.

18 SET 2026
CONVERSAÇÃO DE VOZ EM TEMPO REAL

GPT‑Live 1

Modelo de voz em tempo real para conversações expressivas, interrupções naturais e fluxos com ferramentas.

18 SET 2026
RECONHECIMENTO DE VOZ

GPT‑Transcribe

Modelo especializado de transcrição de alta precisão para ficheiros e entradas de áudio em tempo real.

18 SET 2026
REPRESENTAÇÃO VETORIAL DE TEXTO

text‑embedding‑3‑large

Modelo de embeddings de maior capacidade da OpenAI para pesquisa semântica, classificação, clustering e RAG.

18 SET 2026
PROGRAMAÇÃO, UTILIZAÇÃO DO COMPUTADOR E TRABALHO PROFISSIONAL

GPT‑6.1 Sol

Modelo da OpenAI para programação complexa, utilização do computador e trabalho profissional com entradas de texto e imagem. O fornecedor anuncia um desempenho próximo do Astra a um custo inferior; avalie esse equilíbrio nas suas próprias tarefas.

30 SET 2026
02 / AVALIAÇÕES

Resultados publicados

Os números são apresentados com o contexto comunicado pela fonte. Um resultado do fornecedor não equivale a uma comparação independente nem substitui uma avaliação própria.

ModeloBenchmarkResultadoMétrica
GPT‑6 AstraTerminal-Bench Science 0.164,6 %Exatidão
GPT‑6 AstraGPQA Diamond96,0 %Exatidão
GPT‑6 AstraBenchCAD95,9 %Sobreposição geométrica
GPT‑5.6 SolAgents' Last Exam52,7 %Exatidão
GPT‑5.6 SolSWE-Bench Pro64,6 %Resolvido
GPT‑5.6 SolTerminal-Bench 2.188,8 %Exatidão
GPT‑5.6 TerraAgents' Last Exam50,4 %Exatidão
GPT‑5.6 TerraSWE-Bench Pro63,4 %Resolvido
GPT‑5.6 TerraTerminal-Bench 2.187,4 %Exatidão
GPT‑5.6 LunaAgents' Last Exam50,3 %Exatidão
GPT‑5.6 LunaSWE-Bench Pro62,7 %Resolvido
GPT‑5.6 LunaTerminal-Bench 2.184,7 %Exatidão
GPT‑5.5Evaluaciones oficiales GPT‑5.5PublicadasCódigo e trabalho profissional
GPT‑4.1SWE-bench Verified54,6 %Problemas resolvidos publicados
gpt‑oss‑120bEvaluaciones gpt‑ossNível o4-mini publicadoRaciocínio geral
GPT‑Image‑2.5 SunburstEvaluación visual GPT‑Image‑2.5Modelo principalPreferência e seguimento de instruções
Sora 2 ProEvaluación de Sora 2 ProPublicadaVídeo e áudio sincronizados
GPT‑Live 1Evaluación de conversación GPT‑LiveModelo principalNaturalidade e interrupções
GPT‑TranscribeEvaluación ASR GPT‑TranscribePublicadaPrecisão de transcrição
text‑embedding‑3‑largeMTEB64,6 %Média publicada
03 / MÉTODO

Como ler o diretório

Uma organização, um produto e um modelo não são a mesma unidade. A Inferama separa-os para evitar atribuir capacidades ou condições comerciais ao elemento errado.

01

Laboratório

Entidade que desenvolve ou publica o modelo e mantém a respetiva documentação técnica e de segurança.

02

Modelo

Versão identificável com limites, modalidades e comportamento que podem mudar entre lançamentos.

03

Canal de acesso

API, aplicação, nuvem associada ou plano comercial; cada canal pode ter preços, retenção e limites distintos.

04

Fonte e data

Cada afirmação deve conservar a página oficial consultada e a data de verificação.

ANÁLISE

Análises relacionadas

Sora 2 Pro nos benchmarks de vídeo: o que uma preferência às cegas mede — e o que deixa sem resposta
ANALISIS

Sora 2 Pro nos benchmarks de vídeo: o que uma preferência às cegas mede — e o que deixa sem resposta

Uma pontuação de arena descreve o resultado de uma comparação realizada segundo um protocolo específico; por si só, não demonstra que um modelo siga melhor as instruções, mantenha a continuidade temporal ou sincronize áudio e vídeo. Este guia distingue o que é possível afirmar sobre o Sora 2 Pro daquilo que os benchmarks disponíveis não permitem concluir.

26 set 2026
Avaliação de conversação GPT‑Live: como medir turnos, interrupções e resolução de tarefas sem confundir uma conversa fluida com um agente confiável
ANALISIS

Avaliação de conversação GPT‑Live: como medir turnos, interrupções e resolução de tarefas sem confundir uma conversa fluida com um agente confiável

Guia para avaliar o GPT‑Live‑1 em conversas de voz full‑duplex, separando dinâmica de turnos, compreensão, sucesso da tarefa e segurança de ações delegadas. Propõe um protocolo reproduzível com áudio controlado, rastros, anotação temporal e revisão humana às cegas.

23 set 2026
Avaliação ASR do GPT‑Transcribe: como medir texto, falantes e tempos sem ocultar os erros que comprometem o fluxo posterior
ANALISIS

Avaliação ASR do GPT‑Transcribe: como medir texto, falantes e tempos sem ocultar os erros que comprometem o fluxo posterior

Uma avaliação útil de transcrição automática não se resume a uma única porcentagem de precisão. Este guia propõe um protocolo para medir, separadamente, a fidelidade do texto, as entidades críticas, a atribuição de falantes, as marcações de tempo, a segmentação e a validade da saída consumida por uma aplicação. O objetivo é comparar versões e configurações de forma reproduzível e decidir, com evidências, quando promover, restringir ou bloquear uma implantação.

23 set 2026
Edição localizada de imagens com IA: como verificar se o modelo altera apenas o pedido e preserva o restante ativo
GUIA

Edição localizada de imagens com IA: como verificar se o modelo altera apenas o pedido e preserva o restante ativo

Uma edição generativa útil em produção não é validada apenas porque a alteração solicitada parece correta. Este guia propõe tratar cada retoque como um contrato de preservação: definir o que pode mudar, o que tem de ser mantido, como o medir e quando exigir revisão humana.

23 set 2026
GPT-Transcribe: o que uma equipa deve voltar a validar antes de substituir o seu transcritor
NOTICIA

GPT-Transcribe: o que uma equipa deve voltar a validar antes de substituir o seu transcritor

O GPT-Transcribe é apresentado como um modelo de transcrição disponível através da API da OpenAI. Antes de substituir um sistema ASR existente, convém validar não apenas o texto resultante, mas também o contrato técnico que sustenta pesquisas, resumos, alertas, citações, revisões e registos de conformidade.

22 set 2026
BenchCAD: o que reconstruir uma peça mecânica executável demonstra — e o que não prova sobre projeto industrial
ANALISIS

BenchCAD: o que reconstruir uma peça mecânica executável demonstra — e o que não prova sobre projeto industrial

O BenchCAD 1.0 mede se um sistema consegue gerar, modificar ou interpretar programas CadQuery cuja geometria pode ser executada e comparada com uma referência. É um sinal útil sobre reconstrução paramétrica, mas não substitui a validação de tolerâncias, função, fabricação nem integração em um fluxo de engenharia.

22 set 2026
04 / FONTES

Rastreabilidade