Laboratório
Entidade que desenvolve ou publica o modelo e mantém a respetiva documentação técnica e de segurança.
Consulte os modelos documentados, as avaliações publicadas e as fontes primárias associadas a esta organização.
Modelo de fronteira generalista orientado para tarefas complexas, uso de ferramentas e trabalho profissional de alta exigência.
16 SET 2026↗ FRONTEIRA GENERALISTATrabalho complexo, código e agentes com ferramentas.
16 SET 2026↗ EQUILÍBRIO CUSTO/CAPACIDADETarefas que equilibram qualidade, velocidade e custo.
16 SET 2026↗ ALTA EFICIÊNCIAAlto volume, subagentes e extração estruturada.
16 SET 2026↗ FRONTEIRA ANTERIORGeração anterior da OpenAI para código e trabalho profissional, mantida para comparar migrações e custos.
18 SET 2026↗ SEM RACIOCÍNIO · CONTEXTO LONGOModelo sem raciocínio de contexto longo, útil como referência histórica para código, seguimento de instruções e latência previsível.
18 SET 2026↗ RACIOCÍNIO ABERTOModelo de raciocínio com pesos abertos para execução local ou privada; cabe numa GPU H100 segundo a OpenAI.
18 SET 2026↗ GERAÇÃO E EDIÇÃO VISUALModelo principal da OpenAI para gerar e editar imagens com instruções complexas e produção visual de elevada qualidade.
18 SET 2026↗ VÍDEO COM ÁUDIO SINCRONIZADOModelo histórico de vídeo com áudio sincronizado, útil para comparar a evolução da família Sora.
18 SET 2026↗ CONVERSAÇÃO DE VOZ EM TEMPO REALModelo de voz em tempo real para conversações expressivas, interrupções naturais e fluxos com ferramentas.
18 SET 2026↗ RECONHECIMENTO DE VOZModelo especializado de transcrição de alta precisão para ficheiros e entradas de áudio em tempo real.
18 SET 2026↗ REPRESENTAÇÃO VETORIAL DE TEXTOModelo de embeddings de maior capacidade da OpenAI para pesquisa semântica, classificação, clustering e RAG.
18 SET 2026↗ PROGRAMAÇÃO, UTILIZAÇÃO DO COMPUTADOR E TRABALHO PROFISSIONALModelo da OpenAI para programação complexa, utilização do computador e trabalho profissional com entradas de texto e imagem. O fornecedor anuncia um desempenho próximo do Astra a um custo inferior; avalie esse equilíbrio nas suas próprias tarefas.
30 SET 2026↗Os números são apresentados com o contexto comunicado pela fonte. Um resultado do fornecedor não equivale a uma comparação independente nem substitui uma avaliação própria.
Uma organização, um produto e um modelo não são a mesma unidade. A Inferama separa-os para evitar atribuir capacidades ou condições comerciais ao elemento errado.
Entidade que desenvolve ou publica o modelo e mantém a respetiva documentação técnica e de segurança.
Versão identificável com limites, modalidades e comportamento que podem mudar entre lançamentos.
API, aplicação, nuvem associada ou plano comercial; cada canal pode ter preços, retenção e limites distintos.
Cada afirmação deve conservar a página oficial consultada e a data de verificação.
Uma pontuação de arena descreve o resultado de uma comparação realizada segundo um protocolo específico; por si só, não demonstra que um modelo siga melhor as instruções, mantenha a continuidade temporal ou sincronize áudio e vídeo. Este guia distingue o que é possível afirmar sobre o Sora 2 Pro daquilo que os benchmarks disponíveis não permitem concluir.
26 set 2026 ↗ ANALISISGuia para avaliar o GPT‑Live‑1 em conversas de voz full‑duplex, separando dinâmica de turnos, compreensão, sucesso da tarefa e segurança de ações delegadas. Propõe um protocolo reproduzível com áudio controlado, rastros, anotação temporal e revisão humana às cegas.
23 set 2026 ↗ ANALISISUma avaliação útil de transcrição automática não se resume a uma única porcentagem de precisão. Este guia propõe um protocolo para medir, separadamente, a fidelidade do texto, as entidades críticas, a atribuição de falantes, as marcações de tempo, a segmentação e a validade da saída consumida por uma aplicação. O objetivo é comparar versões e configurações de forma reproduzível e decidir, com evidências, quando promover, restringir ou bloquear uma implantação.
23 set 2026 ↗ GUIAUma edição generativa útil em produção não é validada apenas porque a alteração solicitada parece correta. Este guia propõe tratar cada retoque como um contrato de preservação: definir o que pode mudar, o que tem de ser mantido, como o medir e quando exigir revisão humana.
23 set 2026 ↗ NOTICIAO GPT-Transcribe é apresentado como um modelo de transcrição disponível através da API da OpenAI. Antes de substituir um sistema ASR existente, convém validar não apenas o texto resultante, mas também o contrato técnico que sustenta pesquisas, resumos, alertas, citações, revisões e registos de conformidade.
22 set 2026 ↗ ANALISISO BenchCAD 1.0 mede se um sistema consegue gerar, modificar ou interpretar programas CadQuery cuja geometria pode ser executada e comparada com uma referência. É um sinal útil sobre reconstrução paramétrica, mas não substitui a validação de tolerâncias, função, fabricação nem integração em um fluxo de engenharia.
22 set 2026 ↗