ORGANIZACIÓN VERIFICADA

OpenAI

Consulta los modelos documentados, las evaluaciones publicadas y las fuentes primarias asociadas a esta organización.

01 / MODELOS

Catálogo verificado

FRONTERA GENERALISTA

GPT‑6 Astra

Modelo frontera generalista orientado a tareas complejas, uso de herramientas y trabajo profesional de alta exigencia.

16 SEP. 2026
FRONTERA GENERALISTA

GPT‑5.6 Sol

Trabajo complejo, código y agentes con herramientas.

16 SEP. 2026
EQUILIBRIO COSTE/CAPACIDAD

GPT‑5.6 Terra

Tareas equilibradas entre calidad, velocidad y coste.

16 SEP. 2026
ALTA EFICIENCIA

GPT‑5.6 Luna

Alto volumen, subagentes y extracción estructurada.

16 SEP. 2026
FRONTERA ANTERIOR

GPT‑5.5

Generación anterior de OpenAI para código y trabajo profesional, conservada para comparar migraciones y coste.

18 SEP. 2026
NO RAZONADOR · CONTEXTO LARGO

GPT‑4.1

Modelo no razonador de contexto largo, útil como referencia histórica para código, seguimiento de instrucciones y latencia predecible.

18 SEP. 2026
RAZONAMIENTO ABIERTO

gpt‑oss‑120b

Modelo de razonamiento con pesos abiertos para ejecución local o privada; cabe en una GPU H100 según OpenAI.

18 SEP. 2026
GENERACIÓN Y EDICIÓN VISUAL

GPT‑Image‑2.5 Sunburst

Modelo principal de OpenAI para generar y editar imágenes con instrucciones complejas y producción visual de alta calidad.

18 SEP. 2026
VÍDEO CON AUDIO SINCRONIZADO

Sora 2 Pro

Modelo histórico de vídeo con audio sincronizado, útil para comparar la evolución de la familia Sora.

18 SEP. 2026
CONVERSACIÓN DE VOZ EN TIEMPO REAL

GPT‑Live 1

Modelo de voz en tiempo real para conversaciones expresivas, interrupciones naturales y flujos con herramientas.

18 SEP. 2026
RECONOCIMIENTO DE VOZ

GPT‑Transcribe

Modelo especializado de transcripción de alta precisión para archivos y entradas de audio en tiempo real.

18 SEP. 2026
REPRESENTACIÓN VECTORIAL DE TEXTO

text‑embedding‑3‑large

Modelo de embeddings de mayor capacidad de OpenAI para búsqueda semántica, clasificación, clustering y RAG.

18 SEP. 2026
CÓDIGO, USO DE ORDENADOR Y TRABAJO PROFESIONAL

GPT‑6.1 Sol

Modelo de OpenAI para código complejo, uso de ordenador y trabajo profesional con entrada de texto e imagen. El proveedor lo sitúa cerca de Astra en rendimiento, a menor coste; comprueba ese equilibrio con tus propias tareas.

30 SEP. 2026
02 / EVALUACIONES

Resultados publicados

Las cifras se muestran con el contexto comunicado por su fuente. Un resultado del proveedor no equivale a una comparación independiente ni sustituye una evaluación propia.

ModeloBenchmarkResultadoMétrica
GPT‑6 AstraTerminal-Bench Science 0.164,6 %Exactitud
GPT‑6 AstraGPQA Diamond96,0 %Exactitud
GPT‑6 AstraBenchCAD95,9 %Solapamiento geométrico
GPT‑5.6 SolAgents' Last Exam52,7 %Exactitud
GPT‑5.6 SolSWE-Bench Pro64,6 %Resuelto
GPT‑5.6 SolTerminal-Bench 2.188,8 %Exactitud
GPT‑5.6 TerraAgents' Last Exam50,4 %Exactitud
GPT‑5.6 TerraSWE-Bench Pro63,4 %Resuelto
GPT‑5.6 TerraTerminal-Bench 2.187,4 %Exactitud
GPT‑5.6 LunaAgents' Last Exam50,3 %Exactitud
GPT‑5.6 LunaSWE-Bench Pro62,7 %Resuelto
GPT‑5.6 LunaTerminal-Bench 2.184,7 %Exactitud
GPT‑5.5Evaluaciones oficiales GPT‑5.5PublicadasCódigo y trabajo profesional
GPT‑4.1SWE-bench Verified54,6 %Problemas resueltos publicados
gpt‑oss‑120bEvaluaciones gpt‑ossNivel o4-mini publicadoRazonamiento general
GPT‑Image‑2.5 SunburstEvaluación visual GPT‑Image‑2.5Modelo principalPreferencia y seguimiento de instrucciones
Sora 2 ProEvaluación de Sora 2 ProPublicadaVídeo y audio sincronizado
GPT‑Live 1Evaluación de conversación GPT‑LiveModelo principalNaturalidad e interrupciones
GPT‑TranscribeEvaluación ASR GPT‑TranscribePublicadaPrecisión de transcripción
text‑embedding‑3‑largeMTEB64,6 %Promedio publicado
03 / MÉTODO

Cómo leer el directorio

Una organización, un producto y un modelo no son la misma unidad. Inferama los separa para evitar atribuir capacidades o condiciones comerciales al elemento equivocado.

01

Laboratorio

Entidad que desarrolla o publica el modelo y mantiene su documentación técnica y de seguridad.

02

Modelo

Versión identificable con límites, modalidades y comportamiento que pueden cambiar entre lanzamientos.

03

Canal de acceso

API, aplicación, nube asociada o plan comercial; cada canal puede tener precios, retención y límites distintos.

04

Fuente y fecha

Cada afirmación debe conservar la página oficial consultada y la fecha de verificación.

ANÁLISIS

Análisis relacionados

Sora 2 Pro en los benchmarks de vídeo: qué mide una preferencia ciega y qué deja sin responder
ANALISIS

Sora 2 Pro en los benchmarks de vídeo: qué mide una preferencia ciega y qué deja sin responder

Una puntuación de arena describe el resultado de una comparación bajo un protocolo concreto; no demuestra por sí sola que un modelo siga mejor las instrucciones, mantenga la continuidad temporal o sincronice audio y vídeo. Esta guía separa lo que puede afirmarse sobre Sora 2 Pro de lo que los benchmarks disponibles no permiten concluir.

26 sep. 2026
Evaluación de conversación GPT‑Live: cómo medir turnos, interrupciones y resolución de tareas sin confundir una charla fluida con un agente fiable
ANALISIS

Evaluación de conversación GPT‑Live: cómo medir turnos, interrupciones y resolución de tareas sin confundir una charla fluida con un agente fiable

Guía para evaluar GPT‑Live‑1 en conversaciones de voz full‑duplex separando dinámica de turnos, comprensión, éxito de tarea y seguridad de acciones delegadas. Propone un protocolo reproducible con audio controlado, trazas, anotación temporal y revisión humana ciega.

23 sep. 2026
Evaluación ASR de GPT‑Transcribe: cómo medir texto, hablantes y tiempos sin ocultar los errores que rompen el flujo posterior
ANALISIS

Evaluación ASR de GPT‑Transcribe: cómo medir texto, hablantes y tiempos sin ocultar los errores que rompen el flujo posterior

Una evaluación útil de transcripción automática no se resume en un único porcentaje de precisión. Esta guía propone un protocolo para medir, por separado, la fidelidad del texto, las entidades críticas, la atribución de hablantes, las marcas de tiempo, la segmentación y la validez de la salida que consume una aplicación. El objetivo es comparar versiones y configuraciones de forma reproducible, y decidir con evidencia cuándo promover, restringir o bloquear un despliegue.

23 sep. 2026
Edición localizada de imágenes con IA: cómo comprobar que el modelo cambia solo lo pedido y conserva el resto del activo
GUIA

Edición localizada de imágenes con IA: cómo comprobar que el modelo cambia solo lo pedido y conserva el resto del activo

Una edición generativa útil en producción no se valida solo porque el cambio solicitado parezca correcto. Esta guía propone tratar cada retoque como un contrato de preservación: definir qué puede cambiar, qué debe mantenerse, cómo medirlo y cuándo exigir revisión humana.

23 sep. 2026
GPT-Transcribe: qué debe volver a validar un equipo antes de sustituir su transcriptor
NOTICIA

GPT-Transcribe: qué debe volver a validar un equipo antes de sustituir su transcriptor

GPT-Transcribe figura como un modelo de transcripción disponible a través de la API de OpenAI. Antes de reemplazar un sistema ASR existente, conviene validar no solo el texto resultante, sino también el contrato técnico que sostiene buscadores, resúmenes, alertas, citas, revisiones y registros de cumplimiento.

22 sep. 2026
BenchCAD: qué demuestra reconstruir una pieza mecánica ejecutable y qué no prueba sobre diseño industrial
ANALISIS

BenchCAD: qué demuestra reconstruir una pieza mecánica ejecutable y qué no prueba sobre diseño industrial

BenchCAD 1.0 mide si un sistema puede generar, modificar o interpretar programas CadQuery cuya geometría se puede ejecutar y comparar con una referencia. Es una señal útil sobre reconstrucción paramétrica, pero no sustituye la validación de tolerancias, función, fabricación ni integración en un flujo de ingeniería.

22 sep. 2026
04 / FUENTES

Trazabilidad