Uso principal declarado o inferido con cautela desde la documentación oficial.
GPT‑5.6 Sol
Trabajo complejo, código y agentes con herramientas.
Lo esencial
Capacidad máxima de entrada cuando la fuente la publica.
Límite máximo de generación documentado.
Canales de disponibilidad verificados.
Familia funcional principal y especialidades verificadas.
Condiciones declaradas para API, pesos o despliegue propio.
Límites e integración
| ID de API | gpt-5.6-sol |
|---|---|
| Tipo de modelo | Texto y razonamiento |
| Modelo de acceso | Propietario de pago |
| Licencia | Propietaria |
| Despliegue | API alojada |
| Lanzamiento | JUL 2026 |
| Corte de conocimiento | 16 FEB 2026 |
| Entrada | Texto · Imagen |
| Salida | Texto |
| Ventana de contexto | 1.050.000 tokens |
| Salida máxima | 128.000 tokens |
| Razonamiento | Esfuerzo none, low, medium, high, xhigh y max |
| Herramientas publicadas | Funciones · Búsqueda web · Búsqueda en archivos · Uso de ordenador |
| Salidas estructuradas | Compatible |
| Procesamiento por lotes | Compatible · 50 % de descuento |
| Caché de prompts | Compatible · 90 % de descuento en lecturas |
| Ajuste fino | No publicado |
| Plataformas verificadas | OpenAI API |
Trabajo complejo, código y agentes con herramientas.
El coste y el rendimiento dependen del nivel de razonamiento.
Qué puede hacer
Orientación
Trabajo complejo, código y agentes con herramientas.
Contexto
1.050.000 tokens · 128.000 tokens
Herramientas e integración
Funciones · Búsqueda web · Búsqueda en archivos · Uso de ordenador
Acceso
OpenAI API · Responses y Chat Completions
Coste documentado
| Concepto | Valor | Unidad / condición |
|---|---|---|
| Entrada estándar | 4,00 USD / 1 M tokens | Tarifa estándar de API |
| Entrada en caché | 0,40 USD / 1 M tokens | Lectura de prefijos reutilizados |
| Escritura o almacenamiento de caché | 5,00 USD / 1 M tokens | La condición varía según proveedor |
| Salida estándar | 20,00 USD / 1 M tokens | Puede incluir tokens de razonamiento |
| Entrada por lotes | 2,00 USD / 1 M tokens | Procesamiento asíncrono |
| Salida por lotes | 10,00 USD / 1 M tokens | Procesamiento asíncrono |
Consulta la fuente primaria antes de presupuestar un despliegue.
i Los precios cambian y pueden depender del nivel, la región o la longitud del contexto. Revisa la fuente antes de tomar una decisión.
Cómo leer los resultados
Un benchmark público orienta, pero no sustituye una evaluación con tus datos, herramientas, presupuesto y tolerancia al error.
| Benchmark | Resultado | Métrica | Fuente |
|---|---|---|---|
| Agents' Last Exam | 52,7 % | Exactitud | Ver fuente ↗ |
| SWE-Bench Pro | 64,6 % | Resuelto | Ver fuente ↗ |
| Terminal-Bench 2.1 | 88,8 % | Exactitud | Ver fuente ↗ |
Inferama solo destaca un «mejor resultado» cuando la métrica, el conjunto de prueba, la configuración y la fecha permiten una comparación equivalente. Las cifras del proveedor se presentan como afirmaciones de su propia fuente.
Cronología
GPT‑5.6 Sol
Versión incorporada al catálogo verificado de Inferama.
Análisis relacionados
AutomationBench: qué demuestra un agente que deja un flujo empresarial en el estado correcto —y qué no
AutomationBench evalúa si un agente puede completar flujos entre aplicaciones SaaS simuladas y llevarlos a un estado final verificable. Esta guía explica qué significa esa evidencia, cómo leer sus métricas y qué pruebas adicionales hacen falta antes de extrapolar un resultado a una empresa real.
22 sep. 2026 ↗ PAPERAgents’ Last Exam: qué mide un agente de trabajo real y por qué su tasa de éxito no equivale a «automatizar un empleo»
Agents’ Last Exam evalúa agentes en tareas profesionales dentro de entornos de sistema operativo y con resultados verificables. Su diseño es útil para estudiar la ejecución de flujos de trabajo, pero una cifra agregada de éxito no demuestra que un empleo pueda automatizarse. Para interpretarla hacen falta detalles sobre las tareas, el entorno, el arnés, el modelo, las herramientas, el presupuesto y la versión evaluada.
22 sep. 2026 ↗