Utilisation principale déclarée ou déduite avec prudence de la documentation officielle.
GPT‑5.6 Sol
Travail complexe, code et agents utilisant des outils.
L'essentiel
Capacité d'entrée maximale une fois publiée par la source.
Limite de génération maximale documentée.
Canaux de disponibilité vérifiés.
Famille fonctionnelle principale et spécialités vérifiées.
Conditions déclarées pour l’API, les poids ou l’auto-hébergement.
Limites et intégration
| ID d’API | gpt-5.6-sol |
|---|---|
| Type de modèle | Texte et raisonnement |
| Mode d’accès | Propriétaire payant |
| Licence | Propriétaire |
| Déploiement | API hébergée |
| Lancement | JUIL 2026 |
| Date limite des connaissances | 16 FÉV 2026 |
| Entrée | Texte · Image |
| Sortie | Texte |
| Fenêtre contextuelle | 1 050 000 tokens |
| puissance maximale | 128 000 tokens |
| Raisonnement | Niveau d’effort none, low, medium, high, xhigh et max |
| Outils publiés | Fonctions · Recherche web · Recherche dans les fichiers · Utilisation d’ordinateur |
| Sorties structurées | Pris en charge |
| Traitement par lots | Compatible · 50 % de réduction |
| Cache de prompts | Compatible · 90 % de réduction sur les lectures |
| Ajustement fin | Non publié |
| Plateformes vérifiées | API OpenAI |
Travail complexe, code et agents utilisant des outils.
Le coût et les performances dépendent du niveau de raisonnement.
Ce qu’il peut faire
Orientation
Travail complexe, code et agents utilisant des outils.
Contexte
1.050.000 tokens · 128.000 tokens
Outils et intégration
Fonctionnalités · Recherche web · Recherche dans les fichiers · Utilisation d’ordinateur
Accès
OpenAI API · Responses et Chat Completions
Coût documenté
| Concept | Valeur | Unité/état |
|---|---|---|
| Entrée standard | 4,00 USD / 1 M tokens | Tarif API standard |
| Entrée en cache | 0,40 USD / 1 M tokens | Lecture de préfixes réutilisés |
| Écriture ou stockage de cache | 5,00 USD / 1 M tokens | La condition varie selon le fournisseur |
| Sortie standard | 20,00 USD / 1 M tokens | Peut inclure des tokens de raisonnement |
| Entrée par lots | 2,00 USD / 1 M tokens | Traitement asynchrone |
| Sortie par lots | 10,00 USD / 1 M tokens | Traitement asynchrone |
Consultez la source primaire avant de budgétiser un déploiement.
i Les prix changent et peuvent dépendre du niveau, de la région ou de la durée du contexte. Vérifiez la source avant de prendre une décision.
Comment lire les résultats
Un benchmark public fournit une orientation, mais ne remplace pas une évaluation avec vos données, outils, budget et tolérance à l’erreur.
| Benchmark | Résultat | Métrique | Source |
|---|---|---|---|
| Agents' Last Exam | 52,7 % | Exactitude | Voir la source ↗ |
| SWE-Bench Pro | 64,6 % | Résolu | Voir la source ↗ |
| Terminal-Bench 2.1 | 88,8 % | Exactitude | Voir la source ↗ |
Inferama ne met en évidence un « meilleur résultat » que lorsque la métrique, l'ensemble de test, la configuration et la date permettent une comparaison équivalente. Les chiffres du fournisseur sont présentés comme des affirmations provenant de sa propre source.
Chronologie
GPT‑5.6 Sol
Version intégrée au catalogue vérifié d’Inferama.
Analyses connexes
AutomationBench : ce que prouve un agent qui place un workflow métier dans le bon état — et ce que cela ne prouve pas
AutomationBench évalue la capacité d’un agent à mener à bien des workflows entre applications SaaS simulées et à les amener à un état final vérifiable. Ce guide explique ce que cette preuve signifie, comment lire ses métriques et quels tests supplémentaires sont nécessaires avant d’extrapoler un résultat à une entreprise réelle.
22 sept. 2026 ↗ PAPERAgents’ Last Exam : ce que mesure un agent de travail réel et pourquoi son taux de réussite ne signifie pas « automatiser un emploi »
Agents’ Last Exam évalue des agents sur des tâches professionnelles dans des environnements de système d’exploitation, avec des résultats vérifiables. Sa conception est utile pour étudier l’exécution de flux de travail, mais un chiffre agrégé de réussite ne démontre pas qu’un emploi peut être automatisé. Pour l’interpréter, il faut connaître les tâches, l’environnement, le harness, le modèle, les outils, le budget et la version évaluée.
22 sept. 2026 ↗