Utilisation principale déclarée ou déduite avec prudence de la documentation officielle.
gpt‑oss‑120b
Modèle de raisonnement à poids ouverts pour une exécution locale ou privée ; il tient sur un GPU H100 selon OpenAI.
L'essentiel
Capacité d'entrée maximale une fois publiée par la source.
Limite de génération maximale documentée.
Canaux de disponibilité vérifiés.
Famille fonctionnelle principale et spécialités vérifiées.
Conditions déclarées pour l’API, les poids ou l’auto-hébergement.
Limites et intégration
| ID d’API | gpt-oss-120b |
|---|---|
| Type de modèle | Texte et raisonnement · Code |
| Mode d’accès | Poids ouverts |
| Licence | Apache 2.0 |
| Déploiement | Local, cloud privé ou fournisseur |
| Lancement | AGO 2025 |
| Date limite des connaissances | Non publié |
| Entrée | Texte |
| Sortie | Texte |
| Fenêtre contextuelle | 131.072 tokens |
| puissance maximale | Non publié |
| Raisonnement | Raisonnement ajustable |
| Outils publiés | |
| Sorties structurées | Non applicable ou non publié |
| Traitement par lots | Non publié |
| Cache de prompts | Non publié |
| Ajustement fin | Poids téléchargeables |
| Plateformes vérifiées | Hugging Face · Proveedores de inferencia |
Raisonnement privé, personnalisation et déploiements nécessitant un contrôle de l’infrastructure.
Exige son propre matériel et son exploitation ; les performances dépendent du runtime et de la quantification.
Ce qu’il peut faire
Orientation
Raisonnement privé, personnalisation et déploiements nécessitant un contrôle de l’infrastructure.
Contexte
131.072 tokens · Non publié
Outils et intégration
Non publié
Accès
Téléchargement des poids
Coût documenté
| Concept | Valeur | Unité/état |
|---|---|---|
| Entrée standard | Non publié | Tarif API standard |
| Entrée en cache | Non publié | Lecture de préfixes réutilisés |
| Écriture ou stockage de cache | Non publié | La condition varie selon le fournisseur |
| Sortie standard | Non publié | Peut inclure des tokens de raisonnement |
| Entrée par lots | Non publié | Traitement asynchrone |
| Sortie par lots | Non publié | Traitement asynchrone |
Consultez la source primaire : l’unité de facturation dépend du type de modèle et du canal d’accès.
i Les prix changent et peuvent dépendre du niveau, de la région ou de la durée du contexte. Vérifiez la source avant de prendre une décision.
Comment lire les résultats
Un benchmark public fournit une orientation, mais ne remplace pas une évaluation avec vos données, outils, budget et tolérance à l’erreur.
| Benchmark | Résultat | Métrique | Source |
|---|---|---|---|
| Evaluaciones gpt‑oss | Niveau o4-mini publié | Raisonnement général | Voir la source ↗ |
Inferama ne met en évidence un « meilleur résultat » que lorsque la métrique, l'ensemble de test, la configuration et la date permettent une comparaison équivalente. Les chiffres du fournisseur sont présentés comme des affirmations provenant de sa propre source.
Chronologie
gpt‑oss‑120b
Version intégrée au catalogue vérifié d’Inferama.