Utilisation principale déclarée ou déduite avec prudence de la documentation officielle.
Llama 4 Scout
Modèle multimodal de 17B paramètres actifs et 16 experts, conçu pour un contexte allant jusqu’à 10 millions de tokens.
L'essentiel
Capacité d'entrée maximale une fois publiée par la source.
Limite de génération maximale documentée.
Canaux de disponibilité vérifiés.
Famille fonctionnelle principale et spécialités vérifiées.
Conditions déclarées pour l’API, les poids ou l’auto-hébergement.
Limites et intégration
| ID d’API | Llama-4-Scout-17B-16E-Instruct |
|---|---|
| Type de modèle | Texte et raisonnement · Vision et documents |
| Mode d’accès | Poids ouverts |
| Licence | Llama Community License |
| Déploiement | Local, cloud privé ou fournisseur |
| Lancement | 5 AVR 2025 |
| Date limite des connaissances | Non publié |
| Entrée | Texte · Image |
| Sortie | Texte |
| Fenêtre contextuelle | 10.000.000 tokens |
| puissance maximale | Non publié |
| Raisonnement | Non applicable ou non publié |
| Outils publiés | |
| Sorties structurées | Non applicable ou non publié |
| Traitement par lots | Non publié |
| Cache de prompts | Non publié |
| Ajustement fin | Poids téléchargeables |
| Plateformes vérifiées | Meta Llama · Hugging Face · Nubes asociadas |
Contexte très long, documents et vision avec contrôle du déploiement.
La licence n’est pas Apache/MIT et le contexte maximal exige beaucoup de mémoire et des tests de récupération.
Ce qu’il peut faire
Orientation
Contexte très long, documents et vision avec contrôle du déploiement.
Contexte
10.000.000 tokens · Non publié
Outils et intégration
Non publié
Accès
Téléchargement direct et fournisseurs
Coût documenté
| Concept | Valeur | Unité/état |
|---|---|---|
| Entrée standard | Non publié | Tarif API standard |
| Entrée en cache | Non publié | Lecture de préfixes réutilisés |
| Écriture ou stockage de cache | Non publié | La condition varie selon le fournisseur |
| Sortie standard | Non publié | Peut inclure des tokens de raisonnement |
| Entrée par lots | Non publié | Traitement asynchrone |
| Sortie par lots | Non publié | Traitement asynchrone |
Consultez la source primaire : l’unité de facturation dépend du type de modèle et du canal d’accès.
i Les prix changent et peuvent dépendre du niveau, de la région ou de la durée du contexte. Vérifiez la source avant de prendre une décision.
Comment lire les résultats
Un benchmark public fournit une orientation, mais ne remplace pas une évaluation avec vos données, outils, budget et tolérance à l’erreur.
| Benchmark | Résultat | Métrique | Source |
|---|---|---|---|
| Evaluaciones Llama 4 Scout | Leader de sa catégorie | Multimodal et contexte long | Voir la source ↗ |
Inferama ne met en évidence un « meilleur résultat » que lorsque la métrique, l'ensemble de test, la configuration et la date permettent une comparaison équivalente. Les chiffres du fournisseur sont présentés comme des affirmations provenant de sa propre source.
Chronologie
Llama 4 Scout
Version intégrée au catalogue vérifié d’Inferama.