Utilisation principale déclarée ou déduite avec prudence de la documentation officielle.
Cohere Embed 4
Modèle d’embeddings multimodaux pour le texte, les images et les documents mixtes avec des dimensions configurables.
L'essentiel
Capacité d'entrée maximale une fois publiée par la source.
Limite de génération maximale documentée.
Canaux de disponibilité vérifiés.
Famille fonctionnelle principale et spécialités vérifiées.
Conditions déclarées pour l’API, les poids ou l’auto-hébergement.
Limites et intégration
| ID d’API | embed-v4.0 |
|---|---|
| Type de modèle | Plongements · Vision et documents |
| Mode d’accès | Propriétaire payant |
| Licence | Propriétaire |
| Déploiement | API hébergée |
| Lancement | 2025 |
| Date limite des connaissances | Non publié |
| Entrée | Texte · Image · PDF |
| Sortie | Vecteur |
| Fenêtre contextuelle | 128 000 tokens |
| puissance maximale | 256, 512, 1.024 ou 1.536 dimensions |
| Raisonnement | Non applicable ou non publié |
| Outils publiés | |
| Sorties structurées | Non applicable ou non publié |
| Traitement par lots | Non publié |
| Cache de prompts | Non publié |
| Ajustement fin | Non publié |
| Plateformes vérifiées | Cohere API · Nube privada |
RAG d’entreprise, recherche de documents visuels et récupération multilingue.
Mesurez le rappel avec vos documents et l’impact des dimensions, du stockage et de la réindexation.
Ce qu’il peut faire
Orientation
RAG d’entreprise, recherche de documents visuels et récupération multilingue.
Contexte
128.000 tokens · 256, 512, 1.024 ou 1.536 dimensions
Outils et intégration
Non publié
Accès
API Cohere et déploiement privé
Coût documenté
| Concept | Valeur | Unité/état |
|---|---|---|
| Entrée standard | Non publié | Tarif API standard |
| Entrée en cache | Non publié | Lecture de préfixes réutilisés |
| Écriture ou stockage de cache | Non publié | La condition varie selon le fournisseur |
| Sortie standard | Non publié | Peut inclure des tokens de raisonnement |
| Entrée par lots | Non publié | Traitement asynchrone |
| Sortie par lots | Non publié | Traitement asynchrone |
Consultez la source primaire : l’unité de facturation dépend du type de modèle et du canal d’accès.
i Les prix changent et peuvent dépendre du niveau, de la région ou de la durée du contexte. Vérifiez la source avant de prendre une décision.
Comment lire les résultats
Un benchmark public fournit une orientation, mais ne remplace pas une évaluation avec vos données, outils, budget et tolérance à l’erreur.
| Benchmark | Résultat | Métrique | Source |
|---|---|---|---|
| Evaluaciones Embed 4 | Publiées | Récupération multimodale | Voir la source ↗ |
Inferama ne met en évidence un « meilleur résultat » que lorsque la métrique, l'ensemble de test, la configuration et la date permettent une comparaison équivalente. Les chiffres du fournisseur sont présentés comme des affirmations provenant de sa propre source.
Chronologie
Cohere Embed 4
Version intégrée au catalogue vérifié d’Inferama.
Analyses connexes
Cohere Embed 4 : migrer un index multimodal sans mélanger les espaces vectoriels
Embed 4 permet de générer des représentations pour le texte, les images et les entrées mixtes. Mais l’intégrer à un index existant suppose de recalculer et de valider les vecteurs, les requêtes et la configuration : ses spécifications ne prouvent pas, à elles seules, que la récupération s’améliorera sur un corpus donné.
25 sept. 2026 ↗ COMPARATIVAClaude Sonnet 5 et Cohere Embed 4 en RAG multimodal : comment distinguer une défaillance de récupération d’une défaillance de réponse
Claude Sonnet 5 et Cohere Embed 4 interviennent à des couches différentes d’un système RAG multimodal. Ce guide propose une expérience factorielle, sur un corpus et des conditions figés, afin de mesurer séparément si les bonnes preuves ont été récupérées et si la réponse les exploite fidèlement.
22 sept. 2026 ↗