Utilisation principale déclarée ou déduite avec prudence de la documentation officielle.
Voxtral TTS
Modèle de synthèse vocale multilingue avec streaming et clonage zero-shot à partir d’une référence vocale.
L'essentiel
Capacité d'entrée maximale une fois publiée par la source.
Limite de génération maximale documentée.
Canaux de disponibilité vérifiés.
Famille fonctionnelle principale et spécialités vérifiées.
Conditions déclarées pour l’API, les poids ou l’auto-hébergement.
Limites et intégration
| ID d’API | voxtral-mini-tts-2603 |
|---|---|
| Type de modèle | Voix et audio |
| Mode d’accès | API et poids ouverts |
| Licence | CC BY-NC 4.0 |
| Déploiement | API ou local avec restrictions de licence |
| Lancement | 23 MAR 2026 |
| Date limite des connaissances | Non publié |
| Entrée | Texte · Audio de référence |
| Sortie | Audio |
| Fenêtre contextuelle | Texte et référence vocale |
| puissance maximale | Audio en streaming |
| Raisonnement | Non applicable ou non publié |
| Outils publiés | |
| Sorties structurées | Non applicable ou non publié |
| Traitement par lots | Non publié |
| Cache de prompts | Non publié |
| Ajustement fin | Poids téléchargeables |
| Plateformes vérifiées | API Mistral |
Narration, prototypes vocaux et synthèse multilingue.
La licence est non commerciale ; vérifiez le consentement et les droits vocaux avant de cloner.
Ce qu’il peut faire
Orientation
Narration, prototypes vocaux et synthèse multilingue.
Contexte
Texte et référence vocale · Audio en streaming
Outils et intégration
Non publié
Accès
API Mistral et poids
Coût documenté
| Concept | Valeur | Unité/état |
|---|---|---|
| Entrée standard | Non publié | Tarif API standard |
| Entrée en cache | Non publié | Lecture de préfixes réutilisés |
| Écriture ou stockage de cache | Non publié | La condition varie selon le fournisseur |
| Sortie standard | Non publié | Peut inclure des tokens de raisonnement |
| Entrée par lots | Non publié | Traitement asynchrone |
| Sortie par lots | Non publié | Traitement asynchrone |
Consultez la source primaire : l’unité de facturation dépend du type de modèle et du canal d’accès.
i Les prix changent et peuvent dépendre du niveau, de la région ou de la durée du contexte. Vérifiez la source avant de prendre une décision.
Comment lire les résultats
Un benchmark public fournit une orientation, mais ne remplace pas une évaluation avec vos données, outils, budget et tolérance à l’erreur.
| Benchmark | Résultat | Métrique | Source |
|---|---|---|---|
| Evaluaciones Voxtral TTS | ~90 ms | Temps jusqu’au premier audio publié | Voir la source ↗ |
Inferama ne met en évidence un « meilleur résultat » que lorsque la métrique, l'ensemble de test, la configuration et la date permettent une comparaison équivalente. Les chiffres du fournisseur sont présentés comme des affirmations provenant de sa propre source.
Chronologie
Voxtral TTS
Version intégrée au catalogue vérifié d’Inferama.
Analyses connexes
Voxtral TTS : ce qu’une équipe doit valider avant de remplacer une voix synthétique en production
Mistral AI documente Voxtral TTS comme un service de génération vocale avec streaming et plusieurs formats de sortie. Avant de remplacer un fournisseur ou un modèle pour des appels, des notifications ou du contenu publié, une équipe doit vérifier non seulement la qualité audible, mais aussi la compatibilité du contrat technique, opérationnel et de données, au moyen d’une régression fondée sur ses propres scripts.
22 sept. 2026 ↗ GUIAVoix synthétiques en production : démontrer le consentement, contrôler la ressemblance et retirer une voix sans perdre la traçabilité
Utiliser une voix synthétique de manière responsable exige davantage qu’une case à cocher ou une démonstration convaincante. Ce guide propose un système opérationnel pour relier chaque audio à une autorisation précise, maîtriser le risque de ressemblance avec des personnes identifiables, informer lorsque cela est nécessaire et retirer des actifs lorsque les conditions d’utilisation évoluent.
22 sept. 2026 ↗