Uso primario dichiarato o dedotto con cautela dalla documentazione ufficiale.
Voxtral TTS
Modello multilingue di sintesi vocale con streaming e clonazione zero-shot a partire da un riferimento vocale.
L'essenziale
Capacità di input massima quando pubblicata dalla fonte.
Limite massimo di generazione documentato.
Canali di disponibilità verificati.
Famiglia funzionale principale e specialità verificate.
Condizioni dichiarate per API, pesi o distribuzione autonoma.
Limiti e integrazione
| ID API | voxtral-mini-tts-2603 |
|---|---|
| Tipo di modello | Voce e audio |
| Modalità di accesso | API e pesi aperti |
| Licenza | CC BY-NC 4.0 |
| Distribuzione | API o locale con restrizioni di licenza |
| Rilascio | 23 MAR 2026 |
| Cutoff della conoscenza | Non pubblicato |
| Entrata | Testo · Audio di riferimento |
| Uscita | Audio |
| Finestra di contesto | Testo e riferimento vocale |
| rendimento massimo | Audio in streaming |
| Ragionamento | Non applicabile o non pubblicato |
| Strumenti pubblicati | |
| Uscite strutturate | Non applicabile o non pubblicato |
| Elaborazione batch | Non pubblicato |
| Cache dei prompt | Non pubblicato |
| Fine-tuning | Pesi scaricabili |
| Piattaforme verificate | Mistral API |
Narrazione, prototipi vocali e sintesi multilingue.
La licenza è non commerciale; verifica consenso e diritti vocali prima di clonare.
Cosa può fare
Orientamento
Narrazione, prototipi vocali e sintesi multilingue.
Contesto
Testo e riferimento vocale · Audio in streaming
Strumenti e integrazione
Non pubblicato
Accesso
Mistral API e pesi
Costo documentato
| Concetto | Di valore | Unità/condizione |
|---|---|---|
| Input standard | Non pubblicato | Tariffa API standard |
| Input in cache | Non pubblicato | Lettura di prefissi riutilizzati |
| Scrittura o archiviazione della cache | Non pubblicato | La condizione varia in base al fornitore |
| Output standard | Non pubblicato | Può includere token di ragionamento |
| Input batch | Non pubblicato | Elaborazione asincrona |
| Output batch | Non pubblicato | Elaborazione asincrona |
Consulta la fonte primaria: l'unità di fatturazione dipende dal tipo di modello e dal canale di accesso.
i I prezzi cambiano e possono dipendere dal livello, dalla regione o dalla durata del contesto. Controlla la fonte prima di prendere una decisione.
Come leggere i risultati
Un benchmark pubblico orienta, ma non sostituisce una valutazione con i tuoi dati, strumenti, budget e tolleranza all'errore.
| Benchmark | Risultato | Metrica | Fonte |
|---|---|---|---|
| Evaluaciones Voxtral TTS | ~90 ms | Tempo al primo audio pubblicato | Vedi fonte ↗ |
Inferama evidenzia un "miglior risultato" solo quando la metrica, il set di test, la configurazione e la data consentono un confronto equivalente. I dati del fornitore sono presentati come affermazioni provenienti dalla propria fonte.
Cronologia
Voxtral TTS
Versione inclusa nel catalogo verificato di Inferama.
Analisi correlate
Voxtral TTS: cosa deve verificare un team prima di sostituire una voce sintetica in produzione
Mistral AI documenta Voxtral TTS come servizio di generazione vocale con streaming e diversi formati di output. Prima di sostituire un fornitore o un modello nelle chiamate, negli avvisi o nei contenuti pubblicati, un team deve verificare non solo la qualità percepibile, ma anche la compatibilità del contratto tecnico, operativo e dei dati attraverso una regressione basata sui propri copioni.
22 set 2026 ↗ GUIAVoci sintetiche in produzione: come dimostrare il consenso, controllare la somiglianza e ritirare una voce senza perdere la tracciabilità
Usare una voce sintetica in modo responsabile richiede più di una casella di accettazione o di una demo convincente. Questa guida propone un sistema operativo per collegare ogni audio a un'autorizzazione specifica, controllare il rischio di somiglianza con persone identificabili, informare quando necessario e ritirare gli asset quando cambiano le condizioni d'uso.
22 set 2026 ↗