M
MISTRAL AI / voxtral-mini-tts-2603

Voxtral TTS

Modello multilingue di sintesi vocale con streaming e clonazione zero-shot a partire da un riferimento vocale.

01 / RIEPILOGO

L'essenziale

ORIENTAMENTOSintesi vocale e clonazione

Uso primario dichiarato o dedotto con cautela dalla documentazione ufficiale.

CONTESTOTesto e riferimento vocale

Capacità di input massima quando pubblicata dalla fonte.

USCITAAudio in streaming

Limite massimo di generazione documentato.

ACCESSOMistral API e pesi

Canali di disponibilità verificati.

TIPO DI MODELLOVoce e audio

Famiglia funzionale principale e specialità verificate.

LICENZACC BY-NC 4.0

Condizioni dichiarate per API, pesi o distribuzione autonoma.

02 / SCHEDA TECNICA

Limiti e integrazione

ID APIvoxtral-mini-tts-2603
Tipo di modelloVoce e audio
Modalità di accessoAPI e pesi aperti
LicenzaCC BY-NC 4.0
DistribuzioneAPI o locale con restrizioni di licenza
Rilascio23 MAR 2026
Cutoff della conoscenzaNon pubblicato
EntrataTesto · Audio di riferimento
UscitaAudio
Finestra di contestoTesto e riferimento vocale
rendimento massimoAudio in streaming
RagionamentoNon applicabile o non pubblicato
Strumenti pubblicati
Uscite strutturateNon applicabile o non pubblicato
Elaborazione batchNon pubblicato
Cache dei promptNon pubblicato
Fine-tuningPesi scaricabili
Piattaforme verificateMistral API
SI ADATTA MEGLIO A

Narrazione, prototipi vocali e sintesi multilingue.

DA MONITORARE

La licenza è non commerciale; verifica consenso e diritti vocali prima di clonare.

03 / CAPACITÀ

Cosa può fare

01

Orientamento

Narrazione, prototipi vocali e sintesi multilingue.

02

Contesto

Testo e riferimento vocale · Audio in streaming

03

Strumenti e integrazione

Non pubblicato

04

Accesso

Mistral API e pesi

Modalità di input
TestoAudio di riferimento
04 / PREZZI

Costo documentato

ConcettoDi valoreUnità/condizione
Input standardNon pubblicatoTariffa API standard
Input in cacheNon pubblicatoLettura di prefissi riutilizzati
Scrittura o archiviazione della cacheNon pubblicatoLa condizione varia in base al fornitore
Output standardNon pubblicatoPuò includere token di ragionamento
Input batchNon pubblicatoElaborazione asincrona
Output batchNon pubblicatoElaborazione asincrona

Consulta la fonte primaria: l'unità di fatturazione dipende dal tipo di modello e dal canale di accesso.

i I prezzi cambiano e possono dipendere dal livello, dalla regione o dalla durata del contesto. Controlla la fonte prima di prendere una decisione.

05 / VALUTAZIONI

Come leggere i risultati

“

Un benchmark pubblico orienta, ma non sostituisce una valutazione con i tuoi dati, strumenti, budget e tolleranza all'errore.

BenchmarkRisultatoMetricaFonte
Evaluaciones Voxtral TTS~90 msTempo al primo audio pubblicatoVedi fonte ↗

Inferama evidenzia un "miglior risultato" solo quando la metrica, il set di test, la configurazione e la data consentono un confronto equivalente. I dati del fornitore sono presentati come affermazioni provenienti dalla propria fonte.

06 / VERSIONI

Cronologia

Voxtral TTS

Versione inclusa nel catalogo verificato di Inferama.

ANALISI

Analisi correlate

07 / FONTI

Tracciabilità