Uso primário declarado ou inferido com cautela a partir da documentação oficial.
Voxtral TTS
Modelo multilingue de texto para voz com streaming e clonagem zero-shot a partir de uma referência de voz.
O essencial
Capacidade máxima de entrada quando publicada pela fonte.
Limite máximo de geração documentado.
Canais de disponibilidade verificados.
Família funcional principal e especialidades verificadas.
Condições declaradas para API, pesos ou alojamento próprio.
Limites e integração
| ID de API | voxtral-mini-tts-2603 |
|---|---|
| Tipo de modelo | Voz e áudio |
| Modelo de acesso | API e pesos abertos |
| Licença | CC BY-NC 4.0 |
| Implantação | API ou local com restrições de licença |
| Lançamento | 23 MAR 2026 |
| Data de corte do conhecimento | Não publicado |
| Entrada | Texto · Áudio de referência |
| Saída | Áudio |
| Janela de contexto | Texto e referência de voz |
| saída máxima | Áudio em streaming |
| Raciocínio | Não aplicável ou não publicado |
| Ferramentas publicadas | |
| Passeios Estruturados | Não aplicável ou não publicado |
| Processamento em lote | Não publicado |
| Cache de prompts | Não publicado |
| Ajuste fino | Pesos transferíveis |
| Plataformas verificadas | Mistral API |
Narração, protótipos de voz e síntese multilingue.
A licença é não comercial; analisa o consentimento e os direitos de voz antes de clonar.
O que pode fazer
Orientação
Narração, protótipos de voz e síntese multilingue.
Contexto
Texto e referência de voz · Áudio em streaming
Ferramentas e integração
Não publicado
Acesso
Mistral API e pesos
Custo documentado
| Conceito | Valor | Unidade/condição |
|---|---|---|
| Entrada padrão | Não publicado | Tarifa padrão da API |
| Entrada em cache | Não publicado | Leitura de prefixos reutilizados |
| Escrita ou armazenamento em cache | Não publicado | A condição varia consoante o fornecedor |
| Saída padrão | Não publicado | Pode incluir tokens de raciocínio |
| Entrada por lotes | Não publicado | Processamento assíncrono |
| Saída por lotes | Não publicado | Processamento assíncrono |
Consulta a fonte primária: a unidade de faturação depende do tipo de modelo e do canal de acesso.
i Os preços mudam e podem depender do nível, região ou duração do contexto. Verifique a fonte antes de tomar uma decisão.
Como ler os resultados
Um benchmark público orienta, mas não substitui uma avaliação com os teus dados, ferramentas, orçamento e tolerância ao erro.
| Benchmark | Resultado | Métrica | Fonte |
|---|---|---|---|
| Evaluaciones Voxtral TTS | ~90 ms | Tempo até ao primeiro áudio publicado | Ver fonte ↗ |
O Inferama só destaca o “melhor resultado” quando a métrica, o conjunto de testes, a configuração e a data permitem uma comparação equivalente. Os números do fornecedor são apresentados como declarações de sua própria fonte.
Cronologia
Voxtral TTS
Versão incorporada no catálogo verificado da Inferama.
Análises relacionadas
Voxtral TTS: o que uma equipa deve validar antes de substituir uma voz sintética em produção
A Mistral AI documenta o Voxtral TTS como um serviço de geração de voz com streaming e vários formatos de saída. Antes de substituir um fornecedor ou modelo em chamadas, avisos ou conteúdo publicado, uma equipa deve verificar não só a qualidade audível, mas também a compatibilidade do contrato técnico, operacional e de dados através de uma regressão com os seus próprios guiões.
22 set 2026 ↗ GUIAVozes sintéticas em produção: como comprovar o consentimento, controlar a semelhança e retirar uma voz sem perder a rastreabilidade
Usar uma voz sintética de forma responsável exige mais do que uma caixa de aceitação ou uma demonstração convincente. Este guia propõe um sistema operacional para relacionar cada áudio a uma autorização específica, controlar o risco de semelhança com pessoas identificáveis, informar quando necessário e retirar ativos quando as condições de uso mudarem.
22 set 2026 ↗