Laboratório
Entidade que desenvolve ou publica o modelo e mantém a respetiva documentação técnica e de segurança.
Consulte os modelos documentados, as avaliações publicadas e as fontes primárias associadas a esta organização.
Modelo expressivo de texto para voz com etiquetas emocionais, diálogo entre vários oradores e suporte para mais de 70 idiomas.
18 SET 2026↗ TRANSCRIÇÃO MULTILINGUEModelo de reconhecimento de voz para mais de 90 idiomas, com diarização, tempos por palavra, entidades e etiquetas de áudio.
18 SET 2026↗ SÍNTESE DE VOZ EXPRESSIVAModelo de síntese de voz expressiva para narração, personagens e diálogo em mais de 90 idiomas.
29 SET 2026↗ SÍNTESE DE VOZ DE BAIXA LATÊNCIAVariante do Eleven v4 otimizada para agentes de voz e respostas expressivas em tempo real.
29 SET 2026↗Os números são apresentados com o contexto comunicado pela fonte. Um resultado do fornecedor não equivale a uma comparação independente nem substitui uma avaliação própria.
| Modelo | Benchmark | Resultado | Métrica |
|---|---|---|---|
| Eleven v3 | Evaluación Eleven v3 | 70+ idiomas | Cobertura e expressividade publicadas |
| Scribe v2 | Evaluación Scribe v2 | 90+ idiomas | Cobertura ASR publicada |
Uma organização, um produto e um modelo não são a mesma unidade. A Inferama separa-os para evitar atribuir capacidades ou condições comerciais ao elemento errado.
Entidade que desenvolve ou publica o modelo e mantém a respetiva documentação técnica e de segurança.
Versão identificável com limites, modalidades e comportamento que podem mudar entre lançamentos.
API, aplicação, nuvem associada ou plano comercial; cada canal pode ter preços, retenção e limites distintos.
Cada afirmação deve conservar a página oficial consultada e a data de verificação.
A documentação fornecida associa o Eleven v3 à geração de voz multilíngue, mas não basta para confirmar um número específico de idiomas nem a qualidade de uma localização. Analisamos o que tem respaldo e propomos verificações a fazer antes de o integrar na produção.
29 set 2026 ↗ ANALISISUma pontuação de WER, por si só, não descreve o desempenho geral de um sistema de transcrição. Analisamos o que é possível verificar sobre o Scribe v2, como o corpus, a normalização e a configuração afetam os resultados e quais informações são necessárias para repetir uma comparação.
28 set 2026 ↗ ANALISISUm protocolo para verificar, com vozes e guiões controlados, se uma indicação de interpretação altera a entrega sem prejudicar a fidelidade ao texto, a identidade vocal ou a repetibilidade. A documentação disponível não permite confirmar aqui quais são as etiquetas específicas do Eleven v3: o primeiro passo é verificar o que é aceite no acesso que será testado.
28 set 2026 ↗ COMPARATIVAUma cadeia modular com reconhecimento de voz, DeepSeek V4.1 Flash e Eleven v3 não equivale a um modelo de voz full-duplex. Este guia propõe comparar os dois sistemas de ponta a ponta, sem antecipar um vencedor com base em especificações isoladas.
26 set 2026 ↗ NOTICIAA Mistral AI documenta o Voxtral TTS como um serviço de geração de voz com streaming e vários formatos de saída. Antes de substituir um fornecedor ou modelo em chamadas, avisos ou conteúdo publicado, uma equipa deve verificar não só a qualidade audível, mas também a compatibilidade do contrato técnico, operacional e de dados através de uma regressão com os seus próprios guiões.
22 set 2026 ↗ NOTICIAO GPT-Transcribe é apresentado como um modelo de transcrição disponível através da API da OpenAI. Antes de substituir um sistema ASR existente, convém validar não apenas o texto resultante, mas também o contrato técnico que sustenta pesquisas, resumos, alertas, citações, revisões e registos de conformidade.
22 set 2026 ↗