Opções de voz
Encontre o fluxo de trabalho de texto para voz do Google ideal
Texto para voz do Google pode significar uma prévia rápida em áudio ou um arquivo de áudio para um projeto. A melhor opção depende de você querer ouvir agora, salvar o resultado ou controlar a voz.
Uma escolha antes de começar
Decida se você precisa de uma prévia para ouvir ou de uma gravação reutilizável. Essa distinção importa mais do que o nome da ferramenta.
Como o texto chega aos seus ouvidos
Estas três etapas explicam o funcionamento básico, seja quando um serviço reproduz a fala imediatamente, seja quando fornece áudio para outro aplicativo.
-
1
Prepare um trecho curto
Comece com as palavras exatas que você quer que sejam faladas. Escreva por extenso as abreviações que possam ser lidas incorretamente, adicione pontuação onde deve haver uma pausa e divida um roteiro longo em trechos menores. Um texto claro ajuda um sistema de texto para voz a produzir uma leitura mais previsível.
-
2
Escolha como ouvir o áudio
Para conferir rapidamente uma pronúncia, cole o texto no Google Tradutor e use o controle de áudio, quando disponível. Para gerar áudio por programação, o Google Cloud Text-to-Speech usa uma solicitação de API com idioma e voz selecionados. Uma ferramenta de texto para voz no navegador é outra opção se você prefere um editor direto.
-
3
Ouça, revise e use
Ouça o resultado até o fim. Nomes, números e grafias incomuns merecem uma segunda conferida. Se o áudio for para um vídeo ou uma apresentação, verifique se a opção escolhida realmente fornece um arquivo de áudio; ouvir uma prévia não significa que você pode exportá-la.
Qual é a diferença entre as opções do Google?
A opção mais adequada depende do que você precisa fazer depois de ouvir. São produtos diferentes do Google, não dois modos do mesmo editor de texto para voz.
- Recurso de áudio do Google Tradutor
- Google Cloud Text-to-Speech
Objetivo principal
Ouvir no Google Tradutor
Ouça o texto digitado ou traduzido como um recurso rápido de apoio à compreensão auditiva.
Google Cloud Text-to-Speech
Gere fala para um aplicativo por meio de um serviço voltado a desenvolvedores.
Como começar
Ouvir no Google Tradutor
Digite o texto na interface do Tradutor e use o controle de reprodução quando ele aparecer.
Google Cloud Text-to-Speech
Configure um projeto no Cloud e envie uma solicitação de síntese pela API.
Seleção de voz
Ouvir no Google Tradutor
A interface oferece controle direto limitado sobre a voz usada na reprodução.
Google Cloud Text-to-Speech
As solicitações podem especificar uma voz disponível e um idioma.
Saída de áudio
Ouvir no Google Tradutor
Projetado para reprodução na interface, não como um fluxo de trabalho de exportação de áudio de uso geral.
Google Cloud Text-to-Speech
Retorna dados de áudio sintetizado que um aplicativo pode salvar ou processar.
Uso mais indicado
Ouvir no Google Tradutor
Conferir como soa uma palavra ou um trecho curto.
Google Cloud Text-to-Speech
Incorporar saída de voz a um software ou produzir áudio por meio de um fluxo de trabalho configurado.
Principal vantagem
Ouvir no Google Tradutor
A disponibilidade e o funcionamento da reprodução podem variar conforme o idioma, o dispositivo e a interface.
Google Cloud Text-to-Speech
Exige configuração técnica; as vozes e os recursos disponíveis dependem da configuração escolhida.
Saiba o que você precisa do resultado
Experimente um fluxo direto de geração de voz
Se você quer um áudio falado, e não uma prévia de tradução ou uma integração com API, comece pelo roteiro e ouça o resultado com atenção antes de usá-lo. O Texttovoice oferece uma forma direta de experimentar esse fluxo de texto para voz; confira as opções de saída disponíveis para a sua tarefa.
Experimente gerar voz- Escreva para quem vai ouvir, não apenas para quem vai ler.
- Confira nomes e números na reprodução.
- Confirme se o resultado é adequado ao uso pretendido.
Dúvidas sobre as ferramentas de voz do Google
Não. O controle de reprodução do Tradutor é útil para ouvir um texto digitado ou traduzido, enquanto o Cloud Text-to-Speech é um serviço voltado a desenvolvedores para gerar voz por meio de uma API. Escolha conforme você precise ouvir algo rapidamente ou gerar áudio para um aplicativo.
O Tradutor é, principalmente, uma interface para ouvir textos. Por isso, não presuma que o controle de reprodução ofereça uma gravação para download. Se um arquivo de áudio for indispensável, escolha um fluxo que permita explicitamente gerar e salvar um.
Você não precisa programar para usar um controle de reprodução em uma interface disponível do Google. O Google Cloud Text-to-Speech é diferente: ele foi criado para aplicativos configurados e solicitações de API. Um editor direto de texto para voz pode ser mais fácil para um texto pontual.
A geração de voz interpreta o texto escrito. Por isso, uma abreviação, um nome desconhecido ou uma sequência de dígitos pode ter mais de uma leitura plausível. Escreva a pronúncia desejada por extenso quando possível, ajuste a pontuação e ouça novamente antes de usar o áudio.
Não necessariamente. As opções de voz dependem do idioma e do produto ou da configuração do Google que você usa. Confira as opções disponíveis para o seu idioma antes de planejar um projeto multilíngue.