Opciones de voz
Encuentra la forma adecuada de usar el texto a voz de Google
El texto a voz de Google puede servir para escuchar una vista previa rápida o para crear un archivo de audio para un proyecto. La mejor opción depende de si quieres escuchar el resultado ahora, guardarlo o controlar la voz.
Una decisión antes de empezar
Decide si necesitas una vista previa para escuchar o una grabación que puedas reutilizar. Esa diferencia importa más que el nombre de la herramienta.
Cómo llega el texto a tus oídos
Estas tres etapas explican el funcionamiento básico, tanto si un servicio reproduce la voz de inmediato como si entrega audio para otra aplicación.
-
1
Prepara un fragmento breve
Empieza con las palabras exactas que quieres que se pronuncien. Escribe las abreviaturas completas si podrían interpretarse mal, añade puntuación donde deba haber una pausa y divide los guiones largos en fragmentos manejables. Un texto claro ayuda a que un sistema de texto a voz produzca una lectura más predecible.
-
2
Elige cómo escuchar el resultado
Para comprobar rápidamente una pronunciación, pega el texto en Google Translate y usa el control de escucha, si está disponible. Para generar audio mediante programación, Google Cloud Text-to-Speech utiliza una solicitud API con un idioma y una voz seleccionados. Una herramienta de texto a voz en el navegador es otra opción si prefieres un editor directo.
-
3
Escucha, corrige y utiliza el resultado
Escucha el resultado de principio a fin. Los nombres, los números y las grafías poco habituales merecen una segunda escucha. Si lo necesitas para un video o una presentación, comprueba si la opción elegida proporciona un archivo de audio: poder escuchar una vista previa no significa que puedas exportarla.
En qué se diferencian las opciones de Google
La opción más adecuada depende de lo que necesites hacer después de escuchar. Son productos diferentes de Google, no dos modos de un mismo editor de texto a voz.
- Función de escucha de Google Translate
- Google Cloud Text-to-Speech
Propósito principal
Escuchar en Google Translate
Escucha el texto introducido o traducido como ayuda rápida para comprobar cómo suena.
Google Cloud Text-to-Speech
Genera voz para una aplicación mediante un servicio dirigido a desarrolladores.
Cómo empezar
Escuchar en Google Translate
Introduce texto en la interfaz de Google Translate y usa el control de reproducción cuando aparezca.
Google Cloud Text-to-Speech
Configura un proyecto de Cloud y envía una solicitud de síntesis a través de la API.
Selección de voz
Escuchar en Google Translate
La interfaz ofrece un control directo limitado sobre la voz que se escucha.
Google Cloud Text-to-Speech
Las solicitudes pueden especificar una voz y un idioma disponibles.
Salida de audio
Escuchar en Google Translate
Está diseñado para reproducir audio en la interfaz, no para exportarlo de forma general.
Google Cloud Text-to-Speech
Devuelve datos de audio sintetizado que una aplicación puede guardar o procesar.
Uso más adecuado
Escuchar en Google Translate
Comprobar cómo suena una palabra o un fragmento breve.
Google Cloud Text-to-Speech
Incorporar voz a un programa o producir audio mediante un flujo de trabajo configurado.
Ventaja principal
Escuchar en Google Translate
La disponibilidad y el funcionamiento de la reproducción pueden variar según el idioma, el dispositivo y la interfaz.
Google Cloud Text-to-Speech
Requiere configuración técnica; las voces y funciones disponibles dependen de la configuración seleccionada.
Ten claro qué necesitas del resultado
Prueba un flujo directo de generación de voz
Si lo que buscas es un clip hablado, en lugar de una vista previa de traducción o una integración mediante API, empieza por el guion y escucha el resultado con atención antes de usarlo. Texttovoice ofrece un lugar donde probar directamente ese flujo de texto a voz; comprueba las opciones de salida disponibles para tu tarea.
Prueba la generación de voz- Escribe para que se escuche bien, no solo para que se lea bien.
- Comprueba los nombres y números al reproducir el audio.
- Confirma que el resultado sea adecuado para el uso previsto.
Preguntas sobre las herramientas de voz de Google
No. La función de escucha de Translate sirve para oír el texto introducido o traducido, mientras que Cloud Text-to-Speech es un servicio para desarrolladores que genera voz mediante una API. Elige según necesites escuchar el texto rápidamente u obtener audio para una aplicación.
Translate es principalmente una interfaz de escucha, así que no des por hecho que su control de reproducción permite descargar una grabación. Si necesitas un archivo de audio, elige un flujo que permita generarlo y guardarlo explícitamente.
No necesitas código para usar la función de escucha de una interfaz de Google que la ofrezca. Google Cloud Text-to-Speech es diferente: está pensado para aplicaciones configuradas y solicitudes a la API. Un editor directo de texto a voz puede ser más sencillo para un texto puntual.
La generación de voz interpreta el texto escrito, por lo que una abreviatura, un nombre poco conocido o una secuencia de dígitos pueden tener varias lecturas posibles. Escribe la pronunciación deseada de forma explícita cuando sea posible, ajusta la puntuación y vuelve a escuchar el audio antes de usarlo.
No necesariamente. Las opciones de voz dependen del idioma y del producto o la configuración de Google que utilices. Comprueba las opciones disponibles para tu idioma antes de planificar un proyecto multilingüe.