Stimmoptionen
Den passenden Workflow für Google Text-to-Speech finden
Google Text-to-Speech kann eine kurze Hörprobe oder eine Audiodatei für ein Projekt liefern. Welcher Weg der richtige ist, hängt davon ab, ob Sie den Text jetzt anhören, das Ergebnis speichern oder die Stimme anpassen möchten.
Eine Entscheidung vor dem Start
Entscheiden Sie, ob Sie eine Hörprobe oder eine wiederverwendbare Aufnahme benötigen. Dieser Unterschied ist wichtiger als der Name des Tools.
Wie Text zu Sprache wird
Diese drei Schritte erklären das Grundprinzip – unabhängig davon, ob ein Dienst Sprache sofort abspielt oder Audio für eine andere Anwendung bereitstellt.
-
1
Einen kurzen Textabschnitt vorbereiten
Beginnen Sie mit genau den Wörtern, die gesprochen werden sollen. Schreiben Sie Abkürzungen aus, die falsch gelesen werden könnten, setzen Sie Satzzeichen an Stellen, an denen eine Pause sein soll, und teilen Sie ein langes Skript in überschaubare Abschnitte auf. Eine klare Eingabe hilft einem System für Text zu Sprache, den Text vorhersehbarer vorzulesen.
-
2
Wiedergabeweg wählen
Für eine schnelle Prüfung der Aussprache können Sie Text in Google Translate einfügen und, sofern verfügbar, die Vorlesefunktion nutzen. Zur programmatischen Audioerzeugung verwendet Google Cloud Text-to-Speech eine API-Anfrage mit ausgewählter Sprache und Stimme. Ein browserbasiertes Tool für Text zu Sprache ist eine weitere Möglichkeit, wenn Sie lieber direkt in einem Editor arbeiten.
-
3
Anhören, überarbeiten und verwenden
Hören Sie sich das Ergebnis vollständig an. Namen, Zahlen und ungewöhnliche Schreibweisen sollten Sie ein zweites Mal prüfen. Wenn Sie das Audio für ein Video oder eine Präsentation benötigen, prüfen Sie, ob der gewählte Weg tatsächlich eine Audiodatei bereitstellt. Eine Hörprobe allein bedeutet nicht, dass Sie die Wiedergabe exportieren können.
Worin sich die Google-Optionen unterscheiden
Welche Option am besten passt, hängt davon ab, was Sie nach dem Anhören tun möchten. Es handelt sich um unterschiedliche Google-Produkte, nicht um zwei Modi desselben Editors für Text zu Sprache.
- Vorlesefunktion von Google Translate
- Google Cloud Text-to-Speech
Hauptzweck
Vorlesefunktion von Google Übersetzer
Eingegebenen oder übersetzten Text als schnelle Hörhilfe vorlesen lassen.
Google Cloud Text-to-Speech
Über einen Dienst für Entwickler Sprachausgabe für eine Anwendung erzeugen.
So beginnen Sie
Vorlesefunktion von Google Übersetzer
Geben Sie Text in Google Übersetzer ein und verwenden Sie die Vorlesefunktion, wenn sie angezeigt wird.
Google Cloud Text-to-Speech
Konfigurieren Sie ein Cloud-Projekt und senden Sie über die API eine Anfrage zur Sprachsynthese.
Auswahl der Stimme
Vorlesefunktion von Google Übersetzer
Die Oberfläche bietet nur begrenzte Möglichkeiten, die Stimme direkt auszuwählen.
Google Cloud Text-to-Speech
In Anfragen können eine verfügbare Stimme und eine Sprache angegeben werden.
Audioausgabe
Vorlesefunktion von Google Übersetzer
Für die Wiedergabe in der Oberfläche gedacht, nicht als allgemeiner Workflow zum Exportieren von Audiodateien.
Google Cloud Text-to-Speech
Gibt synthetisierte Audiodaten zurück, die eine Anwendung speichern oder verarbeiten kann.
Am besten geeignet für
Vorlesefunktion von Google Übersetzer
Prüfen, wie ein kurzes Wort oder ein Textabschnitt klingt.
Google Cloud Text-to-Speech
Sprachausgabe in Software integrieren oder Audio über einen konfigurierten Workflow erzeugen.
Hauptvorteil
Anhören in Google Translate
Ob die Wiedergabe verfügbar ist und wie sie funktioniert, kann je nach Sprache, Gerät und Benutzeroberfläche variieren.
Google Cloud Text-to-Speech
Erfordert eine technische Einrichtung; verfügbare Stimmen und Funktionen hängen von der gewählten Konfiguration ab.
Wissen Sie, was Sie vom Ergebnis erwarten
Probieren Sie einen direkten Weg zur Sprachausgabe
Wenn Sie statt einer Übersetzungsvorschau oder API-Integration einen gesprochenen Clip benötigen, beginnen Sie mit dem Skript und hören Sie sich das Ergebnis kritisch an, bevor Sie es verwenden. Texttovoice bietet eine direkte Möglichkeit, diesen Text zu Sprache-Ablauf auszuprobieren; prüfen Sie die verfügbaren Ausgabeoptionen für Ihre Aufgabe.
Sprachausgabe ausprobieren- Schreiben Sie fürs Hören, nicht nur fürs Lesen.
- Prüfen Sie Namen und Zahlen bei der Wiedergabe.
- Stellen Sie sicher, dass die Ausgabe für den vorgesehenen Zweck geeignet ist.
Fragen zu Googles Sprachtools
Nein. Die Vorlesefunktion von Translate eignet sich, um eingegebenen oder übersetzten Text anzuhören. Google Cloud Text-to-Speech hingegen ist ein Dienst für Entwickler, der Sprache über eine API erzeugt. Entscheiden Sie danach, ob Sie Text kurz anhören oder Audio für eine Anwendung erzeugen möchten.
Translate ist in erster Linie zum Anhören gedacht. Gehen Sie daher nicht davon aus, dass Sie die Wiedergabe als Aufnahme herunterladen können. Wenn Sie eine Audiodatei benötigen, wählen Sie einen Ablauf, der das Erzeugen und Speichern einer solchen Datei ausdrücklich unterstützt.
Für die Vorlesefunktion in einer verfügbaren Google-Oberfläche benötigen Sie keinen Code. Google Cloud Text-to-Speech ist etwas anderes: Der Dienst ist für konfigurierte Anwendungen und API-Anfragen gedacht. Für einen einzelnen Textabschnitt kann ein direkter Text zu Sprache-Editor einfacher sein.
Bei der Spracherzeugung wird geschriebener Text interpretiert. Daher kann es für eine Abkürzung, einen unbekannten Namen oder eine Ziffernfolge mehrere plausible Lesarten geben. Schreiben Sie die gewünschte Aussprache nach Möglichkeit aus, passen Sie die Zeichensetzung an und hören Sie sich das Audio vor der Verwendung erneut an.
Nicht unbedingt. Die Auswahl an Stimmen hängt von der Sprache und dem jeweiligen Google-Produkt oder der verwendeten Konfiguration ab. Prüfen Sie die verfügbaren Optionen für Ihre Sprache, bevor Sie ein mehrsprachiges Projekt planen.