音声の選択肢
自分に合った Google テキスト読み上げの使い方を見つける
Google テキスト読み上げには、音声をすぐに試聴する方法と、プロジェクト用の音声ファイルを作成する方法があります。今すぐ聞きたいのか、結果を保存したいのか、声を細かく設定したいのかによって、適した方法は変わります。
始める前に決めること
試聴だけでよいのか、再利用できる録音が必要なのかを決めましょう。この違いは、ツールの名前よりも重要です。
テキストが音声になるまで
サービスがその場で音声を再生する場合も、別のアプリケーションで使う音声を出力する場合も、基本的な仕組みは次の3段階で説明できます。
-
1
短い文章を用意する
まず、読み上げたい言葉を正確に入力します。誤読されそうな略語は正式名称に直し、間を置きたい箇所には句読点を入れ、長い原稿は扱いやすい長さに分けましょう。入力を明確にすると、テキスト読み上げで意図に近い読み方を得やすくなります。
-
2
再生方法を選ぶ
発音を手早く確認するなら、Google 翻訳にテキストを貼り付け、利用できる場合は音声再生ボタンを使います。プログラムから音声を生成するなら、Google Cloud Text-to-Speech で言語と声を選択して API リクエストを送ります。直接編集できる画面を使いたい場合は、ブラウザベースのテキスト読み上げツールも選択肢です。
-
3
聞いて、修正して、使う
生成結果を最後まで再生しましょう。名前、数字、珍しいつづりはもう一度確認してください。動画やプレゼンテーションに使うなら、選んだ方法で実際に音声ファイルを取得できるか確認しましょう。試聴できるだけでは、その音声をエクスポートできるとは限りません。
Google の選択肢はどう違う?
どちらが適しているかは、聞いた後に何をしたいかで決まります。これらは同じテキスト読み上げエディターの2つのモードではなく、別々の Google 製品です。
- Google 翻訳の音声再生
- Google Cloud Text-to-Speech
主な用途
Google 翻訳の読み上げ
入力または翻訳されたテキストを音声で聞き、手軽に発音を確認できます。
Google Cloud Text-to-Speech
開発者向けサービスを通じて、アプリケーション用の音声を生成します。
利用の始め方
Google 翻訳の読み上げ
Google 翻訳の画面にテキストを入力し、表示された読み上げボタンを使用します。
Google Cloud Text-to-Speech
Cloud プロジェクトを設定し、API を通じて音声合成リクエストを送信します。
音声の選択
Google 翻訳の読み上げ
画面上で読み上げ音声を直接調整できる範囲は限られています。
Google Cloud Text-to-Speech
リクエストで利用可能な音声と言語を指定できます。
音声出力
Google 翻訳の読み上げ
画面上での再生を目的としており、汎用的な音声エクスポートには適していません。
Google Cloud Text-to-Speech
アプリケーションで保存または処理できる合成音声データを返します。
適した用途
Google 翻訳の読み上げ
短い単語や文章の発音を確認する場合。
Google Cloud Text-to-Speech
ソフトウェアに音声出力を組み込む場合や、設定済みのワークフローで音声を生成する場合。
主な違い
Google 翻訳で音声を聞く
再生できるかどうかや再生時の動作は、言語、デバイス、インターフェースによって異なります。
Google Cloud Text-to-Speech
技術的な設定が必要です。利用できる音声や機能は、選択した設定によって異なります。
必要な結果を明確にする
直接使える音声生成ツールを試す
翻訳の試聴やAPI連携ではなく、音声クリップが必要なら、まず原稿を用意し、生成結果を注意深く聞いてから使用してください。Texttovoiceでは、このテキスト読み上げを直接試せます。用途に合う出力方法があるか確認してください。
音声生成を試す- 読むためだけでなく、聞きやすさを考えて書く。
- 再生して名前や数字の読み方を確認する。
- 出力結果が用途に合っているか確認する。
Googleの音声ツールに関する質問
いいえ。Google 翻訳の再生機能は、入力したテキストや翻訳されたテキストを聞くのに便利です。一方、Cloud Text-to-Speechは、APIを通じて音声を生成する開発者向けサービスです。手軽に聞きたいのか、アプリケーション用の音声出力が必要なのかに応じて選んでください。
Google 翻訳は主に音声を聞くためのインターフェースです。再生機能から録音ファイルをダウンロードできるとは限りません。音声ファイルが必要な場合は、ファイルの生成と保存に明確に対応した方法を選んでください。
利用可能なGoogleのインターフェースで再生機能を使うだけなら、コードは不要です。一方、Google Cloud Text-to-Speechは、設定済みのアプリケーションやAPIリクエストでの利用を想定しています。一度だけ文章を読み上げたい場合は、直接使えるテキスト読み上げエディターのほうが簡単かもしれません。
音声生成では書かれたテキストを解釈するため、略語、なじみのない名前、数字の並びには複数の読み方が考えられます。可能であれば意図した読み方を明記し、句読点を調整して、音声を使う前にもう一度聞いてください。
必ずしもそうではありません。選べる音声は、使用する言語やGoogleの製品・設定によって異なります。多言語のプロジェクトを計画する前に、各言語で利用できる選択肢を確認してください。