送信する Cloud Text-to-Speech リクエスト内で音声合成マークアップ言語(SSML)を使用して細かい休止や頭字語、日付、時刻、略語、検査すべきテキストに対するオーディオ形式を指定することにより、オーディオ レスポンスをより詳細にカスタマイズできます。詳細とコードサンプルについては、Cloud TTS の SSML チュートリアルをご覧ください。
SSML マークアップの例を次に示します。Cloud TTS によりテキストが合成されます。
<speak> Here are <say-as interpret-as="characters">SSML</say-as> samples. I can pause <break time="3s"/>. I can play a sound <audio src="https://www.example.com/MY_MP3_FILE.mp3">didn't get your MP3 audio file</audio>. I can speak in cardinals. Your number is <say-as interpret-as="cardinal">10</say-as>. Or I can speak in ordinals. You are <say-as interpret-as="ordinal">10</say-as> in line. Or I can even speak in digits. The digits for ten are <say-as interpret-as="characters">10</say-as>. I can also substitute phrases, like the <sub alias="World Wide Web Consortium">W3C</sub>. Finally, I can speak a paragraph with two sentences. <p><s>This is sentence one.</s><s>This is sentence two.</s></p> </speak>
上記の SSML ドキュメントの例に対して生成される合成テキストを次に示します。
Here are S S M L samples. I can pause [3 second pause]. I can play a sound [audio file plays]. I can speak in cardinals. Your number is ten. Or I can speak in ordinals. You are tenth in line. Or I can even speak in digits. The digits for ten are one oh. I can also substitute phrases, like the World Wide Web Consortium. Finally, I can speak a paragraph with two sentences. This is sentence one. This is sentence two.
Cloud TTS は、使用可能な SSML タグのうち、このトピックで説明するサブセットをサポートしています。
Cloud TTS を使用して SSML 入力から音声データを作成する方法については、音声ファイルの作成をご覧ください。
使ってみる
Google Cloud を初めて使用する場合は、アカウントを作成し、実際のシナリオで Cloud TTS のパフォーマンスを評価してみてください。新規のお客様には、ワークロードの実行、テスト、デプロイができる無料クレジット 300 ドル分を差し上げます。
Cloud TTS の無料トライアルSSML の使用に関するヒント
実装によっては、Cloud TTS に送信する SSML ペイロードで一重または二重の引用符をエスケープする必要が生じる場合があります。次に、JSON オブジェクトに SSML 入力を含める場合のフォーマット例を示します。
"{ 'input':{ 'ssml':'<speak>The <say-as interpret-as=\"characters\">SSML</say-as> standard <break time=\"1s\"/>is defined by the <sub alias=\"World Wide Web Consortium\">W3C</sub>.</speak>'