AWSのテキスト音声変換エンジンはニュースキャスターのような話し方をする

最新の機械学習技術のおかげで、テキスト音声変換エンジンはこの数年間で大きく進歩した。以前はコンピューターがテキストを読んでることがすぐ分かったが、最近はそれも変わりつつある。Amazon（アマゾン）のクラウドコンピューティング部門AWSは今日（米国時間7/30）、テキスト音声変換を行うニューラルネットワーク用のモデルをいくつかローンチし、その中にはテレビのニュースキャスターの喋りを真似るものもある。
同社の発表声明はこう言っている。「音声のクォリティーは確かに重要だが、もっと人間的にリアルな合成音声を作ることが、これまでは忘れられていた。たとえば、話し方のスタイル。人間なら、ニュースキャスターとスポーツキャスターと大学の先生の話し方スタイルを聞き分けることができる。またほとんどの人間が、状況に応じて話し方を変える。メッセージがいちばんよく伝わるような、話し方を選ぶのだ」。
ニュースキャスターふうの話し方スタイルは、Joanna（ジョアンナ）とMatthew（マシュー）という名前までついた二人のアメリカ人の声で提供され、USA TodayとカナダのThe Globe and Mailの協力により、実際にニュース原稿の読み上げに使われている。
それは、こんな喋り方だ:
https://techcrunch.com/wp-content/uploads/2019/07/da4b9237

リンク元