本文へ移動
  1. トップ
  2. 用語集
  3. 音声合成(TTS)
用語集

音声合成(TTS)とは

要点よみ: おんせいごうせい

文章を読み上げて、人の声のような音声を作る技術。

音声合成は、文章を入れると、それを読み上げた音声を作る技術です。英語で Text to Speech と呼び、TTS と略します。研修の動画のナレーション、案内の音声、資料の読み上げなどに使われます。最近の音声合成は、声の種類や話す調子を指示で変えられます。

人の声で録音するのと比べた利点は、同じ声でいつでも作り直せることです。教材の一部だけを直すときも、話し手を確保せずに 1 本だけ差し替えられます。一方で、話す速さは声の種類によって違い、そのままでは決めた長さに収まらないことがあります。当社の研修の動画では、全部の動画を同じ 1 つの声で作り、BGM と効果音は入れていません。当社が研修の動画を作ったときの合わせ方は、研修の動画を AI で作る記事に書きました。

使うときは、提供元の規約を確かめます。たとえば OpenAI は、聞いている人に、AI で作った声であり人の声ではないことを、はっきり示すよう求めています。