インデックスへスキップ

GLOSSARY

音声合成(TTS)

テキストを自然な音声へ変える技術。音声 AI の出力側の半分で、多くの言語で人のナレーションと区別がつきません。

現代の TTS モデルは、リアルな韻律・感情・笑い声まで含む音声をテキストから直接生成します — 10 年前のロボット声からの世代交代です。カタログの音声ツールは三つに分かれます。汎用ナレーター(Murf、PlayHT、WellSaid、学習教材や動画向け)、表現型(ElevenLabs、オーディオブックやゲーム向け)、専用型(声変換、ダビング、リアルタイムチェンジャー)。

実際に効く選定基準:ボイスライブラリの幅とライセンス、インタラクティブ用途のレイテンシ、きめ細かな制御(ポーズ・強勢・発音)、商用利用条項。ナレーションの不気味の谷は実質閉じました — だからこそ開示と声の所有者同意が業界の現在の論点なのです。

関連する用語

この技術を使うツール

関連カテゴリー