音声合成
意味・解説
テキストデータを人工的な音声に変換して読み上げる技術。
Text-to-Speech(TTS)とも呼ばれ、入力された文字列を解析し、人間が話すような音声を生成する。カーナビの音声案内、スマートスピーカーの応答、視覚障害者向けの読み上げソフトなどで活用される。近年はAI技術により、自然で感情豊かな音声合成が可能になっている。
くわしく
「文字を声に変える『読み上げロボット』の技術」です。
1.進化の歴史:
かつては機械的な声でしたが、深層学習の発展により、人間と区別がつかないほど自然な音声が実現。
2.応用:
動画のナレーション自動生成、多言語対応、個人の声のクローニングなど、活用範囲が急拡大中です。
例文
視覚障害者向けのアプリでは、音声合成技術でWebページの内容を読み上げている。
同義語: TTS, テキスト読み上げ
対義語: 音声認識
分類: 音声処理技術