音声認識
意味・解説
人間が話した音声をコンピュータが解析し、テキストデータに変換する技術。
マイクで収音した音声を信号処理し、言語モデルと音響モデルを用いてテキストに変換する技術。スマートスピーカー、音声入力、自動文字起こし、コールセンターの通話分析など幅広く活用される。深層学習により精度が飛躍的に向上した。
くわしく
「人の声を聞き取って文字に書き起こす『聞き取りの達人AI』」です。
1.仕組み:
音声を波形として分析し、音素→単語→文章と段階的に認識。
2.課題と進化:
方言、騒音環境、話者の癖など難しい条件でも、最新のAIモデルは高い精度を達成しています。
例文
会議の議事録作成に音声認識を活用し、発言内容をリアルタイムでテキスト化している。
過去問での出題状況
直近29回分の過去問(全2,900問)を解析した結果、2回登場しています(出題された年度: 2年度)。
出典: 本サイト独自集計(問題文および全選択肢テキストからの用語出現頻度・2026年6月時点)
同義語: ASR, 音声入力
対義語: 音声合成
分類: 音声処理技術