基礎理論|令和6年度 ITパスポート試験 問78
利用者がスマートスピーカーに向けて話し掛けた内容に対して,スマートスピーカーから音声で応答するための処理手順が(1)〜(4)のとおりであるとき,音声認識に該当する処理はどれか。
- (1)利用者の音声をテキストデータに変換する。
- (2)テキストデータを解析して,その意味を理解する。
- (3)応答する内容を決定して,テキストデータを生成する。
- (4)生成したテキストデータを読み上げる。
- ✓ これが正解(1)
- (2)
- (3)
- (4)
解説
声を文字に変えるところまでが、音声認識の受け持ちです。
話しかけてから応答が返るまでには、性質の違う四つの処理が並んでいます。音声認識が受け持つのは、入ってきた声を文字のデータに変えるところまでです。よって最初の処理が当てはまります。文字になった後、その意味を読み取るのは言葉を扱う別の処理で、何を返すかを決めるのはさらに別の判断です。最後に文字を声にして読み上げる処理は、音を扱う点では似ていますが向きが逆になります。認識は音から文字へ、読み上げは文字から音へです。四つのうち二つが音に関わるので、どちらの向きかを確かめることが要点になります。入口が認識、出口が読み上げ、と押さえておけば迷いません。
ほかの選択肢はなぜ違うのか
- 文字になったデータを解析して意味を読み取る処理です。扱っているのはすでに文字になったもので、声を文字に変える処理はその前に終わっています。言葉の意味を扱う段にあたります。
- 何を返すかを決めて文字のデータを組み立てる処理です。入力ではなく出力を作る側であり、聞き取ることとは向きが逆になります。判断を担う段です。何を言うかを決めるところで、聞き取りはとうに終わっています。
- 組み立てた文字を読み上げる処理です。音を扱う点では最初の処理と似ていますが、文字から音へという逆向きの変換です。音が出てくるほうを認識と呼ぶことはありません。
この問題に関係する言葉
- スマートスピーカー
- 音声認識
出典:令和6年度 ITパスポート試験 問78(改変:原典の図表をテキストに書き起こした)
同じ単元をまとめて解くなら基礎理論へ。
この解説に誤りを見つけたら教えてください。直して、直した記録を残します。誤りを報告する(メールが開きます)