抄録/ポイント:
抄録/ポイント
文献の概要を数百字程度の日本語でまとめたものです。
部分表示の続きは、JDreamⅢ(有料)でご覧頂けます。
J-GLOBALでは書誌(タイトル、著者名等)登載から半年以上経過後に表示されますが、医療系文献の場合はMyJ-GLOBALでのログインが必要です。
急速な国際化に伴い,国際会議などでは英語が国際共通語として用いられ,非英語母語話者の間でも英語で意思疎通を図る場面が増加している。このような非母語音声を認識して会議録を作成するなどの応用技術を考えた場合,非母語音声認識を高精度に行う必要がある。しかし,非英語母語話者の音声は英語母語話者に比べ,発音の揺らぎ,ブレ,訛りが存在する。そのため,非母語音声の音声認識精度は母語音声よりも低下することが多い。非母語音声認識における非母語音声の影響は,音響モデル,発音辞書,デコーディングの各処理系にて考慮する必要があるが,本研究では発音辞書に焦点を当てる。非母語音声認識において,人手による発音変換知識を用いた非英語母語話者発音の逐次学習が提案されている。しかし,これらの発音変換知識を人手で構築することは困難であり,汎用性が小さい。そこで本研究では,非母語音声の音素認識結果をG2P(Grapheme-to-phoneme)ツールの学習データとして用いる。さらに,G2Pツールから非英語母語話者に見られる複数の発音バリエーションを生成し,実音声から生起頻度の高い発音バリエーションを推定する手法を提案する。その結果,人手による発音変換知識を用いた時と比べ,英語中級者においてはほぼ同等の精度,英語上級者においては約2.4%の精度向上を確認できた。(著者抄録)