Non Collision Mispronunciation Addition (NCMA) for Accented ASR

Tutorials

衝突なし誤発音追加(NCMA):アクセント付きASR向け

アクセント付きおよび非ネイティブ音声は発音辞書を破壊する方法で、あなたの音響モデルアライメントに静かに毒を注入します。このInterspeech 2021の研究は一見単純な質問を提起します:検出された

アクセント付きおよび非ネイティブ音声は発音辞書を破壊する方法で、あなたの音響モデルアライメントに静かに毒を注入します。このInterspeech 2021の研究は一見単純な質問を提起します:検出された誤発音を辞書に追加して再訓練するだけで良いのではないか?衝突なし誤発音追加(NCMA)はPAIIのInterspeech 2021 Non-Native Child English Close Track ASRチャレンジへの提出の背後にある技術であり、子どもの音声、L2学習者、およびアクセント付き成人音声が本番ASRにもたらすWER問題に直接対処することを目的としています。

このプレゼンテーションは、NCMAが語彙に新しい発音を注入する際に衝突を避ける方法、より良い音素アライメントがより強い音響モデルにどのようにフィードバックされるか、および検出-追加-再アライメントループ全体が本当に難しいベンチマークで測定可能なWER低下にどのように変換されるかについて説明しています。この技術はW. Chu、P. Chang、およびJ. XiaoによってInterspeech 2021で発表された論文に基づいており、プレゼンテーションはアルゴリズムの選択をそれらに動機づけたチャレンジ提出に結び付けています。教育向けASR、子ども向けプロダクト、コンピュータ支援言語学習、または汎用辞書が静かに失敗するアクセント付き話者の長いテールを構築している場合、対象となった語彙修復がブルートフォースデータ収集をどのように上回るかを見る価値があります。