Author: olewave

News
Joint Unsupervised and Supervised Training for Multilingual ASR
Tutorials

多言語 ASR のための共同無教師学習と教師あり学習

事前学習-ファイン チューニングは多言語 ASR のデフォルト レシピになってきましたが、改善の余地があります。2 つのステージは損失を共有していないため、教師あり段階により有用な自己教師あり構造が静かに洗い流される可能性があります。

12月 4, 2021· 1 min read
UniSpeech-SAT : Universal Speech Representation Learning with Speaker Aware Pre-Training
Tutorials

UniSpeech-SAT: スピーカー認識事前学習による汎用音声表現学習

自己教師あり音声モデルは音韻内容を見事に学習する傾向があるが、スピーカーアイデンティティは後付けになる傾向がある。これはASRには問題ないが、スピーカー検証、ダイアリゼーション、音声クローニングには最悪である。

11月 13, 2021· 1 min read
SNRi Target Training for Joint Speech Enhancement and Recognition
Tutorials

SNRi ターゲット学習による音声強調と認識の結合学習

音声強調とASRの結合学習は明らかに見える。デノイザーを通じて認識損失をバックプロップするだけだ。しかし実際には、積極的なノイズ除去が音響モデルが依存する機能をしばしば歪めるので、複雑である。

11月 5, 2021· 1 min read