Research
FA-Bench Leaderboard for ASR with Word Timestamps
We ranked 28 speech recognition pipelines, 19 built from open models and 9 that call a commercial API, by how closely their word timestamps land on the boundar…
Research
FA-Bench、フォースドアライナーの音素レベルと単語レベルのタイムスタンプ精度を評価するベンチマーク
フォースドアライナーの結果の多くは、再現が困難です。FA-Benchは、オープンで標準化されたベースラインです。30のシステムを、音素レベルと単語レベルのタイムスタンプ精度で採点しました。基準は、人間の言語学者が付けた境界です。クリーンな音声と、4種類の劣化を加えた音声で評価しています。
Research
Olewaveの音声データクリーニングパイプラインが効果的でユニークな理由
OlewaveのOlignパイプラインが、生の音声を、検証済みの書き起こし、単語レベルのタイムスタンプ、信頼度スコアを備えた本番利用可能なASR/TTS学習データに変える仕組みを紹介します。人手によるラベル付けは不要です。
Events
ICASSP 2024でのOlewave
私たちはソウルで開催されたIEEE ICASSP 2024のパトロンおよび展示者でした。創業者兼CEOのWei Chuは、野生データやウェブから取得したデータから音声モデルを訓練することについてのスポットライトトークを行いました。
Events
野生データを活用した高ROIの音声R&Dの実現—当社のICASCP 2024スポットライト
当社の創業者兼CEOであるWei Chuは、ICASCP 2024のスポットライトトークで、従来の音声サービス開発が低ROIである理由と、大規模なオープンソース音声モデルを使用してワイルドデータをフィルタリングし、プライベートデータを自動ラベル付けすることで状況を逆転させる方法について説明しました。