Research
FA-Bench Leaderboard for ASR with Word Timestamps
We ranked 28 speech recognition pipelines, 19 built from open models and 9 that call a commercial API, by how closely their word timestamps land on the boundar…
Research
FA-Bench,一個評估強制對齊器音素層級與詞層級時間戳記準確度的基準測試
大多數強制對齊器的結果都很難重現。FA-Bench 是一個開放、標準化的基準。我們為 30 個系統評分,衡量它們在音素層級與詞層級的時間戳記準確度,並以人類語言學家標定的邊界為對照,測試了乾淨音訊和四種劣化情況。
Research
是什麼讓Olewave的語音資料清理管道有效且獨特
Olewave 的 Olign 管線如何在無需人工標註員的情況下,將原始音訊轉換為可直接用於生產環境的 ASR/TTS 訓練資料,並附上經過驗證的逐字稿、字詞層級時間戳記與信心分數。
Events
利用野生資料進行高投資回報率語音 R&D——我們的 ICASSP 2024 聚焦演講
我們的創始人兼 CEO Wei Chu 的 ICASSP 2024 聚焦演講,關於為什麼傳統語音服務構建的投資回報率低——以及過濾野生資料 + 使用大型開源語音模型自動標記私有資料如何改變局面。