[Olewave's Review] Token-level Sequence Labeling for SLU using Compositional E2E Models

Tutorials

[Olewave 評測] 用於 SLU 的組合式 E2E 模型的令牌級序列標籤化

端到端 SLU 正在流行,但將序列標籤視為序列預測悄悄拋棄了數十年來被充分理解的令牌級標籤機制。

端到端 SLU 正在流行,但將序列標籤視為序列預測悄悄拋棄了數十年來被充分理解的令牌級標籤機制。本文提出了一個組合式端到端 SLU 設計,保持 E2E 的簡單性,同時為你提供令牌級公式,包括 CRF 風格的全局正規化損失和清晰的各組件性能監控。對於在級聯 ASR 加 NLU 管道和直接 E2E 之間權衡的團隊來說,這是一個實用的中間路徑。

技巧是插入一個中間的 ASR 訓練解碼器,在 NLU 標籤器運行之前將語音轉換為令牌級表示,這樣你就能繼承與預訓練 ASR 和 NLU 元件的相容性,而無需支付硬級聯的錯誤傳播代價。在 SLU 基準測試中的命名實體識別上,組合式模型擊敗了級聯和直接 E2E 基準。深入探討介紹了架構、訓練信號設計、全局正規化 CRF 損失如何重新融入圖景,以及當你實際上必須在生產中調試這個系統時,為什麼各組件性能監控很重要。如果你正在發佈語音助手、呼叫中心分析或任何槽位填充和意圖檢測位於 ASR 之上的產品,當組合式 E2E 在你的路線圖上時,這值得一看。