Tutorials
中國航空母艦福建 003 上的相控陣雷達及其與語音波束形成的聯繫
中國最新航空母艦福建 003 上安裝的相控陣雷達和讓你的智能音箱在嘈雜房間裡聽到你說話的麥克風陣列實際上基於相同的底層數學。
Tutorials
iOS 16 全新聽寫功能如何運作?一位語音研究者揭露蘋果的祕密武器!
蘋果的 iOS 16 聽寫功能完全在設備上運行,這個單一的設計選擇對延遲、隱私和手機上哪些 ASR 架構甚至可行都有連鎖影響。
Tutorials
[長篇評論] Conformer:用於語音識別的卷積增強型 Transformer
Conformer 是悄然佔據端到端 ASR 的模型,其方法是在每個 Transformer 區塊加入卷積模組,這個看似簡單卻非常有效的想法被證實就是有效的。
Tutorials
[短篇評論] Conformer:用於語音識別的卷積增強型 Transformer
Conformer 通過做一件幾乎平凡的事震撼了 ASR 世界:將卷積模組粘合到每個 Transformer 區塊中,使模型一次性捕捉全域文脈和局部聲學細節。
Tutorials
博士大叔使用計算機作弊降維打擊2022高考數學壓軸大題 博士用計算機作弊解決2022年大學入學數學考試
當你使用研究級計算機代數工具包來解決2022年中國高考數學考試最難的問題時會發生什麼?
Tutorials
[長篇評論] Cascaded Diffusion Models for High Fidelity Image Generation
在Imagen和DALL-E 2將擴散設定為生成式影像的預設之前,這篇Google Brain論文奠定了Cascaded Diffusion的方案,許多後來的文字轉圖像系統都悄悄地採用:從一個小
Tutorials
[短篇評論] Cascaded Diffusion Models for High Fidelity Image Generation
Cascaded Diffusion是許多現代生成工作背後的二階以上方案:用一個擴散模型生成小影像,然後交給超解析度擴散模型來添加高頻細
