Tutorials
评测 DiTAR:语音生成的扩散 Transformer 自回归建模 ~ Seed-TTS
Seed-TTS 团队回归了 DiTAR,这是对现代语音生成中最尴尬权衡之一的简洁答案:如何在不支付混合扩散加自回归堆栈通常要求的计算成本的情况下保持连续语音表示的灵活性,同时不接受这些组
Tutorials
[长评] 级联扩散模型高保真图像生成
在Imagen和DALL-E 2将扩散模型作为生成图像的默认选择之前,这篇Google Brain论文阐述了许多后来的文本到图像系统悄悄借鉴的级联扩散方案:从小
