ICLR 2024 | 为音视频分离提供新视角,清华大学胡晓林团队推出RTFS-Net

RTFS-Net 是第一个采用少于 100 万个参数的视听语音分离方法。

via 机器之心
来自频道: @AI_News_CN
Loading comments...