#673 · 主分类: 教育与研究

ICASSP-2023-24-Papers

asr denoising domain-adaptation face-recognition generative-models icassp icassp2023 icassp2024 image-generation keyword-spotting language-modeling multimodal-learning music-generation self-supervised-learning semantic-segmentation signal-processing signal-restoration speech-recognition spoken-language-understanding vad

一个精选的ICASSP 2023-24论文集合,涵盖声学、语音和信号处理,并附有代码。

项目最后更新:05/05/25

GitHub Stars

525

Forks数量

23

贡献者数量

17

许可证

MIT

收录理由

ICASSP 2023和2024两届会议体量庞大,光是把实际录用论文梳理清楚,就比读论文本身更耗神。这个索引替你做了分类:条目按技术分会场归置,不是一长串标题堆在那里,所以想找自监督语音学习、基于扩散的语音增强、声音转换或声学场景分类,都能直接翻到对应板块。作者公开了代码的论文,条目里也附了链接,想复现基线或者把近期方法嫁接进自己的流程,省去从PDF里重新实现的功夫。维护者接受拉取请求来补漏,因此集合并不会停在会议录快照那一刻,会持续长下去。它是个可收藏的参考页,不是可安装的库,但作为了解当前语音和音频研究现状的起点,相当结实。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目