#170 · 主分类: AI工具目录与精选清单
audio-ai-hub
audio-ai
audio-generation
audio-llm
music-generation
paper-list
speech-recognition
tts
音频AI研究枢纽:涵盖音频LLM、语音识别、TTS、音乐与音频生成的论文、开源模型、基准和数据集。
项目最后更新:08/24/26
GitHub Stars
950
Forks数量
51
贡献者数量
8
许可证
Other
收录理由
跟踪语音与音频机器学习动态的人,会把这当做一个省事的入口。仓库把论文、开放模型权重、基准测试和数据集收在一处,支持按类别、星标数、日期筛选,想查什么很快。覆盖范围从音频大模型、语音识别、语音合成到音乐生成都有涉猎,光看首页精选就能感受到跨度:Whisper做识别,CosyVoice和IndexTTS做合成,MusicGen做生成,各方向都有代表性项目。星标数每周自动刷新,提交的内容也有人过目整理,列表不会慢慢变成一堆过期的收藏。要是你的工作就是挑选下一个值得尝试的开源音频模型,从这里着手,比直接翻原始搜索结果省时得多。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。