#15 · 主分类: 语音合成与识别

dia

ai open-weight text-to-speech

一种能够一次性生成超逼真对话的TTS模型。

项目最后更新:11/19/25

GitHub Stars

19.4K

Forks数量

1.7K

贡献者数量

21

许可证

Apache-2.0

收录理由

Dia 是 Nari Labs 推出的开源权重文本转语音模型,它把对话本身当作核心输出,而不是朗读文本的副产品。你只需输入一段对话脚本,模型就能一次性生成完整的对话流,连情绪、语气和笑声、咳嗽、清嗓这类非语言声音都能一并呈现。这让它特别适合配音、多角色有声书场景、游戏对白,以及任何需要表现力而非平淡播报的叙述场合。你还可以用一段短音频来引导输出的情绪和语调,让每一句都更贴合你的设想。1.6B 参数权重采用 Apache-2.0 许可,可通过 Hugging Face Transformers 直接运行,官方还提供了在线演示 Space,你可以在接入自己的流程之前先试听效果。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目