GitHub Stars
19.4K
Forks数量
1.7K
贡献者数量
21
许可证
Apache-2.0
收录理由
Dia 是 Nari Labs 推出的开源权重文本转语音模型,它把对话本身当作核心输出,而不是朗读文本的副产品。你只需输入一段对话脚本,模型就能一次性生成完整的对话流,连情绪、语气和笑声、咳嗽、清嗓这类非语言声音都能一并呈现。这让它特别适合配音、多角色有声书场景、游戏对白,以及任何需要表现力而非平淡播报的叙述场合。你还可以用一段短音频来引导输出的情绪和语调,让每一句都更贴合你的设想。1.6B 参数权重采用 Apache-2.0 许可,可通过 Hugging Face Transformers 直接运行,官方还提供了在线演示 Space,你可以在接入自己的流程之前先试听效果。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。