#209 · 主分类: 语音合成与识别
Phonetisaurus
Phonetisaurus G2P
项目最后更新:06/01/24
GitHub Stars
522
Forks数量
128
贡献者数量
19
许可证
BSD-3-Clause
收录理由
Phonetisaurus 是一个专注于字形到音素(G2P)建模的工具,用于为语音识别系统生成发音词典。它构建在 OpenFst 框架之上,提供 C++ 训练与评估程序,并附带 Python 绑定,方便调用。你可以用它训练自己的模型,然后为词典中缺失的单词自动生成发音,省去手工整理词条的大量重复劳动。当需要仔细检查对齐结果时,它还能把每个词的原始 lattices 以 .fst 格式导出,便于深入分析。这个库定位明确,不是开箱即用的完整解决方案,需要自己编译 OpenFst,并且最好熟悉 Kaldi 风格的流水线。尽管搭建环境有些门槛,它在语音社区里有着较长的发展历史,许多团队依然愿意选择它来完成发音词典相关的任务。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。