#209 · 主分类: 语音合成与识别

Phonetisaurus

g2p lexicon openfst pronunciation-dictionary speech-recognition speech-to-text

Phonetisaurus G2P

项目最后更新:06/01/24

GitHub Stars

522

Forks数量

128

贡献者数量

19

许可证

BSD-3-Clause

收录理由

Phonetisaurus 是一个专注于字形到音素(G2P)建模的工具,用于为语音识别系统生成发音词典。它构建在 OpenFst 框架之上,提供 C++ 训练与评估程序,并附带 Python 绑定,方便调用。你可以用它训练自己的模型,然后为词典中缺失的单词自动生成发音,省去手工整理词条的大量重复劳动。当需要仔细检查对齐结果时,它还能把每个词的原始 lattices 以 .fst 格式导出,便于深入分析。这个库定位明确,不是开箱即用的完整解决方案,需要自己编译 OpenFst,并且最好熟悉 Kaldi 风格的流水线。尽管搭建环境有些门槛,它在语音社区里有着较长的发展历史,许多团队依然愿意选择它来完成发音词典相关的任务。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目