#147 · 主分类: 语音合成与识别

Speech-Emotion-Analyzer

audio-files data-science deep-learning deep-neural-networks emotion emotion-recognition keras natural-language-processing natural-language-understanding neural-network python3 speech speech-emotion-recognition speech-recognition voice

神经网络模型能够从音频语音中检测五种不同的男性/女性情感。(深度学习、NLP、Python)

项目最后更新:02/07/23

GitHub Stars

1.4K

Forks数量

435

贡献者数量

1

许可证

MIT

收录理由

这个项目把语音如何一步步变成分类器输入的过程完整摊开,适合想动手理解这条链路的人。它从RAVDESS和SAVEE两个数据集里取短音频,用LibROSA抽取声学特征,再把特征数组交给用Keras搭的卷积网络。模型能区分男声和女声中的愤怒、平静、恐惧、开心、悲伤五种情绪,README里还附了示例音频的波形图和频谱图,让你直观看到模型处理的原始素材长什么样。代码本身不复杂,更适合当作学习参考实现,而不是直接拿去生产环境用。你可以轻松fork下来,换成自己的录音,或者改造成其他类似的语音分析任务。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目