#147 · 主分类: 语音合成与识别
Speech-Emotion-Analyzer
audio-files
data-science
deep-learning
deep-neural-networks
emotion
emotion-recognition
keras
natural-language-processing
natural-language-understanding
neural-network
python3
speech
speech-emotion-recognition
speech-recognition
voice
神经网络模型能够从音频语音中检测五种不同的男性/女性情感。(深度学习、NLP、Python)
项目最后更新:02/07/23
GitHub Stars
1.4K
Forks数量
435
贡献者数量
1
许可证
MIT
收录理由
这个项目把语音如何一步步变成分类器输入的过程完整摊开,适合想动手理解这条链路的人。它从RAVDESS和SAVEE两个数据集里取短音频,用LibROSA抽取声学特征,再把特征数组交给用Keras搭的卷积网络。模型能区分男声和女声中的愤怒、平静、恐惧、开心、悲伤五种情绪,README里还附了示例音频的波形图和频谱图,让你直观看到模型处理的原始素材长什么样。代码本身不复杂,更适合当作学习参考实现,而不是直接拿去生产环境用。你可以轻松fork下来,换成自己的录音,或者改造成其他类似的语音分析任务。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。