语音合成与识别
语音识别、语音合成与音频工具,Whisper API、ElevenLabs 的开源替代。
共 152 个项目
排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。
| 排名 | 项目 | Stars | Forks | 更新 | 许可证 |
|---|---|---|---|---|---|
| 141 |
whisper-turbo
跨平台,GPU加速的Whisper 🏎️ |
1.8K | 82 | 02/27/24 | Apache-2.0 |
| 142 |
deepvoice3_pytorch
基于卷积神经网络的文本转语音合成模型的PyTorch实现 |
2.0K | 481 | 12/19/23 | Other |
| 143 |
tacotron
一个TensorFlow实现的谷歌Tacotron语音合成,带有预训练模型(非官方) |
3.0K | 936 | 07/06/23 | MIT |
| 144 |
Automatic_Speech_Recognition
基于Tensorflow的端到端中英文自动语音识别 |
2.8K | 535 | 03/24/23 | MIT |
| 145 |
audio-diffusion-pytorch
使用扩散模型生成音频,基于PyTorch。 |
2.1K | 175 | 06/12/23 | MIT |
| 146 |
naturalspeech2-pytorch
在Pytorch中实现Natural Speech 2,零样本语音和歌声合成器 |
1.3K | 104 | 09/24/23 | MIT |
| 147 |
Speech-Emotion-Analyzer
神经网络模型能够从音频语音中检测五种不同的男性/女性情感。(深度学习、NLP、Python) |
1.4K | 435 | 02/07/23 | MIT |
| 148 |
artyom.js
一个语音控制、语音命令、语音识别和语音合成的JavaScript库。在你的网站内,用Google Chrome创建你自己的Siri、Google Now或Cortana。 |
1.3K | 362 | 01/24/23 | MIT |
| 149 |
pytorch-kaldi
pytorch-kaldi是一个用于开发最先进的DNN/RNN混合语音识别系统的项目。DNN部分由pytorch管理,而特征提取、标签计算和解码则使用kaldi工具包完成。 |
2.4K | 442 | 03/14/22 | Other |
| 150 |
DeepAudioClassification
用深度学习识别歌曲流派 |
1.1K | 217 | 07/26/21 | Other |
| 151 |
SincNet
SincNet 是一种高效处理原始音频样本的神经架构。 |
1.2K | 272 | 04/28/21 | MIT |
| 152 |
project_alias
一种可训练的寄生设备,让用户自定义智能助手的唤醒词和命令,通过树莓派设备增强隐私和控制。 |
1.7K | 98 | 04/05/20 | GPL-3.0 |