语音合成与识别

语音识别、语音合成与音频工具,Whisper API、ElevenLabs 的开源替代。

共 152 个项目

排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。

第 141–152 项,共 152 个

排名 项目 Stars Forks
141 whisper-turbo

跨平台,GPU加速的Whisper 🏎️

1.8K 82
142 deepvoice3_pytorch

基于卷积神经网络的文本转语音合成模型的PyTorch实现

2.0K 481
143 tacotron

一个TensorFlow实现的谷歌Tacotron语音合成,带有预训练模型(非官方)

3.0K 936
144 Automatic_Speech_Recognition

基于Tensorflow的端到端中英文自动语音识别

2.8K 535
145 audio-diffusion-pytorch

使用扩散模型生成音频,基于PyTorch。

2.1K 175
146 naturalspeech2-pytorch

在Pytorch中实现Natural Speech 2,零样本语音和歌声合成器

1.3K 104
147 Speech-Emotion-Analyzer

神经网络模型能够从音频语音中检测五种不同的男性/女性情感。(深度学习、NLP、Python)

1.4K 435
148 artyom.js

一个语音控制、语音命令、语音识别和语音合成的JavaScript库。在你的网站内,用Google Chrome创建你自己的Siri、Google Now或Cortana。

1.3K 362
149 pytorch-kaldi

pytorch-kaldi是一个用于开发最先进的DNN/RNN混合语音识别系统的项目。DNN部分由pytorch管理,而特征提取、标签计算和解码则使用kaldi工具包完成。

2.4K 442
150 DeepAudioClassification

用深度学习识别歌曲流派

1.1K 217
151 SincNet

SincNet 是一种高效处理原始音频样本的神经架构。

1.2K 272
152 project_alias

一种可训练的寄生设备,让用户自定义智能助手的唤醒词和命令,通过树莓派设备增强隐私和控制。

1.7K 98
< 上一页
/ 8
下一页 >