#127 · 主分类: 语音合成与识别

transcriptionstream

automation diarization llm mistral-7b ollama speaker-diarization speech-recognition transcription whisper whisperx

即用型自托管离线转录和说话人分离服务,提供LLM摘要。

项目最后更新:01/18/26

GitHub Stars

947

Forks数量

53

贡献者数量

2

许可证

GPL-3.0

收录理由

经常需要把会议录音、访谈或课堂音频整理成可检索文字的团队,会把这套工具当作一个不错的起点。它把 Whisper 和说话人分离打包成一个完全离线的自托管服务,省去自己拼接各组件的麻烦。你可以通过 SSH 丢文件,也可以用简单的网页界面上传、试听、校对和下载结果,输出会按日期归档,并带时间轴对齐的回放和高亮文本。转录完成后还能交给本地的 Ollama 模型生成结构化摘要,标出说话人、主题、行动项和日期;所有内容经 Meilisearch 索引,事后在大量历史录音里做全文搜索也很快。虽然需要 NVIDIA GPU 和一定的 Docker Compose 经验,但对想用最小装配搭一套私有转写管线的用户来说,值得一试。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目