#73 · 主分类: 语音合成与识别

AudioNotes

ai asr funasr ollama python qwen2 whisper

快速提取音视频内容,整理成一份结构化的markdown笔记

项目最后更新:08/19/26

GitHub Stars

2.5K

Forks数量

365

贡献者数量

3

许可证

MIT

收录理由

AudioNotes 把音视频转文字、笔记整理和内容问答都放在本地电脑上完成,默认不把录音或视频发给第三方 AI 接口。FunASR 在本地识别语音,Ollama 负责把文字稿整理成结构化的 Markdown 笔记,上传的文件、识别结果、笔记和对话历史都保存在本机。如果你经常处理不能外传的敏感音频,这种本地优先的设计会很有吸引力。除了转写,你还能就材料内容继续追问,也可以从历史记录里重新打开以前的笔记。默认搭配的模型在普通硬件上对中文识别效果不错,需要识别其他语言时,可以换成多语言模型。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目