#73 · 主分类: 语音合成与识别
AudioNotes
ai
asr
funasr
ollama
python
qwen2
whisper
快速提取音视频内容,整理成一份结构化的markdown笔记
项目最后更新:08/19/26
GitHub Stars
2.5K
Forks数量
365
贡献者数量
3
许可证
MIT
收录理由
AudioNotes 把音视频转文字、笔记整理和内容问答都放在本地电脑上完成,默认不把录音或视频发给第三方 AI 接口。FunASR 在本地识别语音,Ollama 负责把文字稿整理成结构化的 Markdown 笔记,上传的文件、识别结果、笔记和对话历史都保存在本机。如果你经常处理不能外传的敏感音频,这种本地优先的设计会很有吸引力。除了转写,你还能就材料内容继续追问,也可以从历史记录里重新打开以前的笔记。默认搭配的模型在普通硬件上对中文识别效果不错,需要识别其他语言时,可以换成多语言模型。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。