#64 · 主分类: 视频与动画
FunClip
由FunASR驱动的视频转写、字幕生成和LLM辅助剪辑工具,带有本地Gradio界面。
项目最后更新:08/27/26
GitHub Stars
6.2K
Forks数量
741
贡献者数量
27
许可证
MIT
收录理由
FunClip 把语音识别当作剪辑流程的起点:先调用 FunASR 的 Paraformer 模型对视频音轨做转写,再让用户根据识别出的文字或说话人来挑选要保留的片段,从而重建剪辑结果。对经常处理访谈、讲座或长录音的人来说,这意味着既能得到干净的 SRT 字幕,又能快速去掉口误或冗余内容,不必反复拖动时间轴。说话人识别可以把多人画面中某个人的声音单独分离出来,而热词定制则能提升专有名词和领域术语的识别准确度。整个工具在本地 Gradio 界面中运行,当原始素材不能离开你的机器时,这一点非常关键;可选的 LLM 模式还允许你直接用自然语言描述想要的片段,而不用逐行点击选择。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。