#144 · 主分类: 知识库与企业搜索

semantra-python

cli machine-learning semantic-search

语义搜索多功能工具

项目最后更新:08/27/24

GitHub Stars

2.7K

Forks数量

160

贡献者数量

5

许可证

MIT

收录理由

Semantra 能把电脑里的一堆本地文本和 PDF 文件变成可检索的集合,全程不用搭建任何服务器。你只需在命令行里指向目标文档,它就在本机完成切分和向量化,随后打开一个浏览器界面,按语义相关度而非关键词匹配来排序结果。这种工作流很适合那些需要频繁翻查大量文档的人——记者赶稿时在泄露文件里找线索,研究者跨论文追踪某个主题,分析师在档案堆里梳理脉络,都能派上用场。网页端会显示相关度分数,高亮最相关的段落,还支持用加号和减号标记来微调查询。默认情况下,向量化计算全在本地完成,也有一个可选的 OpenAI 模式,相当于你拿到了搜索引擎级别的检索能力,但文档内容始终不会离开自己的设备。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目