#104 · 主分类: 知识库与企业搜索

EmbedAnything

ai cloud generative-ai hacktoberfest high-performance indexing inference information-retrieval large-language-models local machine-learning onnxruntime pipeline production-ready python rag rust search server vector-database

高性能、模块化、内存安全且生产就绪的推理、摄取和索引,用 Rust 构建 🦀

项目最后更新:08/12/26

GitHub Stars

1.3K

Forks数量

144

贡献者数量

22

许可证

Apache-2.0

收录理由

做检索管线的团队常被嵌入生成的速度和成本卡住。EmbedAnything 用 Rust 内核把这件事扛了下来,能从文本、图像、音频、PDF 和网页里产出稠密、稀疏、ONNX 以及 late-interaction 等多种嵌入,再流式写入向量数据库,不必把整个语料都塞进内存。Python API 对数据工程师和 RAG 开发者很友好,而 Rust 库则允许你把推理直接嵌进自己的服务里。由于通过 ONNX Runtime 在本地运行,省去了按请求计费的 API 开销——当你要索引数百万份文档时,这笔账会非常可观。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目