#119 · 主分类: 知识库与企业搜索
crw
快速、轻量级的Rust网页抓取、爬虫及搜索API,配备MCP服务器,可直接替换Firecrawl,速度比Tavily快2.3倍。
项目最后更新:08/27/26
GitHub Stars
876
Forks数量
57
贡献者数量
8
许可证
AGPL-3.0
收录理由
想让RAG管线或AI智能体拿到最新网页内容,光是搭一套爬虫的精力往往比干活本身还大。crw是一个很小的Rust二进制,把搜索、抓取、爬行和结构化提取都收进一个工具,输出干净的Markdown或带类型的JSON,可以直接塞给后续的入库流程。它内置了兼容Firecrawl的REST接口,之前已经对接过Firecrawl的团队不用改代码就能换过来;另外还带一个MCP服务端,Claude Code、Cursor这类工具开箱即用。一条命令装好本地就能跑,不需要注册账号,也可以自托管在自家网络里,或者通过Python和Node的正式SDK来调用。别看它轻量,速度一点不含糊——在1000个URL的基准测试里,比Tavily快约2.3倍,比Firecrawl快约1.5倍,而内存只占大约6MB。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
ragflow
RAGFlow 是一款领先的开源检索增强生成(RAG)引擎,将前沿 RAG 与 Agent 能力融合,为大型语言模型(LLM)打造卓越的上下文层。
Understand-Anything
教学型图表优于炫技型图表。将任意代码转化为可探索、搜索和提问的交互式知识图谱。支持Claude Code、Codex、Cursor、Copilot、Gemini CLI等。
crawl4ai
🚀🤖 Crawl4AI:开源的、对LLM友好的网页爬虫与抓取工具。别害羞,加入这里:https://discord.gg/jP8KfhDhyN
docling
为生成式AI准备文档
anything-llm
停止租用你的智能。用AnythingLLM拥有它。你需要的一切,实现强大的本地优先智能体体验。