GitHub Stars
11.9K
Forks数量
876
贡献者数量
7
许可证
Apache-2.0
收录理由
当网页不肯乖乖配合大模型时,Reader 就是那个救场的工具。与其把原始 HTML 直接丢给模型,让它被导航栏和脚本搅得晕头转向,不如在网址前加上服务前缀,拿回一份干净的 Markdown——无头浏览器渲染、PDF 解析、带说明的图片,这些都替你处理好了。配套的搜索接口按查询返回完整页面内容,而不只是标题和摘要,做 agent 或 RAG 的人可以省掉自己写爬虫和提取的功夫。托管 API 对生产环境免费,开源分支也能用 Docker 在本地跑起来,想自己掌控缓存和数据流向时很方便。对任何要把网页内容送进 LLM 管线的团队来说,这省掉的管道工程可不少。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
Folo
🧡 Folo 是 AI RSS 阅读器
Vane
Vane 是一个 AI 驱动的回答引擎。
karakeep
一个可自托管的书签一切应用(链接、笔记和图片),具有基于AI的自动标签和全文搜索功能
daily
daily.dev 是个性化的开发者新闻源和社区。在浏览器新标签页或移动端获取来自全网的最佳技术内容。免费且开源。
SurfSense
开源的NotebookLM替代品。通过一个平台、API或MCP服务器,使用实时数据(Reddit、YouTube、Instagram、TikTok、Indeed、Google搜索、地图等)研究开放网络。加入我们的Discord:https://discord.gg/ejRNvftDp9