#488 · 主分类: AI代理与自动化
ai-crawler-py
从URL开始爬取网站,查找相关页面并提取数据——全部由您的自然语言提示引导。
项目最后更新:08/21/26
GitHub Stars
3.2K
Forks数量
11
贡献者数量
2
许可证
Other
收录理由
多数爬虫工具都要求你先手写CSS选择器或XPath规则才能取到数据,这个Python包换了一条路:你给出起始URL,用自然语言描述想要什么,比如“找出所有Halo游戏及其价格”,它就会自行探索站点、筛出相关页面,再按你口头描述的schema输出Markdown或JSON。爬取引擎本身跑在Oxylabs托管的AI Studio服务上,所以JavaScript繁重的页面和按地域发起的请求都由对方处理,不必在自己机器上折腾。对需要拿价格或产品数据做分析、又不想搭建和维护爬虫基础设施的团队来说,这点很实用。schema辅助功能也是个亮点,把宽松的提示词整理成结构化输出,直接接进现有流程。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。