#5 · 主分类: 隐私保护与联邦数据科学
ai.robots.txt
ai
crawlers
crawling
privacy
一个用于屏蔽AI智能体和机器人的列表。
项目最后更新:08/26/26
GitHub Stars
4.1K
Forks数量
179
贡献者数量
75
许可证
MIT
收录理由
如果你的网站正被不请自来的 AI 爬虫频繁访问,这份列表能让你迅速做出反击。它由一个社区维护的注册表追踪各类 AI 机器人,并提供多种现成的拦截规则:除了标准的 robots.txt,还附带了 nginx、Apache、Caddy、HAProxy 和 lighttpd 的配置片段,你只需按自己的服务器环境复制粘贴,不必从头手写规则。配套的机器人指标表还说明了每个爬虫的用途,想知道谁在抓取你的站点时,这份资料可以当参考手册用。它本质上是配置而非运行中的服务,几分钟就能融入现有技术栈,而且随着贡献者不断添加新代理,内容也会持续更新。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。