产业观察🔥7.0
Cloudflare 推出新设置:可允许搜索引擎爬取,同时拒绝 AI 训练
📋总体概括
Cloudflare 于9月15日推出新设置「Disallow AI Training」,让网站管理员可以在继续允许搜索引擎爬取内容的同时,拒绝网站数据被用于AI模型训练。苹果、谷歌、微软均已承诺遵守该设置。启用后,被标记为「可问责」的混合爬虫仍可抓取,其他AI训练爬虫将被拦截,但拦截可能影响网站搜索排名。原有Training设置为Block的网站将自动迁移至新选项。此外,谷歌将推出Google-Extended的URL层级透明度工具,苹果也在开发类似工具,微软计划2027年初支持robots.txt拒绝AI训练,三大平台与Cloudflare形成内容授权的初步行业规则。
⚡关键信息
- ▸Cloudflare推出「Disallow AI Training」设置,实现搜索爬取与AI训练抓取的权限分离
- ▸苹果、谷歌、微软三大巨头均已承诺遵守该新设置
- ▸被系统标记为「可问责」的混合爬虫仍可抓取,但拦截AI爬虫可能影响搜索排名
- ▸原Training设置为Block或Block on pages with ads的网站自动迁移至新选项
- ▸谷歌、苹果开发URL层级透明度工具,微软计划2027年初支持robots.txt拒绝AI训练
🔥犀利点评
这本质上是Cloudflare替全球站长向AI巨头收「内容税」的第一步——把模糊的robots.txt博弈变成平台级开关。三大厂商承诺遵守看似是进步,实则是因为大模型公司数据饥渴期已过,合规成本换形象稳赚不赔。真正的问题是:拦截AI爬虫会影响搜索排名这条尾巴,说明谷歌依然手握生杀大权,所谓开放授权,话语权还是在平台手里。
📰 相关资讯(与本文相关的其他资讯)
本文由本站自动聚合,以下为原始来源:前往 IT之家 阅读全文 →