互联网基础服务企业 Cloudflare 最近搞了个大动作——1号那天,他们宣布要细化对网络爬虫的管理,根据爬虫的具体行为给它们贴上不同的标签,比如搜索、数据采集、模型训练等等。最关键的是,从2026年9月15日起,默认禁止AI训练类爬虫访问那些带广告的网页。这个时间点一出来,业内不少人都在盘算:内容生态的博弈又到新阶段了。

Cloudflare 的意思其实很直白:大多数网站所有者的心态是矛盾的——既希望自己的内容能被AI发现、被引用,又不想白白损失广告收益。理想情况下,负责任的AI企业会老老实实标记清楚自家爬虫是干什么用的。但现实呢?市面上有相当数量的“混合型爬虫”,一边抓数据做搜索索引,一边顺手拿去训练模型,用途模糊,边界不清。

这才是新规的巧妙之处:Cloudflare 的爬虫管理器会为混合型爬虫匹配它所有的行为模式。换句话说,只要这个爬虫的某一种行为被网站所有者明确禁止了,它在那个网站上就什么都别想抓。一招封住所有后门,干脆利落。

除此之外,Cloudflare 还在为网站所有者准备新版归因业务洞察仪表板,目的是帮助大家适应搜索优化从传统的 SEO 到 GEO,再到 AEO(答案引擎优化)的演变。同时会上线页面变动监控功能,避免爬虫对未更新的内容做无意义的重复抓取。更值得关注的是,他们还在推“按使用计价”的抓取付费模式——这意味着,未来内容被爬取可能不再是免费午餐,而是可以量化为实际收入的一部分。

本文转载于:https://www.itren.com/digital/186856.html 如有侵犯,请联系zhengruancom@outlook.com删除。
免责声明:正软商城发布此文仅为传递信息,不代表正软商城认同其观点或证实其描述。