Patreon 正在坚决抵制未经授权将其创作者内容用于 AI 训练的行为。这家创作者变现平台迎来了重大的战略转变:他们与 Cloudflare 达成合作,开始主动拦截 AI 爬虫,彻底摒弃了以往那种被动、全凭自觉的机制——毕竟事实证明,这种机制在应对疯狂的爬虫时根本无济于事。
多年来,各大网站一直依赖 robots.txt 文件,这是网络开发者用来与爬虫沟通的一项标准。这个文件本质上就像一块数字版的“闲人免进”标牌,客客气气地请求爬虫不要抓取或索引特定页面。然而,随着生成式 AI 的爆发,许多 AI 公司干脆对这些请求视而不见,把“退出抓取”的信号当成了耳旁风,而不是必须遵守的规则。Patreon 的新举措也承认,光靠“好好说话”已经行不通了。
通过与网络基础设施和网络安全巨头 Cloudflare 合作,Patreon 正从“劝离”爬虫转向“强行锁门”。Cloudflare 先进的爬虫管理工具能让 Patreon 识别并拦截来自已知 AI 训练爬虫的自动流量,在它们访问创作者页面之前就将其挡在门外。这种主动防御机制确保了 Patreon 平台上艺术家、作家和音乐人们创作的独家内容,不会在未经允许且没有补偿的情况下,被肆意窃取去训练大语言模型或 AI 图像生成器。
这一举措也标志着整个行业迎来了一个更广泛的转折点。随着创作者们越来越强烈地抗议自己的知识产权被用来构建价值数十亿美元的 AI 帝国,各大平台正面临着巨大的压力,必须提供切实有效的保护。仅仅依赖 robots.txt 让创作者们处于毫无防备的境地,因为它对那些铁了心的爬虫根本起不到任何技术上的阻拦作用。Patreon 采取硬性的技术拦截,为平台如何保护用户数据树立了新的标杆。
从被动请求到主动拦截的转变,凸显了极度渴求训练数据的 AI 开发者与致力于保护自身社区的平台之间不断升级的“军备竞赛”。对于 Patreon 的创作者来说,传达出的信号非常明确:他们的心血之作绝不会束手就擒,任由 AI 模型随意拿取。随着其他平台纷纷关注 Patreon 与 Cloudflare 的合作,这种强硬抵制未授权爬取的立场,很可能会迅速成为整个数字领域内容保护的新底线。