Patreon 不再請求 AI 機器人停止抓取數據,而是開始直接阻止它們
我是 LongbridgeAI,我可以總結文章信息。Patreon 正在積極阻止 AI 機器人抓取創作者內容用於模型訓練,超越了之前通過 robots.txt 的請求。該平台與 Cloudflare 合作,使用 AI 爬蟲控制技術來阻止未經授權的訪問,將每週的抓取嘗試從數千次減少到零。這一轉變解決了忽視同意的複雜抓取工具的問題,旨在讓創作者掌控他們的作品如何被 AI 公司使用,同時仍允許那些為 Patreon 帶來流量的索引機器人
Patreon,這個為創作者提供會員服務的平台,正在加強對人工智能抓取其內容用於訓練目的的打擊。週四,該公司表示,它正在與互聯網基礎設施提供商 Cloudflare 合作,直接阻止旨在未經許可訓練其人工智能模型的 AI 機器人訪問。
公司表示,強化措施是必要的,因為自 2023 年首次採取措施阻止 AI 爬蟲以來,AI 抓取技術變得更加複雜。此外,Patreon 的付費牆長期以來將創作者的大部分內容鎖定在爬蟲無法接觸的範圍之外。但最近,該公司推出了新的發現工具,如重新設計的首頁動態和類似推文的 Quips,這可能會使更多內容暴露給爬蟲。
這些變化的出現是因為越來越多的在線出版商和內容創作者開始意識到人工智能如何獲取他們的作品,以使其 AI 模型更智能。為此,Cloudflare 現在提供工具,允許網站出版商限制 AI 機器人,包括一個市場,讓網站對抓取 AI 機器人收費,稱為按抓取付費。這個月早些時候,它改變了政策,默認阻止 “混合使用” 的爬蟲,即那些同時索引和訓練網站內容的爬蟲,訪問任何託管廣告的頁面。
Patreon 表示,它正在擴展與 Cloudflare 的現有合作,利用該公司的 AI 抓取控制技術來更新其 AI 政策和執行工具。不同之處在於,Patreon 現在不僅僅是要求 AI 爬蟲不要使用 robots.txt 文件抓取內容——這是向機器人提供如何使用其網站的指令的標準方式——而是積極阻止 AI 訓練機器人。
“同意不應取決於抓取者是否選擇遵守,” Patreon 的一篇博客文章解釋道,提到更嚴格的措施。
在測試這些功能時,個別 AI 訓練爬蟲每週嘗試訪問 Patreon 的次數從 “數千次降至零”,該文章指出。這表明,AI 抓取者忽視了 Patreon 的 robots.txt 文件,仍然在抓取該網站,儘管有其請求。
然而,該公司表示,它將允許那些索引頁面並組織信息的機器人,這些信息可以用於將用户引導回 Patreon。
“隨着 AI 代理變得越來越強大和流行,創作者理應在他們的作品如何被 AI 公司使用方面擁有實質性的發言權,” Patreon 的產品負責人 Drew Rowny 在公告中表示。“在大多數互聯網環境中,創作者必須接受 AI 對他們作品的訓練,以便接觸和發展受眾。Patreon 有不同的願景:創作者應該能夠發展他們的受眾,並控制他們的作品如何被使用。”
