科技

Patreon升級AI防爬措施 攜手Cloudflare封鎖AI訓練機器人

記者黃仁杰/編譯

創作者會員平台Patreon宣布,將進一步加強防止AI公司未經授權擷取平台內容進行模型訓練,攜手網路基礎設施業者Cloudflare,直接封鎖AI訓練機器人(AI Crawlers),而不再僅依賴robots.txt等自律規範要求對方停止爬取內容。

創作者會員平台Patreon宣布,將進一步加強防止AI公司未經授權擷取平台內容進行模型訓練。(圖/AI生成)

Patreon表示,隨著AI模型快速發展,AI爬蟲技術也愈來愈複雜,因此必須採取更積極的技術手段,保護創作者作品不被任意用於AI模型訓練。

Patreon早在2023年便開始透過robots.txt檔案,要求AI機器人不要抓取網站內容。

robots.txt是網站管理者向搜尋引擎或爬蟲提供存取規範的標準機制,但是否遵守仍取決於機器人本身。

Patreon指出,如今部分AI爬蟲已直接無視robots.txt規範,持續擷取網站內容,因此平台決定改採Cloudflare的AI Crawl Control技術,主動封鎖AI訓練機器人存取內容。Patreon表示:「創作者是否同意,不應建立在爬蟲是否願意遵守規則之上。」

「AI履歷健檢」看見自己優勢:https://campaign.1111.com.tw/resume-review/

更多科技工作請上科技專區:https://techplus.1111.com.tw/

Patreon透露,在測試Cloudflare新技術期間,部分AI訓練機器人原本每週仍會數千次嘗試存取Patreon內容。

導入新措施後,相關存取次數已降至零,也反映部分AI業者先前確實未遵守平台設定的robots.txt限制。不過,Patreon仍會允許一般搜尋引擎等索引型機器人(Indexing Bots)正常存取網站,協助使用者搜尋Patreon內容並導回平台,不影響正常搜尋服務。

Patreon表示,近年除了會員專屬付費內容外,公司也推出新版首頁(Home Feed)、短內容功能Quips等公開內容推薦機制,使更多作品可能暴露於AI爬蟲之下,因此需要進一步提升防護能力。

Cloudflare近期也持續推出AI內容保護工具,包括可向AI公司收取內容擷取費用的「Pay Per Crawl」機制,以及預設封鎖同時進行搜尋索引與AI模型訓練的混合型爬蟲(Mixed-use Crawlers)。

Patreon產品長Drew Rowny表示,隨著AI代理(AI Agents)逐漸普及,創作者應有權決定自己的作品是否能被AI公司用於模型訓練。

他表示,目前許多網路平台要求創作者若想擴大曝光,就必須接受作品被AI模型使用,但Patreon希望建立不同模式,讓創作者既能拓展受眾,也能保有作品使用權與控制權。

來源:TechCrunch

Loading

本篇文章授權來源:科技島

Author

Write A Comment