Patreon 停止依賴 robots.txt,轉向直接封鎖 AI 抓取行為
為何重要
此舉標誌著內容平臺對抗 AI 抓取的戰術正從被動規範轉向主權防禦,不再假設爬蟲會遵守標準的 robots.txt 邊界。 對於基礎設施供應商而言,能夠依據用途精準區分「索引」與「訓練」爬蟲,將成為網站與模型廠商協議中的關鍵基建角色,甚至衍生出如 Cloudflare 的「Pay Per Crawl」等新商業模式。 這可能導致內容版權衝突升級,創作者平臺為了保護收益,愈加有動力與 Cloudflare 級別的廠商合作,迫使大型 AI 公司面臨更多樣化的版權談判或資料蒐集難度。
Patreon 本週宣佈與 Cloudflare 合作,將採取具體措施直接封鎖未獲授權便抓取內容用於訓練 AI 模型的機器人,擺脫過去僅依賴 robots.txt 進行委婉請求的時代。
- 該平臺升級了與 Cloudflare 的合作,利用後者的 AI Crawl Control 技術,針對被識別為意圖訓練的爬蟲進行強制攔截。
- 由於近期推出重新設計的「首頁動態」與類推文功能的「Quips」等新發現工具,使得原本被 paywall 限制或較難抓取的內容增加了曝光度,過去機制不再適用。
- 測試資料顯示,經過這項新政策後,單一 AI 訓練爬蟲每週試圖存取 Patreon 的請求量,已從「數千次」暴跌至零。