開源專案「ShieldFont」利用被汙染的字型愚弄 AI 爬蟲
為何重要
這項技術反映了內容擁有者與 AI 模型開發商之間的資料戰爭升級,提供了一種不需修改後端伺服器的「使用者端」防禦手段;然而,作為一種基於字型螢火蟲技術的防禦措施,其效果仍可能隨著更強大的解析與爬蟲技術而衰退。
為了阻止 AI 爬蟲未經授權抓取網站內容進行訓練,設計工作室 Seneda & Abrucio 與 Playtype 合作推出開源專案 ShieldFont;此技術運用 OpenType 標準中的 GSUB(字形置換)擴充套件應用,將網站原始 HTML 中的實質詞彙替換為無害但語意混淆的對應詞,但透過渲染後的人眼觀察依然正常。
- 替換機制:替換維持詞性與語意分類(如名詞換名詞),目前建置約 250 個替換池,大約四分之一文字會被置換,目標是增加爬蟲資料庫的「不確定性」而非完全阻擋。
- 檔案規格:發布的桌面字型約 5 MB,壓縮後的網頁字型檔僅約 800 KB;專案內建三種 GSUB 字典,並支援使用者自製以防止逆向工程。
- 版權與限制:目前處於 v0/alpha 階段,防禦手段可能被 OCR、使用者端檢視或下載字型程式破解,亦可能對 SEO 造成負面影響。