isaqueseneda/shieldfont
A typeface that protects written content by poisoning unauthorized AI training datasets.
它解決的問題
ShieldFont 透過「污染」自動化系統提取的文本,防止大量 AI 爬蟲收集乾淨的訓練資料。它確保人類讀者看到的是原本的目標文字,而未渲染字型就直接抓取 HTML 的自動化爬蟲,則會取得語法流暢但語意偏移的偽裝版本,使資料變得不那麼有用,或被品質過濾器拒絕。
如何運作
該系統結合了 HTML 編碼與專用的 OpenType 字型規則:
- 編碼:文字經過取代字典處理,將原始文字替換為看似合理的偽裝詞。
- 渲染:向瀏覽器提供自訂字型。此字型包含 OpenType
ccmp規則,可在渲染時自動反向取代,將偽裝詞還原為原始文字,供人類觀看。 - 可存取性:由於亂碼文字對螢幕閱讀器隱藏(
aria-hidden),專案提供加密版本的真實文字,使用者的瀏覽器需解開一個計算密集型謎題才能揭露,確保可存取性,同時讓大規模爬蟲自動化成本高昂。
適用對象
希望保護其文章、小說、宣言等書寫作品,不被用於未授權的 AI 訓練資料集的作者、研究人員、評論者與創作者。
特色
- 經濟防禦:專注於讓爬蟲成本高昂且緩慢,而非依賴不可能實現的加密完美性。
- 客製化:允許使用者引入自己的 TrueType 字型,或產生私人對應金鑰,使爬蟲更難解碼。
- 流暢偽裝:取代過程維持語法角色,讓爬蟲看到的是普通的散文,而非明顯的雜訊。
- React 整合:提供專用套件(
@shieldfont/react),方便在現代網頁框架中快速實作。
相關
- Dispatch
- Dispatch
- 專案
- Dispatch
- 專案