provos/ironcurtain

A secure* runtime for autonomous AI agents. Policy from plain-English constitutions. (*https://ironcurtain.dev)

它解決的問題

IronCurtain 為自主 AI 代理提供了一個安全的執行環境,以防止「環境權限」——即代理擁有完整系統存取權限時,可能因提示注入或模型偏移而刪除檔案、竊取資料或推送惡意程式碼的風險。它消除了在限制性、無用的沙箱與手動批准每一項操作的繁瑣過程之間做選擇的需要。

如何運作

IronCurtain 使用「憲法導向」的安全模型,使用者以自然語言定義安全意圖。一個 LLM 管道將此自然語言憲法編譯成確定性的、非 LLM 的規則,並在執行時強制執行。

關鍵架構組件包括:

  • 語義介入:所有代理互動皆透過 Model Context Protocol (MCP) 伺服器進行。每次工具呼叫都會被策略引擎攔截,該引擎可允許、拒絕或將動作升級至人類審核。
  • 沙箱化:代理在隔離環境中執行——內建代理使用 V8 隔離,外部代理(如 Claude Code 或 Goose)則使用 Docker 容器——且無法直接存取主機。
  • 可信輸入:在終端多路複用模式下,使用者在命令模式下輸入的文字會被捕捉為已驗證的意圖信號,讓系統能自動批准符合該意圖的後續代理動作。
  • 策略編譯:系統將英文意圖轉換為 JSON 規則,產生測試場景以驗證這些規則,並在部署前修復失敗的規則。

適用對象

使用自主 AI 代理進行程式設計、系統管理或漏洞發現的開發者與研究人員,希望確保代理在未經明確人類監督的情況下無法執行破壞性或未授權的操作。

特色亮點

  • 憲法轉策略:將人類可讀的英文指示轉換為確定性的安全規則。
  • 終端多路複用器:提供一個 TUI,中介工具呼叫並內建升級選擇器,同時捕捉可信的使用者輸入。
  • uma-agent 協調:支援複雜的多代理工作流程(例如漏洞發現),並為每個代理設置安全邊界。
  • 角色管理:允許建立命名的策略檔案,包含各自的憲法、工作區與記憶體。
  • 深度防禦:結合 V8/Docker 隔離、MITM 代理(用於 LLM API 呼叫)與驗證註冊表代理(用於套件安裝)。

相關

  • 專案
  • 專案
  • 專案
  • 專案
  • 專案