provos/ironcurtain

A secure* runtime for autonomous AI agents. Policy from plain-English constitutions. (*https://ironcurtain.dev)

What it solves

IronCurtain 为自主 AI 智能体 (agent) 提供了一个安全的运行时环境,以防止 """ambient authority"""(即智能体拥有全系统访问权限,并可能由于提示词注入 (prompt injection) 或模型漂移 (model drift) 导致删除文件、泄露数据或推送恶意代码的风险)。它消除了在限制性强且无用的沙箱与手动批准 every single action 的繁琐过程之间的权衡。

How it works

IronCurtain 使用一种 """constitution-based"""(基于宪法/规则集)的安全模型,用户可以用纯英文指令来定义安全意图。一个 LLM pipeline 编译该自然语言宪法,将其转换为在运行时强制执行的确定性、非 LLM 规则。

关键架构组件包括:

  • Semantic Interposition: All agent 交互均通过 Model Context Protocol (MCP) 服务器进行。每一个 tool call 都会被策略引擎拦截,该引擎可以允许、拒绝或将该操作交由人类用户进行审批-。
  • Sandboxing: Agent 运行在隔离环境中——内置 agent 运行在 V8 isolate 中,而外部 agent(如 Claude Code 或 Goose)运行在 Docker container 中——且没有任何直接访问宿主机的权限。
  • Trusted Input: 在其终端多路复用器 (terminal multiplexer) 模式下,用户在命令模式下输入的文本被捕获为经过验证的意图信号,允许系统自动批准后续与该意图匹配的 agent 动作。
  • Policy Compilation: 系统将英文意图翻译成 JSON 规则,生成测试场景以验证这些规则,并在部署前如果规则失败则进行修复。

Who it’s for

使用自主 AI 智能体进行编程、系统管理或漏洞发现,并希望确保智能体在没有明确人类监督- 即可无法 perform destructive 或 unauthorized 动作的开发者和研究人员。

Highlights

  • Constitution-to-Policy: 将人类可读的英文指令转换为确定\n- Policy 策略规则。
  • Title-to-Policy: 将人类可读的英文指令转换为确定性安全策略规则。
  • Terminal Multiplexer: 提供一个 TUI,通过内联式升级/审批- 选项器 (escalation pickers) 内联式升级/审批- 选项器 (escalation picker) 内联式升级/ 解析器 (escalation picker) 内的- 选项器 (escalation picker) 内联式审批- 选项器 (escalation picker) 内联式升级/审批- 选项器 (thought-to-policy) s/escalation pickers and trusted user input capture.
  • uma-agent Orchestration: 支持复杂的、多智能体工作流 (e-g., vulnerability discovery) (e.://- vulnerability discovery) (e.g., vulnerability discovery) (e.g., MITM proxy for LLM API calls and a validating registry proxy for package installations.

相关

  • 项目
  • 项目
  • 项目
  • 项目
  • 项目