agent-governance-toolkit: 为自主 AI Agent 提供确定性的策略执行与治理层

它解决了什么问题

AI Agent 通常自主运行,做出调用工具、浏览网页或查询数据库的决策。依赖提示词层面的安全性(要求模型遵循规则)是不可靠的,因为模型容易受到提示词注入和对抗性攻击的影响。该工具包提供了一个确定性的治理层,在 Agent 执行动作之前对其进行拦截,确保仅允许执行授权动作,并为合规性提供防篡改的审计追踪。

工作原理

该工具包实现了一种“故障关闭”(fail-closed)架构,其中每一个工具调用、消息或委托都会被策略引擎拦截。该引擎根据 YAML 定义的策略(使用 Rust 核心运行时以保证速度和确定性)评估请求,并检查身份和信任级别。如果某个动作被策略拒绝,那么无论模型的意图如何,Agent 在结构上都不可能执行该动作。

适用对象

需要在生产环境中部署自主 AI Agent,并需要严格的策略执行、身份管理和监管合规(例如 OWASP Agentic Top 10 或 EU AI Act)的开发人员和 SRE。

亮点

  • 多语言支持:提供 Python、TypeScript、.NET、Rust 和 Go 的 SDK。
  • 框架无关:可与 AutoGen、LangGraph、CrewAI、Semantic Kernel 和 LlamaIndex 等主流框架集成。
  • 确定性执行:将安全性从概率性的基于提示词的请求转变为确定性的应用程序代码。
  • 全面的治理栈:包括执行沙箱化(Privilege Rings)、SRE 监控(SLOs、kill switches)和合规性验证(OWASP audits)。
  • MCP 安全网关:专门检测 Model Context Protocol 服务器中的工具投毒、漂移和隐藏指令。

Sources