agent-governance-toolkit: 為自主 AI Agent 提供確定性的策略執行與治理層
它解決了什麼問題
AI Agent 通常自主運作,做出呼叫工具、瀏覽網頁或查詢資料庫的決策。僅依賴提示詞層級的安全機制(要求模型遵守規則)是不可靠的,因為模型容易受到提示詞注入(prompt injection)和對抗性攻擊。此工具包提供了一個確定性的治理層,在 Agent 執行動作之前攔截其行為,確保僅允許授權的動作發生,並為合規性提供防篡改的稽核軌跡。
運作原理
此工具包實作了「失效關閉」(fail-closed)架構,其中每個工具呼叫、訊息或委派都會被策略引擎攔截。該引擎會根據 YAML 定義的策略(使用 Rust 核心執行環境以確保速度與確定性)來評估請求,並檢查身分與信任等級。如果動作被策略拒絕,無論模型的意圖為何,Agent 在結構上都無法執行該動作。
目標對象
在生產環境中部署自主 AI Agent,且需要嚴格策略執行、身分管理與法規合規性(例如 OWASP Agentic Top 10 或 EU AI Act)的開發人員與 SRE。
重點功能
- 多語言支援:提供 Python、TypeScript、.NET、Rust 與 Go 的 SDK。
- 框架無關性:可與 AutoGen、LangGraph、CrewAI、Semantic Kernel 與 LlamaIndex 等主要框架整合。
- 確定性執行:將安全性從機率性的提示詞請求轉移到確定性的應用程式碼中。
- 全面的治理堆疊:包含執行沙箱化(Privilege Rings)、SRE 監控(SLOs、kill switches)以及合規性驗證(OWASP 稽核)的工具。
- MCP 安全閘道:專門偵測 Model Context Protocol 伺服器中的工具投毒(tool poisoning)、漂移(drift)與隱藏指令。