decionis/agent-safe-pipeline
Reference architecture for AI agents that propose actions but cannot authorize them — immutable intent capture, an independent Decionis policy verdict (ALLOW/ESCALATE/BLOCK), verified human approval, and a SafeExecutor that consumes a single-use intent-bound grant.
解決的問題
AI代理通常自主性過強,或缺乏安全處理特權操作的方式。本專案提供了一種參考架構,確保代理可以提出操作建議,但是否實際執行則由一個獨立的授權邊界來決定。
工作原理
系統透過多階段流程將代理的提議與實際執行分離:
- 意圖捕獲:代理提出一個操作(意圖),該意圖被記錄為不可變的記錄。
- 獨立決策:一個閘道(Decionis)根據策略評估該意圖,決定是否允許(ALLOWED)、阻止(BLOCKED)或升級至人工審核(ESCALATED)。
- 人工驗證:若被升級,人類透過 Presence 服務驗證該意圖。
- 安全執行:SafeExecutor 使用一個封閉的 ActionRegistry 來執行操作,該註冊表將操作名稱對應到可信的處理器,確保代理既不持有實際憑證,也無法決定使用哪個處理器。
適用對象
需要執行敏感操作(如處理退款或部署程式碼)的 AI 代理開發者,且要求嚴格的授權與人工介入監督。
亮點
- 不可變意圖:防止代理在評估後修改其提議。
- 信任邊界:將特權憑證置於可信執行器之後,遠離代理。
- 失敗時關閉設計:網路錯誤或格式錯誤的回應預設會被阻止。
- 參考實作:包含 Shopify 退款、GitHub 部署和 MCP 工具閘道的範例。
相關
- 專案
- 專案
- 專案
- 專案
- 專案