Justin0504/Aegis

Runtime policy enforcement for AI agents. Cryptographic audit trail, human-in-the-loop approvals, kill switch. Zero code changes.

What it solves

AEGIS 是一個 AI 代理的執行前防火牆。它透過即時攔截與分類,防止代理執行危險的工具呼叫——例如破壞性的 SQL 查詢、未授權的檔案系統存取或資料外洩。它取代了每一次動作都需要人工介入的需求,同時提供防篡改的稽核追蹤以符合合規要求。

How it works

AEGIS 介於 AI 代理與其工具之間,使用輕量級 SDK(支援 Python、TypeScript 與 Go)。當代理嘗試呼叫工具時,請求會送至 AEGIS Gateway,透過五階段管線處理:

  1. Classify:根據參數辨識工具類型(例如資料庫、Shell、網路)。
  2. Anomaly:偵測與代理過往行為的偏差。
  3. Evaluate:依 JSON‑Schema 政策與注入偵測器檢查呼叫。
  4. Match DSL:套用租戶特定的政策規則。
  5. Decide:決定是否允許、阻止或暫停以供人工審核。

若呼叫被標記為「pending」,會出現在 Compliance Cockpit,供人工操作員批准或拒絕。所有操作皆記錄於符合 RFC 6962 的 Merkle 透明日誌中。

Who it’s for

AEGIS 針對在生產環境部署 AI 代理的開發者與安全團隊設計,這些環境對安全、合規(SOC 2、ISO 27001、EU AI Act)與風險管理有嚴格需求。

Highlights

  • Pre-Execution Blocking:在高風險行動發生前即阻止,而非事後僅記錄。
  • Compliance Cockpit:集中式儀表板,提供即時監控、取證稽核追蹤與人工審核批准。
  • Agent Threat Ontology:包含 40 種代理特定攻擊技術(AAT‑T*)的版本化分類法,並提供安全缺口映射。
  • Tamper-Evident Logging:使用 Merkle 樹透明日誌,提供離線可驗證的稽核記錄證明。
  • Zero-Config Instrumentation:只需一行程式碼即可整合至現有代理,無需更改代理內部邏輯。