Justin0504/Aegis
Runtime policy enforcement for AI agents. Cryptographic audit trail, human-in-the-loop approvals, kill switch. Zero code changes.
What it solves
AEGIS 是一個 AI 代理的執行前防火牆。它透過即時攔截與分類,防止代理執行危險的工具呼叫——例如破壞性的 SQL 查詢、未授權的檔案系統存取或資料外洩。它取代了每一次動作都需要人工介入的需求,同時提供防篡改的稽核追蹤以符合合規要求。
How it works
AEGIS 介於 AI 代理與其工具之間,使用輕量級 SDK(支援 Python、TypeScript 與 Go)。當代理嘗試呼叫工具時,請求會送至 AEGIS Gateway,透過五階段管線處理:
- Classify:根據參數辨識工具類型(例如資料庫、Shell、網路)。
- Anomaly:偵測與代理過往行為的偏差。
- Evaluate:依 JSON‑Schema 政策與注入偵測器檢查呼叫。
- Match DSL:套用租戶特定的政策規則。
- Decide:決定是否允許、阻止或暫停以供人工審核。
若呼叫被標記為「pending」,會出現在 Compliance Cockpit,供人工操作員批准或拒絕。所有操作皆記錄於符合 RFC 6962 的 Merkle 透明日誌中。
Who it’s for
AEGIS 針對在生產環境部署 AI 代理的開發者與安全團隊設計,這些環境對安全、合規(SOC 2、ISO 27001、EU AI Act)與風險管理有嚴格需求。
Highlights
- Pre-Execution Blocking:在高風險行動發生前即阻止,而非事後僅記錄。
- Compliance Cockpit:集中式儀表板,提供即時監控、取證稽核追蹤與人工審核批准。
- Agent Threat Ontology:包含 40 種代理特定攻擊技術(AAT‑T*)的版本化分類法,並提供安全缺口映射。
- Tamper-Evident Logging:使用 Merkle 樹透明日誌,提供離線可驗證的稽核記錄證明。
- Zero-Config Instrumentation:只需一行程式碼即可整合至現有代理,無需更改代理內部邏輯。