Justin0504/Aegis
Runtime policy enforcement for AI agents. Cryptographic audit trail, human-in-the-loop approvals, kill switch. Zero code changes.
What it solves
AEGIS 是一个 AI 代理的执行前防火墙。它通过实时拦截和分类,防止代理执行危险的工具调用——例如破坏性的 SQL 查询、未授权的文件系统访问或数据泄露。它取代了每一次操作都需要人工介入的需求,同时提供防篡改的审计追踪以满足合规要求。
How it works
AEGIS 位于 AI 代理与其工具之间,使用轻量级 SDK(支持 Python、TypeScript 和 Go)。当代理尝试调用工具时,请求会发送到 AEGIS Gateway,经过五阶段管道处理:
- Classify:根据参数识别工具类型(例如数据库、Shell、网络)。
- Anomaly:检测与代理历史行为的偏差。
- Evaluate:依据 JSON‑Schema 策略和注入检测器检查调用。
- Match DSL:应用租户特定的策略规则。
- Decide:决定是否允许、阻止或暂停以供人工审查。
如果调用被标记为“pending”,它会出现在 Compliance Cockpit,供人工操作员批准或拒绝。所有操作均记录在符合 RFC 6962 的 Merkle 透明日志中。
Who it’s for
AEGIS 面向在生产环境部署 AI 代理的开发者和安全团队,这些环境对安全、合规(SOC 2、ISO 27001、EU AI Act)和风险管理有严格要求。
Highlights
- Pre-Execution Blocking:在高风险行为发生前即阻止,而不是事后仅记录。
- Compliance Cockpit:集中式仪表板,提供实时监控、取证审计追踪和人工审查批准。
- Agent Threat Ontology:包含 40 种代理特定攻击技术(AAT‑T*)的版本化分类法,并提供安全缺口映射。
- Tamper-Evident Logging:使用 Merkle 树透明日志,提供离线可验证的审计记录证明。
- Zero-Config Instrumentation:只需一行代码即可集成到现有代理,无需更改代理内部逻辑。