Justin0504/Aegis
Runtime policy enforcement for AI agents. Cryptographic audit trail, human-in-the-loop approvals, kill switch. Zero code changes.
What it solves
AEGIS は AI エージェントの実行前ファイアウォールです。破壊的な SQL クエリ、未承認のファイルシステムアクセス、データ流出などの危険なツール呼び出しを、実行前にリアルタイムでインターセプトし分類することで防止します。すべてのアクションに対して人間が介在する必要をなくし、コンプライアンスのための改ざん防止監査トレイルも提供します。
How it works
AEGIS は AI エージェントとそのツールの間に位置し、軽量 SDK(Python、TypeScript、Go 用)で提供されます。エージェントがツール呼び出しを試みると、リクエストは AEGIS Gateway に送られ、5 段階のパイプラインで処理されます:
- Classify:引数に基づきツールタイプ(データベース、シェル、ネットワークなど)を特定します。
- Anomaly:エージェントの過去の行動からの逸脱を検出します。
- Evaluate:JSON‑Schema ポリシーとインジェクション検出器で呼び出しをチェックします。
- Match DSL:テナント固有のポリシールールを適用します。
- Decide:呼び出しを許可、ブロック、または人間レビューのために保留するかを決定します。
呼び出しが「pending」とマークされた場合、Compliance Cockpit に表示され、人間のオペレーターが承認または却下します。すべての操作は RFC 6962 準拠の Merkle 透明ログに記録されます。
Who it’s for
AEGIS は、セキュリティ、コンプライアンス(SOC 2、ISO 27001、EU AI Act)およびリスク管理が重要な本番環境で AI エージェントを展開する開発者とセキュリティチーム向けに設計されています。
Highlights
- Pre-Execution Blocking:高リスクなアクションが起こる前に阻止し、事後に記録するだけではありません。
- Compliance Cockpit:リアルタイム監視、フォレンジック監査トレイル、人間介在の承認を提供する集中ダッシュボード。
- Agent Threat Ontology:40 種類のエージェント固有攻撃技術(AAT‑T*)のバージョン管理された分類法と、セキュリティギャップを特定するカバレッジマップ。
- Tamper-Evident Logging:Merkle ツリー透明ログを使用し、オフラインで検証可能な監査記録の証拠を提供。
- Zero-Config Instrumentation:エージェントの内部ロジックを変更せず、1 行のコードで既存エージェントに統合可能。