provos/ironcurtain
A secure* runtime for autonomous AI agents. Policy from plain-English constitutions. (*https://ironcurtain.dev)
What it solves
IronCurtain은 자율형 AI 에이전트가 'ambient authority'(주변 권한)를 갖게 되는 위험, 즉 프롬프트 인젝션이나 모델 드리프트로 인해 시스템 전체 권한을 가진 에이전트가 파일을 삭제하거나, 데이터를 유출하거나, 악성 코드를 푸시할 수 있는 위험을 방지하기 위한 안전한 런타임을 제공합니다. 이는 제한적이고 쓸모없는 샌드박스를 선택하거나, 모든 개별 작업을 수동으로 승인해야 하는 번거로운 프로세스 사이에서 고민할 필요를 없애줍니다.
How it works
IronCurtain은 사용자가 일반 영어로 보안 의도를 정의하는 '헌법 기반(constitution-based)' 보안 모델을 사용합니다. LLM 파이프라인은 이 자연어 헌법을 런타임에서 강제되는 결정론적이고 비-LLM 규칙으로 컴파일합니다.
주요 아키텍처 구성 요소는 다음과 같습니다:
- Semantic Interposition: 모든 에이전트 상호작용은 Model Context Protocol (MCP) 서버를 통해 이루어집니다. 모든 도구 호출은 허용, 거부 또는 인간의 승인을 위해 작업을 에스컬레이션할 수 있는 정책 엔진에 의해 가로채집니다.
- Sandboxing: 에이전트는 호스트에 대한 직접적인 액세스 없이, 내장형 에이전트를 위한 V8 isolate 또는 외부 에이전트(Claude Code 또는 Goose와 같은)를 위한 Docker 컨테이너와 같은 격리된 환경에서 실행됩니다.
- Trusted Input: 터미널 멀티플렉서 모드에서, 명령 모드에서 사용자가 입력한 텍스트는 검증된 의도 신호로 캡처되어, 시스템이 해당 의도와 일치하는 후속 에이전트 작업을 자동 승인할 수 있게 합니다.
- Policy Compilation: 시스템은 영어 의도를 JSON 규칙으로 번역하고, 해당 규칙을 검증하기 위한 테스트 시나리오를 생성하며, 배포 전 규칙이 실패할 경우 이를 수정합니다.
Who it’s for
코딩, 시스템 관리 또는 취약점 발견을 위해 자율형 AI 에이전트를 사용하는 개발자와 연구자로서, 명시적인 인간의 감독 없이 에이전트가 파괴적이거나 승인되지 않은 작업을 수행할 수 없도록 보장하고 싶은 분들입니다.
Highlights
- Constitution-to-Policy: 사람이 읽을 수 있는 영어 지침을 결정론적인 보안 규칙으로 변환합니다.
- Terminal Multiplexer: 인라인 에스컬레이션 피커와 신뢰할 수 있는 사용자 입력 캡처를 통해 도구 호출을 중재하는 TUI를 제공합니다.
- ** uma-agent Orchestration**: 에이전트별 보안 경계를 가진 복잡한 다중 에이전트 워크플로우(예: 취약점 발견)를 지원합니다.
- Persona Management: 고유한 헌법, 워크스페이스 및 메모리를 가진 이름이 지정된 정책 프로필을 생성할 수 있게 합니다.
- Defense in Depth: V8/Docker 격리와 LLM API 호출을 위한 MITM 프록시, 패키지 설치를 위한 검증 레지스트리 프록시를 결합합니다.
관련
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트
- 프로젝트