OpenAI Trusted Access for Cyber
OpenAI는 보안 전문가들에게 사이버 역량을 갖춘 GPT-5.3-Codex 모델에 대한 우선적인 접근 권한을 제공하기 위해 설계된 신원 및 신뢰 기반 프레임워크인 Trusted Access for Cyber를 도입했습니다. 이 이니셔티브는 악의적인 행위자에 의한 오용 위험을 완화하는 동시에 소프트웨어 취약점의 발견 및 해결을 가속화하는 것을 목표로 합니다.
GPT-5.3-Codex and Cyber Defense Capabilities
GPT-5.3-Codex는 현재까지 OpenAI의 가장 강력한 사이버 역량을 갖춘 프런티어 추론 모델입니다. 코드 스니펫을 자동 완성하는 데 국한되었던 이전 모델들과 달리, GPT-5.3-Codex는 복잡한 사이버 보안 작업을 수행하기 위해 몇 시간 또는 며칠 동안 자율적으로 작동할 수 있습니다. 이러한 기능은 조직이 보안 태세를 강화하고, 대응 시간을 단축하며, 심각하고 표적화된 공격에 대한 전반적인 회복탄력성을 향상할 수 있도록 합니다.
The Trusted Access for Cyber Framework
OpenAI는 표준 안전 완화 조치로 인해 발생하는 마찰을 줄이기 위해 신뢰 기반 접근 모델을 시범 운영하고 있습니다. "내 코드의 취약점을 찾아줘"와 같은 요청은 방어적 패치 작업이나 악의적인 공격에 모두 사용될 수 있기 때문에, 표준 제한 사항은 종종 선의의 보안 작업을 방해하곤 합니다.
이를 해결하기 위해 OpenAI는 사이버 보안 전문가를 위해 세 가지 단계의 접근 권한을 제공합니다:
- Identity Verification: 개별 사용자는
chatgpt.com/cyber에서 신원을 확인하여 고위험 사이버 보안 작업을 위한 모델에 접근할 수 있습니다. - Enterprise Access: 조직은 OpenAI 담당자를 통해 팀 전체에 대한 신뢰할 수 있는 접근 권한을 요청할 수 있습니다.
- Invite-Only Program: 정당한 방어적 작업을 위해 더 허용적인 또는 고성능의 모델이 필요한 보안 연구원은 초청 전용 프로그램에 지원할 수 있습니다.
신뢰할 수 있는 접근 권한을 가진 사용자는 OpenAI의 Usage Policies 및 Terms of Use를 계속 준수해야 합니다. 이 프레임워크는 멀웨어 생성, 데이터 유출 및 승인되지 않은 테스트와 같은 금지된 행동을 방지하기 위해 설계되었습니다.
Safety Mitigations and Monitoring
OpenAI는 위험을 관리하기 위해 안전 교육과 자동화된 모니터링의 조합을 사용합니다. GPT-5.3-Codex는 자격 증명 도난과 같이 명백히 악의적인 요청을 거부하도록 학습되었습니다. 또한, 의심스러운 사이버 활동의 신호를 감지하기 위해 자동화된 분류기 기반 모니터가 사용됩니다. OpenAI는 이러한 완화 조치가 정책 조정 단계 동안 개발자와 보안 전문가에게 영향을 미칠 수 있다고 언급했습니다.
Cybersecurity Grant Program
OpenAI는 방어적 사이버 작업을 더욱 확장하기 위해 Cybersecurity Grant Program을 통해 1,000만 달러 상당의 API 크레딧을 지원하기로 약속했습니다. 이 프로그램은 오픈 소스 소프트웨어 및 핵심 인프라 시스템의 취약점을 식별하고 해결한 입증된 실적이 있는 팀을 대상으로 합니다.
Sources
관련
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch