ChatGPT 잠금 모드 및 고위험 라벨
OpenAI는 프롬프트 인젝션 공격으로부터 사용자를 보호하고 무단 데이터 유출을 방지하기 위해 잠금 모드와 “고위험” 라벨링 시스템을 도입했습니다. 이러한 도구는 보안에 대한 방어 심층 전략을 제공하며, 고위험 사용자와 조직이 일부 제품 기능을 포기하고 더 엄격한 가드레일을 적용할 수 있게 합니다.
잠금 모드: 고위험 사용자를 위한 결정론적 보안
잠금 모드는 임원이나 보안 팀과 같이 보안 요구가 높은 사용자를 위해 설계된 선택적 고급 보안 설정으로, 프롬프트 인젝션 기반 데이터 유출 위험을 감소시킵니다. 활성화되면 특정 도구와 기능을 결정적으로 비활성화하거나 제한함으로써 ChatGPT가 외부 시스템과 상호 작용하는 방식을 엄격히 제어합니다.
잠금 모드의 주요 제한 사항
민감한 데이터가 대화 외부로 공유되는 것을 방지하기 위해, 잠금 모드는 다음 기능들을 제한하거나 비활성화합니다:
- 실시간 웹 액세스: 웹 브라우징이 캐시된 콘텐츠로 제한되어, 실시간 네트워크 요청이 OpenAI의 제어된 네트워크를 벗어나지 않도록 합니다.
- 이미지 지원: 응답에서 이미지 지원이 비활성화됩니다.
- 심층 연구: 쇼핑 조사 기능을 포함합니다.
- 에이전트 모드 및 캔버스 네트워킹: 이 연결된 기능들이 비활성화됩니다.
- 실시간 커넥터 및 파일 다운로드: 프롬프트 인젝션 스타일 공격의 공격 표면을 줄이기 위해 비활성화됩니다.
가용성 및 관리
잠금 모드는 처음에 ChatGPT Enterprise, Edu, Healthcare, Teachers 플랜에 도입되었습니다. 2026년 6월 4일 현재, 개인 ChatGPT 계정 및 셀프 서비스 ChatGPT Business 계정에도 확대 적용되었습니다.
조직 관리자에게 잠금 모드는 기존 관리자 설정 위에 추가 제한을 겹칩니다. 관리자는 워크스페이스 설정에서 새 역할을 생성하여 이를 활성화할 수 있습니다. 중요한 워크플로우를 유지하기 위해, 관리자는 잠금 모드에서 사용자가 이용할 수 있는 특정 앱 및 해당 앱 내 작업을 세부적으로 제어할 수 있습니다.
고위험 라벨: 표준화된 위험 커뮤니케이션
OpenAI는 ChatGPT, ChatGPT Atlas, Codex 전반에 걸쳐 일관된 안내를 제공하기 위해 “고위험” 라벨 사용을 표준화하고 있습니다. 이러한 라벨은 산업 전반의 안전 완화 조치로 아직 완전히 해결되지 않은 네트워크 관련 위험을 초래하는 기능에 적용됩니다.
구현 및 목적
“고위험” 라벨은 사용자가 문서 조회를 위한 Codex의 네트워크 접근과 같이 추가 보안 위험을 초래할 수 있는 기능을 활성화할 때 이를 사용자에게 알립니다. 이를 통해 사용자는 개인 데이터를 다룰 때 해당 기능을 사용할지 여부에 대해 정보에 입각한 선택을 할 수 있습니다.
OpenAI는 보안이 충분히 향상되어 일반 사용에 대한 위험이 완화되면 이러한 라벨을 제거할 것이며, 라벨이 부착된 기능 목록은 시간이 지나면서 업데이트될 것이라고 밝혔습니다.
방어 심층 전략
OpenAI의 보안 접근 방식은 AI 시스템이 더욱 강력하고 연결될수록 실용적인 보호를 제공하는 데 중점을 둡니다. 잠금 모드와 같은 결정론적 설정을 투명한 위험 라벨링과 결합함으로써, OpenAI는 제3자가 AI 시스템을 오도하여 민감한 정보를 누설하거나 악의적인 명령을 수행하도록 하는 프롬프트 인젝션이라는 새로운 위험을 완화하고자 합니다.