OpenAI Codex: codex-1으로 구동되는 클라우드 기반 코딩 에이전트
OpenAI는 소프트웨어 엔지니어링을 위해 설계된 클라우드 기반 코딩 에이전트인 Codex를 출시했습니다. Codex는 codex-1 모델로 구동되며, 이는 OpenAI o3의 코딩 작업에 특화되어 최적화된 버전으로, 실제 코딩 작업에 대한 강화 학습을 통해 인간 스타일을 모방하고 지시를 정확히 따르며 코드가 통과할 때까지 반복적으로 테스트하도록 훈련되었습니다.
기술 아키텍처 및 실행 환경
Codex는 보안과 제어된 실행을 보장하기 위해 격리된 클라우드 컨테이너 내에서 작동합니다. 각 에이전트는 모델 실행 중 인터넷 접근이 차단된 자체 컨테이너에서 실행됩니다. 환경은 사용자의 코드베이스와 사용자가 정의한 개발 환경(필요한 모든 종속성, 설정 및 도구 포함)으로 미리 로드됩니다.
- 파일 시스템 접근: 에이전트는 컨테이너 내의 파일을 읽고 편집할 수 있습니다.
- 명령 실행: Codex는 터미널 명령을 실행할 수 있으며, 테스트, 린터, 타입 체커 등을 실행하여 자신의 작업을 검증합니다.
워크플로우 및 검증 가능성
Codex는 자신의 행동에 대한 검증 가능한 증거를 제공하도록 설계되었습니다. 모델은 터미널 로그와 파일에 대한 인용을 제공하여 사용자가 에이전트가 수행한 작업을 검증할 수 있게 합니다.
작업이 완료되면 사용자는 결과를 통합하기 위해 세 가지 주요 옵션을 선택할 수 있습니다:
- 검토: 사용자는 에이전트 작업의 결과를 검토할 수 있습니다.
- 정제: 사용자는 모델 출력에 대한 추가 변경이나 정제를 요청할 수 있습니다.
- 내보내기: 사용자는 생성된 diff를 GitHub 풀 리퀘스트로 내보내거나 코드를 복사하여 로컬 테스트 및 개발에 사용할 수 있습니다.
o3 및 o4-mini와의 관계
이 발표는 OpenAI o3 및 o4-mini 시스템 카드에 대한 부록으로, Codex 에이전트의 기능 및 codex-1 모델을 사용한 기술 구현에 대한 구체적인 세부 정보를 제공합니다.