GPT-5 시스템 카드 추가문: 민감한 대화

OpenAI는 GPT-5 시스템 카드의 추가문을 발표하여 정신 및 정서적 고통을 포함한 민감한 대화를 처리하는 모델의 방식 개선을 상세히 설명했습니다. 170명 이상의 정신 건강 전문가와의 협력을 통해 OpenAI는 원하는 안전 행동에 미치지 못하는 응답을 65-80% 감소시켰습니다.

모델 업데이트 및 안전 개선

2025년 10월 3일, OpenAI는 ChatGPT의 기본 모델에 업데이트를 배포하여 고통의 징후를 인식하고 지지적이며 돌봄 지향적인 응답을 제공하는 능력을 향상시켰습니다. 이 업데이트는 민감한 상황에서 부족하거나 부적절한 응답을 제공하는 대신 사용자를 실제 세계의 지원 시스템으로 안내하는 데 중점을 둡니다.

기준 안전 평가

업데이트의 효과를 측정하기 위해 OpenAI는 10월 3일 모델 버전을 8월 15일 ChatGPT 기본 모델 버전(GPT-5 Instant이라고 알려짐)과 비교했습니다.その結果 평가는 민감한 대화를 처리하는 모델의 향상된 성능에 대한 기준이 됩니다.

전문가 협력

안전 개선은 170명 이상의 정신 건강 전문가와의 파트너십을 통해 개발되었습니다. 이 협력을 통해 모델의 응답은 정서적 고통을 겪는 개인을 인식하고 지원하는 전문 표준과 더 신뢰할 수 있게 일치하도록 보장되었습니다.

Sources