DALL·E 2에서 편향 감소 및 안전성 향상
OpenAI는 전 세계 인구 다양성을 보다 정확하게 반영하도록 사람 이미지 생성에 새로운 시스템 수준 기술을 도입했습니다. 이번 업데이트는 학습 데이터의 편향을 해결하고, 기만적인 콘텐츠 및 공인 이미지 생성 방지를 위한 안전 프로토콜을 강화합니다.
표현 및 다양성 향상
DALL·E 2는 사용자가 인종이나 성별을 명시하지 않은 사람을 설명하는 프롬프트(예: "소방관")를 제공할 때 작동하는 완화 기술을 사용합니다. 이 시스템 수준 개입은 모델이 좁은 고정관념에 기본적으로 의존할 가능성을 줄이기 위해 설계되었습니다.
내부 평가에 따르면 이 기술은 매우 효과적이며, 완화가 적용된 후 사용자는 DALL·E 이미지에 다양한 배경을 가진 사람들이 포함되었다고 보고할 확률이 12배 높아졌습니다.
안전 시스템 강화
2022년 4월에 시작된 연구 미리보기 단계 이후, OpenAI는 초기 사용자들이 민감하고 편향된 이미지를 신고한 피드백을 바탕으로 여러 안전 업데이트를 구현했습니다. 이러한 개선 사항에는 다음이 포함됩니다:
기만적인 콘텐츠 및 공인 이미지
기만적인 콘텐츠 생성 남용 위험을 최소화하기 위해 DALL·E 2는 이제 다음을 거부합니다:
- 현실적인 얼굴이 포함된 이미지 업로드.
- 유명 정치인 및 연예인 등 공인의 모습을 생성하려는 시도.
콘텐츠 필터링 및 모니터링
OpenAI는 창의적 표현과 정책 집행 사이의 균형을 더 잘 맞추기 위해 안전 인프라를 정제했습니다:
- 정확도 향상: 콘텐츠 필터가 OpenAI의 콘텐츠 정책을 위반하는 프롬프트와 이미지 업로드를 차단하는 데 더 효과적으로 업데이트되었습니다.
- 모니터링 강화: 자동 및 인간 모니터링 시스템이 시스템 남용 방지를 위해 더욱 정교해졌습니다.
배포 전략
OpenAI는 책임 있는 배포 전략의 일환으로 DALL·E 2에 대한 접근성을 확대하고 있습니다. 연구소는 사용자 기반을 확대함으로써 실제 사용 패턴에 대해 더 많이 학습할 수 있게 되고, 이는 안전 시스템의 지속적인 반복과 AI 시스템이 학습 데이터에 존재하는 편향을 어떻게 반영하는지에 대한 깊은 이해를 가능하게 한다고 밝혔습니다.