Hugging Face 멀티모달 프로젝트 윤리 헌장

Hugging Face는 멀티모달 학습 프로젝트를 위해 윤리 헌장을 도입하여 윤리적 고려사항이 연구 라이프사이클 초기에 통합되도록 했습니다. 이 프레임워크는 프로젝트 개발을 규정하는 가치와 콘텐츠 정책을 공식화함으로써 알고리즘 편향, 데이터 프라이버시 위반, 악의적 사용과 같은 위험을 완화하는 것을 목표로 합니다.

윤리 헌장의 목적 및 프레임워크

Hugging Face의 멀티모달 학습 그룹은 윤리적 고려사항을 사후 생각이 아닌 머신러닝 라이프사이클의 핵심 요소로 옮기기 위해 이 헌장을 개발했습니다. 프로젝트 초기 단계에서 이러한 원칙을 정의함으로써 팀은 모든 기술적 선택을 명확한 가치와 목표에 기반하고자 합니다.

  • 조기 피드백: 결정과 팀 역할에 대해 투명함으로써 Hugging Face는 의미 있는 변화를 구현할 수 있을 만큼 충분히 일찍 커뮤니티 피드백을 구합니다.
  • 협업 개발: 이 문서는 Hugging Face 연구원 및 엔지니어가 개인 프라이버시, 데이터 거버넌스, 윤리 구현 전문가들의 의견을 반영하여 작성했습니다.
  • 반복적 진화: 이 헌장은 2022년 5월 현재 진행 중인 작업이며, GitHub을 통해 업데이트를 추적하여 “윤리적 AI”의 진화하는 특성을 반영합니다.

콘텐츠 정책 및 금지 사용 사례

Hugging Face는 프로젝트가 방지하고자 하는 멀티모달 기술의 특정 오용을 식별했습니다. 콘텐츠 정책은 다음을 금지합니다:

  • 유해 콘텐츠: 폭력, 괴롭힘, 따돌림, 증오 및 인종, 성별, 연령, 능력, LGBTQA+ 지향, 종교, 교육, 사회경제적 지위 등 정체성 하위 집단에 대한 차별을 조장하는 행위.
  • 법적·권리 위반: 저작권, 프라이버시, 인권, 문화권, 기본권 또는 구속력 있는 법률 위반.
  • PII 생성: 개인 식별 정보를 생성하는 행위.
  • 허위 정보: 타인에게 해를 끼치거나 자극하려는 의도로 만든 허위 정보를 생성하거나, 책임 없이 제작하는 행위.
  • 고위험 분야 적용: 의료, 법률, 금융, 이민 등 삶에 근본적인 피해를 줄 수 있는 분야에서 모델을 부주의하게 사용하는 행위.

핵심 윤리 가치

프로젝트는 책임성과 공정성을 보장하기 위해 설계된 다섯 가지 주요 가치에 의해 안내됩니다:

  • 투명성: 의도, 데이터 출처, 도구 및 결정에 대한 개방성을 통해 커뮤니티가 약점을 식별하고 팀에 책임을 물을 수 있도록 합니다.
  • 개방성 및 재현성: 데이터, 도구 및 실험 조건에 대한 정확한 설명을 공유합니다. 연구 산출물과 모델 체크포인트는 차별 없이 모두가 접근 가능해야 합니다.
  • 공정성: 모든 인간을 동등하게 대우하는 것으로 정의되며, 인종, 성별, 장애, 성적 지향과 관련된 편향을 모니터링하고 완화해야 합니다. 여기에는 훈련 데이터와 모델 출력 모두에 대한 편향 검토가 포함됩니다.
  • 자기비판: 과대광고와 과장된 주장을 피하고, 훈련 데이터의 선별 및 필터링을 위한 더 나은 전략을 지속적으로 모색하는 약속.
  • 크레딧 부여: 적절한 라이선스와 크레딧을 통해 타인의 작업을 존중합니다.

가치 충돌 관리

Hugging Face는 윤리적 가치가 실제로 충돌할 수 있음을 인정합니다. 예를 들어, 개방적이고 재현 가능한 작업을 공유하려는 목표가 개인 프라이버시를 존중하거나 공정성을 보장해야 하는 필요와 충돌할 수 있습니다. 팀은 이러한 긴장이 최선의 행동 방침을 결정하기 위해 위험과 이익을 사례별로 분석해야 함을 강조합니다.

Sources