OpenAI AI 안전 협력을 위한 프레임워크

OpenAI는 기업들이 안전에 대한 투자를 소홀히 하게 되는 집단 행동 문제(collective action problem)를 방지하기 위해, AI 안전 규범에 대한 장기적인 산업 협력을 개선하기 위한 네 가지 핵심 전략을 식별했습니다. 이러한 협력은 AI 시스템이 점점 더 강력해짐에 따라 안전하고 유익한 상태를 유지하도록 보장하는 데 필수적입니다.

AI 안전 협력을 개선하기 위한 네 가지 전략

안전 표준을 준수할 가능성을 높이기 위해, OpenAI는 다음과 같은 네 가지 실행 가능한 전략을 제안합니다:

1. 협력에 대한 정확한 신념 촉진

산업계 참여자들은 AI와 관련된 안전 및 보안 리스크를 소통하고 공유된 우려 사항을 공통 지식으로 만들어야 합니다. 협력을 촉진하기 위해 구체적인 조치를 취할 수 있음을 보여줌으로써, 기업들은 상호 이익을 위한 기회에 관한 자신들의 신념을 일치시킬 수 있습니다.

2. 공동 연구 및 엔지니어링 협업

기업들은 상호 보완적인 전문 분야를 결합하는 공동 학제간 연구에 참여해야 합니다. 이러한 협업은 그 해결책이 전체 분야에 광범위한 유용성을 제공하는 연구 및 엔지니어링 과제에 집중할 때 특히 효과적입니다.

3. 투명성 및 감독 강화

OpenAI는 AI 개발의 더 많은 측면을 적절한 감독과 피드백에 개방할 것을 제안합니다. 여기에는 행동 강령을 공개하고, 출판 관련 의사결정에 관한 투명성을 높이며, 지적 재산권 및 보안 문제를 해결하는 조건 하에 개별 AI 시스템을 정밀 조사할 수 있도록 하는 것이 포함됩니다.

4. 높은 안전 표준을 장려하는 인센티브 제공

산업계는 안전 표준을 준수하기 위한 경제적, 법적 또는 산업 전반의 인센티브를 지원해야 합니다. 이는 이러한 표준을 따르는 조직을 칭찬하고, 시스템이 안전하게 개발되도록 보장하지 못하는 조직을 비난하는 것을 포함합니다.

집단 행동 문제 해결

AI 산업에서의 경쟁 압력은 경쟁 우위를 위해 안전 규범에서 벗어나려는 유인이 안전 협력 유인보다 커지는 "집단 행동 문제"를 생성할 수 있습니다. OpenAI는 AI 실패 및 오용을 방지하는 것과 같은 안전한 개발의 상호 이익이 안전을 무시함으로써 얻는 이점보다 높을 때 협력이 더 일어날 가능성이 높다고 주장합니다.

안전 예방 조치를 무시하려는 유혹을 줄이기 위해, OpenAI는 다음과 같이 제안합니다:

  • 구현 비용 절감: 안전 조치를 구현하는 비용과 어려움을 낮추면 준수 유인이 더 매력적이게 됩니다.
  • 규제 환경: 정부는 중대한 안전 표준을 위반하는 것이 금지되는 규제 환경을 조성할 수 있습니다.

공동 연구를 위한 제안된 분야

OpenAI는 조직 및 국가의 경계를 넘어선 협업을 철저히 매핑할 것을 옹호하며, 특히 다음과 같이 광범위한 유용성을 가진 분야에 집중할 것을 제안합니다:

  • 형식 검증(Formal verification): AI 시스템의 능력 및 기타 안전 및 보안 측면의 형식 검증에 대한 공동 연구.
  • AI for good: 지속 가능성 및 건강과 같은 광범위한 긍정적 응용 분야를 가진 응용 프로젝트.
  • AI countermeasures: 온라인상의 합성 미디어 생성 오용과 같은 글로벌 위협에 대한 대응책의 공동 개발.

Sources