프론티어 모델 포럼 업데이트

OpenAI, Anthropic, Google, 그리고 Microsoft는 프론티어 모델 포럼의 첫 번째 실행 이사 크리스 메제로레를 임명하고, 1천만 달러 규모의 AI 안전 기금을 출시했습니다. 이러한 이니셔티브는 리더십, 독립 연구 자금 지원, 그리고 업계 전반의 기술 표준 수립을 통해 프론티어 AI 모델의 안전하고 책임감 있는 개발을 보장하는 것을 목표로 합니다.

실행 이사 임명

브루킹스 연구소의 인공지능 및 신흥 기술 이니셔티브 디렉터를 역임했던 크리스 메제로레는 프론티어 모델 포럼의 첫 번째 실행 이사로 임명되었습니다. 이 직책에서 메제로레는 포럼의 사명을 이끌어가는 책임이 있습니다:

  • 잠재적 위험을 최소화하고 책임감 있는 개발을 촉진하기 위해 AI 안전 연구를 진전시킵니다.
  • 프론티어 모델에 대한 안전 모범 사례를 식별하고 수립합니다.
  • 학계, 정책 입안자, 시민 사회와의 지식 공유를 촉진합니다.
  • 주요 사회적 과제를 해결하기 위해 AI 사용을 지원합니다.

AI 안전 기금

AI 역량이 가속화됨에 따라 학계 연구의 격차를 해소하기 위해, 프론티어 모델 포럼과 여러 자선 파트너는 새로운 AI 안전 기금을 위한 초기 자금으로 1천만 달러 이상을 약속했습니다.

자금 출처 및 관리

이 기금은 Anthropic, Google, Microsoft, OpenAI 및 Patrick J. McGovern 재단, David and Lucile Packard 재단, Eric Schmidt, Jaan Tallinn과 같은 자선 파트너들의 지원을 받습니다. 이 기금은 Meridian Institute에서 관리되며, 독립적인 외부 전문가, AI 회사 대표, 그리고 보조금 전문가로 구성된 자문 위원회의 감독을 받습니다.

목표 및 범위

AI 안전 기금의 주요 초점은 학계 기관, 연구 센터, 스타트업의 독립 연구자들을 지원하는 것입니다. 이 기금은 프론티어 시스템에서 잠재적으로 위험한 능력을 테스트하기 위한 새로운 모델 평가 및 레드 팀링 기술 개발을 구체적으로 목표로 합니다. 이 이니셔티브는 2023년 초에 백악관에서 서명된 자발적 AI 약속의 일부를 이행하여第三方의 취약점 발견 및 보고를 용이하게 합니다.

기술 표준 및 레드 팀링

프론티어 모델 포럼은 연구자, 정부, 업계 동료들 간의 토론을 동기화하기 위해 정의 및 프로세스의 공통 기준을 수립하기 위해 노력하고 있습니다.

레드 팀링 표준화

포럼은 첫 번째 기술 작업 그룹 업데이트를 발표했으며,これに AI에 대한 'red teaming'의 공통 정의를 제공합니다. 포럼은 레드 팀링을 '해로운 능력, 출력, 또는 인프라 위협을 식별하기 위해 AI 시스템과 제품을 조사하는 구조화된 프로세스'로 정의합니다.

책임 있는 공개 프로세스

포럼은 프론티어 AI 연구소들이 발견된 취약점, 위험한 능력, 그리고 관련 완화 방안에 대한 정보를 공유할 수 있도록 책임 있는 공개 프로세스를 개발하고 있습니다. 이 프로세스는 포럼 구성원들이 국가 안보 영역 내에서 수행한 AI 능력 및 완화 방안에 대한 기존 연구를 기반으로 합니다.

미래 로드맵

프론티어 모델 포럼은 전략과 우선순위를 지도할 자문 위원회를 설립할 예정입니다. 향후 마일스톤에는 AI 안전 기금을 위한 첫 번째 제안 요청 공고 및 이용 가능해지는 추가 기술 결과의 발표가 포함됩니다.

Sources