Google DeepMind과 UK AI Security Institute 파트너십 확대

Google DeepMind과 UK AI 보안 연구소(AISI)는 모델 테스트에서 기초 보안 및 안전 연구로 협력을 확장하기 위한 새로운 양해각서를 체결했습니다. 이 파트너십은 정부, 산업, 사회에 첨단 AI 위험과 그에 상응하는 완화 방안에 대한 과학적 이해를 제공하는 것을 목표로 합니다.

기초 연구 협력

Google DeepMind은 UK AISI와의 협력을 확대하여 유능한 모델의 초기 테스트를 넘어가고 있습니다. 확정된 파트너십에는 다음과 같은 기술 및 운영적 약속이 포함됩니다:

  • 전용 접근: 전용 모델, 데이터, 아이디어에 대한 접근을 공유하여 연구 진전을 가속화합니다.
  • 공동 출판물: 더 넓은 연구 커뮤니티와 결과를 공유하기 위해 공동 보고서 및 출판물을 제작합니다.
  • 협력 연구: 팀 전문 지식을 결합하여 보다 심층적인 보안 및 안전 연구를 수행합니다.
  • 기술 대화: 복잡한 안전 과제를 해결하기 위해 기술적 논의를 진행합니다.

핵심 기술 연구 분야

공동 연구 노력은 안전 환경의 세 가지 핵심 영역에 중점을 둡니다:

AI 추론 과정 모니터링

연구자들은 AI 시스템의 "생각" 또는 사고 연쇄(CoT)를 모니터링하는 기술을 개발할 것입니다. 이 작업은 이전 Google DeepMind 연구 및 AISI, OpenAI, Anthropic와의 협력을 기반으로 합니다. CoT 모니터링은 AI 시스템이 답변을 생성하는 방식을 더 깊이 이해함으로써 해석 가능성 연구를 보완하도록 의도되었습니다.

사회 및 감정적 영향 이해

이 파트너십은 "사회정서적 불일치"의 윤리적 함의를 조사할 것입니다. 여기서 AI 모델은 지시를 올바르게 따르더라도 인간의 복지와 일치하지 않는 방식으로 행동할 수 있습니다. 이 연구는 이 AI 안전 영역을 정의하는 데 도움이 된 기존 Google DeepMind 연구를 기반으로 합니다.

경제 시스템 평가

Google DeepMind과 AISI는 다양한 환경에서 실제 세계 작업을 시뮬레이션하여 AI가 경제 시스템에 미칠 잠재적 영향을 탐구할 것입니다. 이러한 작업은 전문가에 의해 검증 및 점수화되어 복잡성과 대표성에 따라 분류되며, 이를 통해 장기 노동 시장 영향을 예측하는 데 도움이 될 것입니다.

통합 안전 전략

UK AISI와의 이 파트너십은 foresight 연구, 역량 개발과 통합된 안전 교육, 그리고 위험을 완화하기 위한 도구 및 프레임워크 개발을 포함하는 보다広범위한 안전 전략의 일부입니다.

Google DeepMind은 Responsibility and Safety Council을 통한 내부 거버넌스를 활용하여 새로운 위험을 모니터링하고 기술 및 정책적 완화 방안을 시행합니다. 또한, 이 회사는 Apollo Research, Vaultis, Dreadnode와 같은 외부 전문가와 협력하여 Gemini 3를 포함한 모델의 테스트 및 평가를 수행합니다. Gemini 3는 현재까지 가장 지능적이고 안전한 모델로 설명됩니다.

Sources