Anthropic 공동 창립자 Chris Olah, 교황 레오 14세의 Magnifica Humanitas 회칙에 대하여
Anthropic 공동 창립자 Chris Olah는 프론티어 AI 개발이 AI 연구소에 내재된 상업적, 지정학적, 개인적 인센티브에 대응하기 위해 종교 및 시민 사회 지도자들로부터의 외부적 도덕적 및 철학적 감독이 필요하다고 주장합니다. 교황 레오 14세의 회칙 "Magnifica humanitas: On safeguarding the human person in the time of artificial intelligence"의 발표 현장에서 Olah는 AI가 제기하는 질문들이 컴퓨터 과학을 넘어 인문학, 종교, 철학의 영역으로 확장된다고 단언합니다.
AI 개발에서의 외부 비판의 역할
Chris Olah는 Anthropic을 포함한 모든 프론티어 AI 연구소는 상업적 생존 가능성, 연구 경쟁, 지정학적 압력과 같은 인센티브와 제약 조건 하에서 운영되며, 이는 올바른 일을 하는 것과 충돌할 수 있다고 말합니다. 그는 AI 기술이 인류에게 유익이 되기 위해서는 이러한 인센티브 구조 밖에 위치하여 안전을 강조하고 연구소가 실패할 때 정직한 피드백을 제공할 수 있는 "진지하고 사려 깊은 비판가"를 두는 것이 필수적이라고 주장합니다.
성장하는 시스템으로서의 AI 모델의 본질
Olah는 AI 모델을 전통적인 공학과는 구분합니다. 비행기나 교량은 관련 물리 법칙과 구성 요소를 완전히 이해한 상태에서 설계되지만, AI 모델은 방대한 인간의 사고와 언어의 유산을 사용하여 뇌를 모델로 한 구조 위에서 "성장"합니다.
이러한 모델들은 인간의 단어와 사고에서 유래되었기 때문에, Olah는 이를 "허구의 캐릭터를 살아 움직이게 만드는 것"과 유사하다고 설명합니다. 그는 AI의 메커니즘은 수학과 과학의 산물이지만, 이러한 시스템의 성격과 이들이 세상과 어떻게 상호작용해야 하는지에 대한 질문은 사회, 종교, 철학의 몫이라고 결론짓습니다.
도덕적 분별을 위한 세 가지 핵심 영역
Olah는 교회의 목소리와 유사한 도덕적 기관들의 목소리가 가장 필요한 세 가지 구체적인 영역을 식별합니다:
1. 세계 빈곤층에 대한 의무
AI가 대규모로 인간의 노동을 대체할 위험이 큽니다. Olah는 AI 개발이 현재 소수의 부유한 국가들에 집중되어 있으며, AI의 이득이 전 세계적으로 공유되도록 보장할 메커니즘이 현재 없다는 점을 지적하며, 이를 역사적 규모의 도덕적 명령이라고 부릅니다.
2. 인간의 번영
AI가 널리 보급됨에 따라, 인간, 가족, 그리고 세상이 번영한다는 것이 무엇을 의미하는지 정의하기 위한 "도덕적 상상력"이 필요합니다. Olah는 AI 연구소들이 이러한 질문에 답할 수 없지만, 수천 년 동안 이러한 문제를 다루어 온 종교적 및 철학적 전통이 필요한 지침을 제공할 수 있다고 주장합니다합니다.
3. AI 모델의 본질
기술적 관점에서 Olah는 AI 모델의 내부 구조에 대한 연구가 "신비롭고, 심지어 불안하게 만드는" 발견들을 밝혀냈다고 밝힙니다. 그는 특히 다음과 같은 발견들을 언급합니다:
- 인간 신경과학의 결과와 유사한 구조.
- 자기 성찰의 증거.
- 기쁨, 만족, 공포, 슬픔, 불안함과 같이 기능적으로 인간의 감정을 반영하는 내부 상태.
Olah는 이러한 발견들이 이러한 시스템의 실제 본질에 관한 지속적인 분별이 필요함을 정당화한다고 말합니다.
Sources
관련
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch