Google DeepMind: 알파고의 10년 영향
Google DeepMind는 알파고가 10년 전 개척한 기술이 복잡한 게임을 마스터하는 단계에서 벗어나 근본적인 과학적 과제를 해결하고 인공 일반 지능(AGI) 개발에 정보를 제공하는 수준으로 진화했다고 발표했습니다. 2016년 세계 챔피언 Lee Sae Dol에 대한 승리는 AI가 인간 전문가를 모방하는 것을 넘어 새로운 전략을 발견할 수 있음을 보여주었으며, 검색 및 강화 학습을 실제 과학 문제에 적용하기 위한 로드맵을 제시했습니다.
알파고의 기술적 기반
알파고는 $10^{170}$개의 가능한 위치를 가진 바둑의 극한 복잡성을 딥 뉴럴 네트워크와 고급 검색 및 강화 학습을 결합함으로써 극복했습니다. 시스템의 학습 과정은 두 가지 주요 단계로 이루어졌습니다:
- Supervised Learning: 알파고는 먼저 인간 전문가가 둔 게임을 연구하여 가능한 수들의 모델을 학습했습니다.
- Reinforcement Learning: 그 후 시스템은 자체와 수백 수천 번의 게임을 두어 가장 강력한 승리 전략을 강화했습니다.
게임을 다루기 쉽게 만들기 위해 알파고는 가장 가능성이 높은 경로들의 부분 집합을 분석하여 승리로 이어질 가능성이 가장 높은 수를 식별했습니다. 이 접근법은 AlphaGo Zero에서 더욱 정교화되었으며, AlphaZero는 게임 규칙만을 사용해 바둑, 체스, 쇼기 등을 처음부터 마스터한 일반화된 시스템으로, 인간 최고 수준의 플레이어와 Stockfish와 같은 특화 프로그램을 물리쳤습니다.
게임에서 과학적 돌파구로의 전환
DeepMind는 알파고가 입증한 방대한 검색 공간을 탐색하는 능력을 물리적 세계에 적용하여 여러 고영향 과학적 성과를 이끌어냈습니다:
단백질 접힘과 AlphaFold
2020년에 DeepMind는 AlphaFold 2를 통해 3D 단백질 구조 예측이라는 50년간의 대규모 도전을 해결했습니다. 이 시스템은 현재 2억 개의 알려진 모든 단백질 구조를 접히게 하며, 오픈소스 데이터베이스에 제공되어 300만 명이 넘는 연구자들이 말라리아 백신 및 플라스틱 분해 효소 연구에 활용하고 있습니다. 이 연구는 2024년에 John Jumper와 Demis Hassabis에게 화학 분야 노벨상을 안겨주었습니다.
수학적 추론
AlphaProof는 알파고 아키텍처의 직접적인 후계자로, 언어 모델과 AlphaZero의 강화 학습 및 검색 알고리즘을 결합해 형식적인 수학 명제를 증명합니다. AlphaGeometry 2와 함께 AlphaProof는 국제수학올림피아드(IMO)에서 은메달 수준을 달성했습니다. 이후 Gemini의 "Deep Think" 모드의 고급 버전이 2025년 IMO에서 금메달 수준의 성과를 기록했습니다.
알고리즘 발견 및 과학 협업
- AlphaEvolve: Gemini 기반 코딩 에이전트로, 컴퓨터 코드를 탐색하여 효율적인 알고리즘을 찾습니다. 현대 신경망의 핵심 연산인 행렬 곱셈에 대한 새로운 방법을 발견했습니다.
- AI Co-scientist: 검색 및 추론 원리를 통합해 에이전트가 과학적 가설을 "토론"할 수 있게 하는 시스템입니다. 런던 임페리얼 컬리지의 검증 연구에서, 인간 연구자들이 수년간 개발하는 데 걸렸던 항생제 내성에 관한 가설을 독립적으로 도출했습니다.
DeepMind는 또한 이러한 기술을 활용해 유전체, 핵융합 에너지, 날씨 예측 분야의 연구를 진전시켰습니다.
인공 일반 지능(AGI)으로 가는 길
DeepMind는 AGI로 가는 길에 세 가지 핵심 요소의 통합이 필요하다고 주장합니다:
- World Models: 언어, 오디오, 비디오, 이미지, 코드를 이해하는 Gemini와 같은 다중모달 시스템.
- Search and Planning: 알파고와 AlphaZero가 개척한 추론 및 검색 기술.
- Specialized Tool Use: 일반 모델이 특화된 AI 도구를 호출할 수 있는 능력(예: AlphaFold를 사용해 단백질 구조를 예측).
"Move 37"이 AI의 틀을 깨는 사고 능력을 보여준 반면, DeepMind는 진정한 독창적 발명을 기존 게임을 마스터하는 것뿐만 아니라 바둑만큼 깊고 우아한 새로운 게임을 창조하는 능력으로 정의합니다.