AI와 수학적 추론: 작업 기억 가설
작업 기억 가설
AI가 복잡한 수학 문제를 해결하는 데 능숙하다는 점은 일반 지능의 증가나 수학적 직관의 발달 때문이라고 여겨지곤 한다. 그러나 더 설득력 있는 대안적 설명은, 인간 뇌보다 훨씬 더 큰 효과적인 작업 기억을 AI가 지니고 있다는 것이다. AI는 막대한 외부 기호적 작업 공간—특히 컨텍스트 창—을 활용함으로써 인간 추론에 가장 큰 생물학적 제약 중 하나인 동시에 여러 낯선 요소를 유지하고 조작하는 능력의 한계를 제거한다.
작업 기억이 인지적 병목 현상이 되는 이유
작업 기억은 짧은 기간 동안 정보를 유지하고 조작하는 데 사용되는 정신 시스템이다. 수학에서는 변수, 연산, 가정, 중간 보조정리 등을 추적하는 데 필요하다. 인간의 작업 기억은 심각하게 제한되어 있다. 예를 들어, 두 개의 세 자리 수를 머릿속에서 곱하는 것이 어렵다는 것은 연산 자체가 간단하기 때문이 아니라, 부분 결과를 유지하는 데 어려움이 있기 때문이다.
연구에 따르면, 작업 기억은 일반 지능 외에도 수학 성과를 독립적으로 예측하는 요소이다. Alloway와 Passolunghi(2011) 및 Alloway와 Alloway(2010)의 연구는 작업 기억 측정이 어린이의 수학 능력과 학업 성취에 독특한 기여를 한다는 것을 발견했으며, 때로는 지능 지수(IQ)보다 더 강력한 예측 변수가 되기도 했다. 이는 유사한 지능을 가진 개인들 사이에서, 작업 기억에서 정보를 조작하는 능력이 수학적 성공을 결정짓는 경우가 많다는 것을 시사한다.
AI의 증강된 기호적 작업 기억
사람들은 스케치 종이를 사용해 작업 기억을 확장하지만, AI 모델은 컨텍스트 창을 막대한 외부 노트북처럼 사용한다. 이 '증강된 기호적 작업 기억'은 모델이 전체 문제 진술, 수백 개의 중간 방정식, 여러 번 포기한 접근 방식을 동시에 활성화할 수 있게 한다.
추론의 외부화
사람들은 사적인 내부 정신 상태를 유지할 수 있지만, 일반적인 언어 모델은 이미 생성한 토큰의 순서를 통해 상태를 유지한다. 텍스트는 단순한 사고 과정의 보고가 아니라, 추론 자체의 메커니즘이다. 이 '소리 내어 생각하기'는 수학에서 전략적 우위를 제공한다. 왜냐하면:
- 명시적 제약: AI는 매 단계마다 활성 제약(예: "n은 홀수, p는 소수")을 다시 표현할 수 있어, 인간 수학자들이 자주 겪는 "기록 오류"를 방지할 수 있다.
- 구성적 안정성: 수학적 추론은 매우 구성적이다(A → B → C → D). 큰 작업 공간은 AI가 전반적인 구조를 잃지 않고 긴 추론 체인을 구성할 수 있게 한다.
- 검증 가능성: 수학 기호는 모호성을 줄이도록 설계되어 있어, 단계를 기록하고 검증할 수 있는 대규모 텍스트 작업 공간에서 작동하는 지능에 완벽하게 적합하다.
도메인 특수성: 수학 vs. 비형식적 추론
막대한 컨텍스트 창의 장점은 모든 영역에 적용되는 것은 아니다. 수학에서만 특히 강력하다. 왜냐하면 수학은 명확하고 검증 가능한 방식으로 인위적으로 구성된 도메인이기 때문이다.
반면, 비형식적 추론(예: 사회적 또는 정치적 분석)은 불안정한 개념과 숨겨진 원인에 의존한다. 더 큰 컨텍스트 창은 AI가 더 많은 데이터를 검토할 수 있게 하지만, 관측되지 않은 사실을 회수하거나 "공정하다"나 "책임감 있다"와 같은 용어의 본질적 모호성을 해결할 수는 없다. 이러한 영역에서 중심적인 과제는 불확실성 하에서 올바른 인과 모델을 식별하는 것이며, 기호적 장부를 관리하는 것이 아니다.
폰 노이만 vs. 아인슈타인의 구분
AI와 인간 수학적 천재성의 차이는 존 폰 노이만과 알버트 아인슈타인의 능력 차이로 설명될 수 있다. 물리학자 유진 위그너가 지적했듯이, 폰 노이만은 거대한 양의 정보와 복잡한 논증을 처리하는 데 있어서 뛰어난 속도와 용량을 지녔다. 반면 아인슈타인은 문제를 완전히 재구성할 수 있는 더 깊고 더 창의적인 능력으로 특징지어진다.
현재 AI는 폰 노이만의 능력을 기계적으로 증폭한 형태로 보인다—매우 빠르고 광범위하며, 막대한 양의 명시적 정보를 유지할 수 있다. AI의 다음 단계는 "아인슈타인적 깊이"를 달성하는 것이다. 즉, 문제가 잘못 설정되었음을 인식하고, 문제를 이해하는 데 있어 근본적으로 새로운 방식을 창안할 수 있는 능력이다.
커뮤니티 관점의 통합
기술 전문가들 사이의 논의는 "기억력 우월성" 효과가 수학을 넘어서 소프트웨어 공학과 일반적인 문제 해결에도 확장된다는 점을 시사한다:
- 지식 재조합: 일부는 높은 지능으로 여겨지는 많은 것이 실제로는 다른 사람들이 동시에 보유하지 못하는 다양한 지식 조각(A + B)을 결합할 수 있는 능력이라고 주장한다.
- 강제적 접근과 인내심: AI는 인간의 정서적·신체적 피로를 겪지 않기 때문에, 부정적인 결과에 좌절하지 않고 "강제적 접근" 방식으로 연구 방향을 탐색할 수 있다.
- 부정적 흔적의 가치: 인간 수학자들이 주로 긍정적 결과만 발표하는 반면, AI는 실패한 시도인 "부정적 흔적"을 쉽게 저장하고 재사용할 수 있어, 같은 실수를 반복하는 것을 피할 수 있다.
- 추상화의 비용: 일부 관찰자들은 AI가 기억 제약이 없기 때문에 인간의 제한된 작업 기억에 맞추어 문제를 단순화할 필요가 없기 때문에, 더 장황한 코드를 생성하고 더 적은 추상화를 하게 된다고 지적한다.
"AI는 동일한 아키텍처에 얽매이지 않는다. 추론을 텍스트로 전환하고, 그 텍스트를 막대한 외부 인지적 작업 공간으로 사용할 수 있다."
Sources
관련
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch