DeepSeek, 미-중 컴퓨팅 격차에 관한 유출된 발언 속에 투자 유치 일시 중단

DeepSeek, 미-중 컴퓨팅 격차에 관한 유출된 발언 속에 투자 유치 일시 중단

DeepSeek의 창립자 Liang Wenfeng이 중국과 미국 사이의 "컴퓨팅 격차(compute gap)"에 대해 솔직한 평가를 내린 투자자 회의 녹취록이 유출됨에 따라, DeepSeek가 2차 투자 유치를 일시 중단했습니다. 이번 유출은 하드웨어 가용성에서의 상당한 불균형을 강조하며, DeepSeek는 이것이 중국 AI 연구소들이 미국의 프런티어 모델에 필적하는 것을 막는 주요 병목 현상이라고 믿고 있습니다.

하드웨어 부족과 "산술적 문제"

Liang Wenfeng은 중국 AI 개발의 불리함을 인재 부족이 아닌 자원 문제로 규정합니다. 유출된 발언에 따르면, 팀들의 기술 및 배경 측면에서 실질적으로 동일하기 때문에 인력 격차는 미미합니다. 주요 장애물은 가용 가능한 컴퓨팅 자원의 절대적인 양입니다.

유출된 투자자 논의의 주요 세부 사항은 다음과 같습니다:

  • 칩 조달 격차: Liang은 프런티어 모델을 훈련하는 데 200,000개의 Huawei 950 칩이 필요하다고 언급했으나, 실제로 받은 것은 16,000개에 불과했다고 전해졌습니다.
  • 공급망 제약: 이러한 부족 현상은 Huawei의 불충분한 생산 능력 때문이며, Liang은 이 상황이 최소 3년 동안 지속될 것으로 예상합니다.
  • 재무 규모: Liang은 연간 조달에 20억(아마도 USD)을 지출하는 것이 해당 부서의 "탁월한 성과"로 간주될 것이라고 언급했는데, 이는 현재의 지출 수준이 세계 최대 규모의 모델을 훈련하는 데 필요한 수준보다 훨씬 낮음을 시사합니다.

모델 훈련에 대한 전략적 접근

하드웨어 제약에도 불구하고, DeepSeek는 미국 경쟁사들이 사용하는 컴퓨팅 자원의 일부만을 활용하여 미국 연구소와의 격차를 3~6개월 이내로 좁히는 것을 목표로 하고 있습니다. 이 전략은 원시 하드웨어 성능의 부족을 보완하기 위해 알고리즘 효율성에 집중합니다.

미국 기술로부터의 전환과 관련하여, 녹취록에 따르면 V3 훈련 중에는 NVIDIA GPU가 사용되었으나, 더 이상 NVIDIA 생태계를 사용하지 않는 것으로 나타났습니다. 이는 향후의 중단을 피하기 위해 미국 기반 소프트웨어 스택으로부터 분리되려는 전략적 움직임을 시사합니다.

커뮤니티 분석 및 반론

기술 관찰자들과 투자자들은 이러한 유출이 시사하는 바에 대해 몇 가지 점을 제기했습니다:

  • 절대적 프런티어의 가치: 일부 분석가들은 중국 모델이 비용의 아주 일부만으로 프런티어에 근접한 성능에 도달할 수 있다면, AI를 범용화(commoditizing)하고 미국 연구소들이 수행한 막대한 투자에 대한 수익을 감소시킬 수 있으므로 "절대적 프런티어"를 달성하는 것이 반드시 필요한지에 대해 의문을 제기합니다.
  • 전략적 신호: Liang의 솔직함이 중국 정부나 국내 칩 제조업체에 자원 할당을 늘리도록 압박하기 위한 전략적 움직임인지에 대한 회의적인 시각이 있습니다.
  • 국내 산업의 변화: 일부 관찰자들은 중국 기업들이 국내 반도체 산업의 성장을 강제하기 위해 미국이 아닌 중국 정부에 의해 NVIDIA 칩 구매가 점점 더 금지되는 광범위한 추세를 지적합니다.

"우리와 미국 사이의 가장 큰 격차는 자원에 있습니다." — Liang Wenfeng

Sources