Anthropic의 오픈 웨이트 모델에 대한 입장

Anthropic은 오픈 웨이트 모델에 대한 금지를 옹호하지 않는다고 명시적으로 밝혔습니다. CEO Dario Amodei는 위험한 능력을 갖추지 않은 오픈 웨이트 모델이 필요한 컴퓨팅 비용 외에 추가 비용 없이 연구자, 개발자 및 기업에 가치를 제공함으로써 공공재 역할을 한다고 주장합니다.

국가 안보 우려 및 금지의 한계

Anthropic은 보호주의적 오픈 웨이트 모델 금지가 해결하지 못할 두 가지 주요 국가 안보 위험을 식별합니다:

1. 권위주의 군사 및 감시 우월성

주요 우려는 권위주의 정부—특히 중국 공산당(CCP)—가 영구적인 군사적 우월성을 달성하거나 심각한 내부 억압을 시행하기 위해 미국보다 더 강력한 AI 모델을 개발할 수 있다는 점입니다. Amodei는 가장 위험한 모델은 비밀리에 훈련되어 국가 안보 및 군사적 용도(예: 드론)로 예약된 모델일 가능성이 높으며, 이는 오픈 웨이트 상태나 미국 기업의 이러한 모델의 사용이 이 특정 위협에 무관함을 의미합니다.

2. 사이버 및 생물학적 공격에 대한 오용

두 번째 우려는 강력한 AI 모델이 사이버 공격, 생물학적 공격 또는 심각한 정렬(alignment) 문제로 인해 오용될 위험을 포함합니다. 오픈 웨이트 모델은 가드레일을 적용하기 어렵고 한 번 공개되면 웨이트를 회수할 수 없기 때문에 폐쇄형 모델보다 더 높은 위험을 나타낼 수 있지만, 미국 기업의 사용을 금지하는 것은 이 위험을 완화화지 못합니다. 악의적인 행위자는 합법적인 미국 기업일 가능성이 낮기 때문입니다.

AI 안전 및 보안을 위한 제안된 정책적 조치

오픈 웨이트 모델에 대한 전면적인 금지 대신, Anthropic은 세 가지 구체적인 전략적 조치를 옹호합니다:

하드웨어에 대한 제한된 접근

Anthropic은 중국에 강력한 칩과 칩 제조 장비를 판매하는 것을 금지하고 밀수 및 우회 방법을 단속하는 것을 지지합니다. 스케일링 법칙(scaling laws) 때문에 중국은 이러한 칩에 접근할 수 없으면 미국보다 더 강력한 모델을나 빌드할 수 없으므로, 이것이 우월한 권위주의 AI 개발을 차단하는 가장 직접적인 방법입니다.

산업 규모의 증류(Distillation) 억제

Anthropic은 산업 규모의 증류(distillation) 작업을 억제하기 위한 정책적 개입을 촉구합니다. 증류는 권위주의 국가가 가용 하드웨어로 평소에 허용되는 것보다 더 나은 모델을 구축할 수 있게 하여, 잠재적으로 중국의 프런티어 모델 수준을 미국의 프런티어 모델 수준과 몇 달 차이로 좁힐 수 있습니다. Amodei는 일부 기업이 증류를 수행하여 오픈 웨이트 모델을 공개하는 것은 사실이지만, 핵심 문제는 웨이트의 공개적 성격이 아니라 미국의 프런티어 모델을 추월격려는 국가 주도의 노력이라는 점을 명확히 합니다.

유능한 모델에 대한 의무적 안전 테스트

Anthropic은 오픈 웨이트인지 폐쇄형 웨이트인지, 또는 출신 국가에 관계없이 충분히 유능한 모든 모델에 대해 출시 전 생물학적, 사이버, 정렬 위험에 대한 의무적 안전 테스트를 거쳐야 한다고 제안합니다. Amodei는 AI 기반 생물학적 무기 방지에 관한 사항은 중국의 이익에도 부합하므로, 중국을 포함한 제한적인 글로벌 협력이 가능할 수 있다고 제안합니다.

오픈 웨이트 논쟁에 대한 관점

오픈 웨이트 모델을 지지하는 공개 서한에 대한 응답으로, Amodei는 오픈 웨이트가 경제적 접근성을 확대하고 경쟁을 강화한다는 점에 동의합니다. 그러나 그는 오픈 웨이트 모델이 반드시 안전장치를 개발하기 쉽게 만들거나 공격자보다 방어자에게 더 많은 이익을 이익을 준다는 주장에 대해서는 이견을 가합니다합니다.

Amodei는 생물학 분야에서 특정 "공격자-방어자 비대칭성"을 강조합니다. 유능한 모델이 바이러스를 무기화하는 데는 빠르게 수행할 수 있지만, 방어(예: 백신 개발)는 수년이 걸리는 운영적 과업업니다. 그는 이러한 위험이 사전에 가정되는 것이 아니라 출시 전 실증적 테스트를 통해 결정되어야 한다고 주장합니다.

Sources

관련