Anthropic의 오픈-웨이트 모델에 대한 입장: 금지를 옹호하지 않음, 칩 통제, 증류, 안전 테스트에 집중
Anthropic의 오픈-웨이트 모델에 대한 입장: 금지를 옹호하지 않음, 칩 통제, 증류, 안전 테스트에 집중
Anthropic의 오픈-웨이트 모델에 대한 입장
Anthropic은 오픈-웨이트 모델에 대한 금지를 옹호한 적이 없습니다. 게시물은 다음과 같이述べ고 있습니다: "Anthropic은 오픈-웨이트 모델에 대한 금지를 옹호한 적이 없습니다." 이 글은 위험한 능력이 없는 오픈-웨이트 모델을 기업, 개발자, 연구자에게 가치를 제공하는 공공재로 묘사합니다.
핵심 국가 안보 우려
다리오 아모데이는 그의 정책 관점을 이끄는 두 가지 악몽 시나리오를 식별합니다. 첫째, 중국 공산당에 한정되지 않은 권위주의 정부는 미국이 구축한 모델보다 더 강력한 AI 모델을 구축하여 영구적인 군사적 우위를 달성하거나 깊은 국내 억압을 달성할 수 있습니다. 둘째, 강력한 AI 모델은 사이버 공격, 생물학적 공격에 악용되거나 심각한 정렬 문제를 겪을 수 있으며, 오픈-웨이트 모델은 가드레일을 적용하기 어렵고 공개된 가중치를 철회할 수 없기 때문에 더 높은 위험을 초래합니다.
제안된 정책 조치
Anthropic은 이러한 우려를 해결하기 위한 세 가지 구체적인 조치를 지지합니다. 첫째, 미국은 중국에 강력한 칩이나 칩 제조 장비를 판매해서는 안 되며, 그러한 칩에 대한 접근을 가능하게 하는 밀수와 우회로를 단속해야 하며, 이는 권위주의적인 AI 훈련 능력을 제한해야 합니다. 둘째, 미국은 산업 규모의 증류 작업을 단속해야 하는데, 이는 더 계산 효율적인 모델 구축을 가능하게 하고 칩 금지를 부분적으로 회피하게 합니다. 셋째, 충분히 capaces한 모델(오픈이든 클로즈든)은 출시 전에 사이버, 생물학적, 정렬 위험에 대한 의무적인 안전 테스트를 받아야 합니다.
산업계로부터의 공개 서한에 대한 응답
오픈 웨이트의 이점에 대해 공개 서한에 동의하면서도, Anthropic은 이들이 본질적으로 방어를 돕는다는 주장에 이의를 제기합니다. 게시물은 다음과 같이 말합니다: "나는これに 대해 많이 동의합니다: 오픈 웨이트는 AI 경제에 대한 접근을 확장하고, 적어도 일부 사용 사례에서는 경쟁을 강화하며, 고객에게 더 큰 통제권을 제공합니다." 그러나 다음과 같이 덧붙입니다: "하지만 나는 그 서한의 주장에 동의하지 않습니다: 오픈-웨이트 모델이 반드시 보호 장치 개발을 쉽게 만든다거나, 능력에 대한 광범위한 접근이 공격자보다 방어자에게 더 반드시 도움이 된다는 주장에 동의하지 않습니다. мне는 반대 상황이 적어도 genauso likely하다고 생각합니다." 저자는 위험과 완화에 대한 질문은 사전 출시 테스트를 통해 경험적으로 답변되어야 하며, 가정해서는 안 된다고 주장합니다.
커뮤니티 반응 및 반론
"예, 이것은 Anthropic이 오픈 웨이트 모델에 대한 금지를 옹호하고 있습니다. 이 테스트를 누가 운영합니까? 이 테스트가 너무 비싸거나 관리자가 특정 사람들의 참여를 거부하면どうなるでしょうか.これは過去に米国がスタンプ를 요구하고 발급을 거부함으로써 상품을 금지했던 방식과 정확히 같습니다." — @cogman10 "기본적으로 우리는 오픈-웨이트 모델을 금지해서는 안 되지만, 중국이 나쁘다는 이유로 프론티어 모델만큼 좋게 허용해서는 안 됩니다. 그리고 다른 사람이 프론티어 모델을 생산할 수 있게 해서는 안 됩니다." — @kelvinjps10 (칩 및 증류 섹션을 인용) "만약 당신이 금지가 효과가 없다고 진정으로 믿는다면, 동일한 논리가 하드웨어에도 적용됩니다.... 우연히도 이러한 모든 조치가 상업적으로 Anthropic에 이익을 줍니다. Dario가 정말로 자신의 주장을 펼치고 싶었다면, Anthropic이 단일 오픈-웨이트 모델을 출시했다면 훨씬 더 효과적이었을 것입니다." — @GodelNumbering "모델이 테스트에 실패하면どうなるでしょうか? 분명히 alguém은 Kimi K3를 악용할 수 있을 것입니다. 이제どうすればいいでしょうか? '의무적 안전 테스트'는 실패에 대한 결과를 암시하지만, Dario는その結果이 무엇인지에 대해何も 말하지 않습니다." — @modeless "돼지에 립스틱을 발라도 여전히 돼지입니다 ... 이것은 오픈 웨이트 모델을 옹호하는 것과 긴장 관계에 있습니다. 직접적이지는 않지만 첫 번째 진술에 의문을 제기할 충분한 이유가 있습니다. 테스트 기준은 무엇입니까? 어떻게 통과합니까? 정부 기관이 통과/실패를 승인하는 것인지, 전 세계적인 기구인지요? 만약 정부라면, 그리고どうやら 정부인 것 같은데, 어떻게 기업 로비를 막아 안전 테스트를 설정하여 파란색을 입은 사람들은 통과시키고 다른 모든 사람들은 안전 문제로 인해 차단할 수 있습니까?" — @duplessitous "따라서 논의는 기본적으로 다음과 같습니다: 이 기술은 너무 위험하므로 오직 _we_만이 접근해야 합니다. 우리는 선한 사람들이며, 오직 우리는 이 기술의 안전한 사용을 보장할 수 있습니다. Quis custodiet ipsos custodes?" — @mjorgers "여기서 완전한 오픈 모델 확산을 추진하는 모든 사람들에게: 오픈 웨이트 생물무기 및 사이버 공격 능력에 대해 무엇을 해야 합니까? 이것이 자유의 대가로 공격자들이 이러한 도구에 접근하도록 허용해야 하는 것일 뿐입니까? ... 당신은 정말로 이 수준의 능력을 가드레일 없이 일반적으로 이용 가능하게 하고 싶습니까?" — @ajyoon "'open weight' 모델은 오픈 소스가 아닙니다. 그들은 여전히 깊이 proprietary입니다. 소스 자료에 접근할 수 없기 때문에 그들을 심문하지 않고는 그들이 무엇을 하는지 또는 어떤 능력을 갖는지 알 수 없습니다." — @petcat
이러한 발언들은 집행 문제, 잠재적인 기업 이익, 테스트 결과에 대한 불명확성, 그리고 명시된 금지에 대한 반대에도 불구하고 제안이 실제로 개방을 제한할 수 있다는 관점을 강조합니다.
관련 Anthropic 발표
스크랩된 내용은 또한 다른 최근 Anthropic 업데이트를 언급합니다:
- Cognizant과의 파트너십 확대를 통해 기업 고객에게 Claude를 제공합니다.
- Claude Opus 5의 도입; 이는 장기 실행 에이전트를 구동하는 Opus 계층의 단계적 개선으로 설명되며, 코딩 및 전문 작업에서의 성능 향상을 제공합니다.
- Anthropic Economic Futures Research Fund의 연구 의제 공유. 이러한 항목들은 입장 성명과 함께 별도의 뉴스 기사로 제시됩니다.