Anthropic Fable 및 Mythos: AI 안전성과 시장 권력의 교차점
Fable 및 Mythos 중단
미국 정부는 국가 안보상의 '탈옥' 가능성 우려로 외국인에 대한 Anthropic의 Fable 5 및 Mythos 5 모델에 대한 모든 접근을 중단했습니다. 이 조치는 안전 가드레일이 장착된 Mythos 모델의 버전인 Fable이 출시된 후, 해당 가드레일이 우회되어 보안 취약점을 식별한 것으로 보고된 상황에 따른 것입니다.
Anthropic에 따르면, 미국 정부는 2026년 6월 14일 동부 표준시 오후 5시 21분에 국가 안보 당국을 근거로 수출 통제 지시를 내렸습니다. 정부는 Fable 5의 가드레일을 우회할 방법이 존재한다고 믿는 반면, Anthropic은 발견된 취약점이 사소하고 다른 공개 모델에서도 발견될 수 있다고 주장합니다. 이번 중단은 외국인, 즉 Anthropic 직원까지도 포함한 전면적인 차단이며, 이는 회사가 국적별 세부 제한을 구현할 내부 통제가 부족했기 때문이라고 전해졌습니다.
경제적 필수성: 사용자 중심으로 이동
프론티어 AI 연구소들은 일반 모델 입력 제공에서 사용자 접점을 직접 소유하는 방향으로 전환하고 있으며, 이는 오픈소스 대안에 의해 기술이 상품화되는 것을 방지하기 위함입니다. 이 전환은 장기적인 경제적 지속 가능성을 위해 필수적이며, AI 가치 사슬에서 핵심 가치는 컴퓨트 제공업체에서 사용자가 작업을 수행하는 인터페이스를 제어하는 주체로 이동하고 있습니다.
이 전략은 모델 제작자를 소프트웨어 기업과 충돌하게 만듭니다. 마이크로소프트 CEO 사티아 나델라는 기업이 일반 모델 위에 '토큰 자본'(AI 역량)을 구축해 자체 IP에 대한 주권을 유지해야 한다고 주장하지만, Anthropic과 같은 연구소의 경제적 동기는 소프트웨어 계층을 완전히 대체하는 것입니다. 사용자 워크플로우의 주요 캔버스가 됨으로써 AI 연구소는 의미 있는 락인을 만들고 경제적 수익의 대부분을 차지할 수 있습니다.
데이터 필수성 및 보존 정책
실제 사용 데이터에 대한 접근은 프론티어 모델을 개선하는 가장 강력한 지렛대이며, Anthropic은 보다 공격적인 데이터 보존 정책을 시행하게 되었습니다. 강화 학습 및 모델 개선을 위해 Anthropic은 모든 Fable 사용자, 이전에 데이터 보존이 없던 기업 고객까지도 사용 데이터를 30일간 보관할 것이라고 발표했습니다.
이 정책 변화는 선순환을 만들게 됩니다. AI 인터페이스 내에서 더 많은 워크플로우가 직접 처리될수록 연구소는 고품질 데이터를 더 많이 수집하고, 이는 모델을 더욱 강력하게 만들어 더 많은 사용자와 데이터를 끌어들입니다. Anthropic은 이 데이터를 학습에 사용하지 않을 것이라고 밝혔지만, 제3자 보호 장치가 없다는 점은 향후 안전성 향상 및 탈옥 방지를 명목으로 이 데이터를 학습에 활용할 가능성을 시사합니다.
권력 필수성: 프론티어 개발 통제
Anthropic은 경쟁자가 자사의 도구를 사용해 다른 프론티어 LLM을 개발하는 것을 방지하기 위해 모델 성능을 은밀히 저하시키는 의지를 보여왔습니다. 초기에는 사전 학습 파이프라인, 분산 학습 인프라, 혹은 ML 가속기 설계와 관련된 요청에 대해 Fable의 효율성을 비밀리에 제한하는 보호 장치를 구현했습니다.
Anthropic은 이후 이 '조용한 사보타주'를 철회하고, 요청이 오래된 Opus 4.8 모델로 전달될 때 이를 공개하기로 합의했지만, 초기 정책은 선도적인 AI를 개발할 수 있는 주체는 소수에 불과하다는 믿음을 드러냈습니다. 정책 선호에 따라 모델 행동을 은밀히 변경할 수 있는 이 능력은 해당 인프라에 의존하는 이들에게 잠재적인 공급망 위험으로 회사를 위치시킵니다.
안전성을 전략적 프레임워크로
Anthropic은 '안전 우선' 서사를 활용해 정책 변화를 정당화하며, 이는 동시에 경제적·권력적 목표와 일치합니다. OpenAI가 안전성을 충분히 고려하지 않았다는 믿음에 뿌리를 둔 회사의 설립 이야기는, 그렇지 않으면 반경쟁적이거나 과도하게 통제하는 것으로 보일 행동에 도덕적 어휘를 제공합니다.
이 정렬의 주요 예시는 다음과 같습니다:
- 안전을 이유로 API 접근을 제한하면서 사용자 락인을 높이는 맞춤형 엔드포인트로 유도.
- 데이터 보존 확대를 통해 탈옥을 방지하고, 동시에 향후 모델 학습을 위한 방대한 데이터셋을 제공.
- AI 개발 통제를 통해 '위험한' 가속을 방지함으로써 경쟁사의 성장을 실질적으로 제한.
커뮤니티 관점 및 반론
산업 관찰자와 사용자들은 이러한 전개에 대해 여러 비판적 지점을 제기했습니다:
"여기서 흥미로운 부분은 Anthropic이 안전에 대해 옳은가가 아니라, 안전이라는 명분이 대담한 정책 변화와 플랫폼 권력을 위한 도덕적 어휘를 제공한다는 점입니다."
일부 비평가들은 "안전" 서사가 시장 지배를 위한 가면이라고 주장하고, 다른 이들은 악의적 사용을 차단하면서도 정당한 보안 감사를 차단하지 못하는 실질적 불가능성을 지적합니다:
"Claude, 나는 안전이 중요한 산업 제어 소프트웨어를 출시합니다. 네트워크 제어 로직을 감사해 주세요. [vs] Claude, 나는 공장을 폭파하고 싶어요... 두 프롬프트 모두 동일한 작업을 수행하고 동일한 출력을 생성합니다. 어떻게 하나는 차단하고 다른 하나는 차단하지 않을 수 있나요?"
또한, 일부는 국가의 힘을 고려할 때 Anthropic이 전 세계 게이트키퍼 역할을 시도하는 것이 비현실적이라고 제안합니다:
"Anthropic이 미국 정부의 의지에 맞서는 통제를 유지할 가능성은 지옥에서도 없어요. 미국 정부가 총을 가지고 있거든요, 그게 전부죠."