オープンウェイトモデルに関するAnthropicの立場
Anthropicは、オープンウェイトモデルの禁止を提唱していないことを明示的に述べています。CEOのDario Amodeiは、危険な能力を持たないオープンウェイトモデルは、必要な計算リソース以外のコストをかけずに研究者、開発者、および企業に価値を提供することで、公共の利益として機能すると主張しています。
国家安全保障上の懸念と禁止措置の限界
Anthropicは、オープンウェイトモデルに対する保護主義的な禁止措置では対処できない、主に2つの国家安全保障上のリスクを特定しています。
1. 権威主義的な軍事および監視の優位性
主な懸念は、権威主義的な政府、特に中国共産党(CCP)が、永続的な軍事優位性を達成したり、深刻な内部抑圧を実施したりするために、米国よりも強力なAIモデルを開発する可能性があることです。Amodeiは、最も危険なモデルは、国家の安全保障や軍事利用(ドローンなど)のために秘密裏に訓練され、それらが確保される可能性が高いと指摘しています。そのため、オープンウェイトの状態や、これらのモデルを米国企業が使用すること自体は、この特定の脅威とは無関係です。
2. サイバーおよび生物学的攻撃への悪用
二次的な懸念は、強力なAIモデルがサイバー攻撃や生物学的攻撃に悪用されたり、深刻なアライメント問題が発生したりするリスクです。オープンウェイトモデルは、ガードレールを適用することが難しく、一度公開されるとウェイトを回収することができないため、クローズドモデルよりも高いリスクをもたらす可能性があります。しかし、米国企業によるその使用を禁止することは、このリスクを軽減することはありません。なぜなら、悪意のあるアクターは、正当な米国企業である可能性が低いためです。
AIの安全性とセキュリティのための提案された政策的措置
オープンウェイトモデルの一律的な禁止ではなく、Anthropicは3つの具体的な戦略的措置を提唱しています。
ハードウェアへのアクセスの制限
Anthropicは、強力なチップやチップ製造装置の中国への販売を禁止し、密輸や回避策への取り締まりを強化することを支持しています。スケーリング則に基づき、中国はこれらのチップにアクセスできなければ、米国よりも強力なモデルを構築することはできません。そのため、これは、優れた権威主義的なAIの開発をブロックする最も直接的な方法です。
産業規模の蒸留(Distillation)の抑止
Anthropicは、産業規模の蒸留(Distillation)操作を抑止するための政策的介入を呼びかけています。蒸留により、権威主義的な国家は、利用可能なハードウェアが通常許容するよりも優れたモデルを構築することができ、中国のフロンティアモデルが米国のフロンティアモデルに数ヶ月の差で追いつく可能性があるためです。Amodeiは、、オープンウェイトモデルを公開する一部の企業が蒸留を行っている一方で、核心的な問題は、米国のフロンティアを追い越そうとする国家主導の取り組みであり、ウェイトのオープンな性質そのものではないと明確にしています。
有能なモデルに対する義務的な安全性試験
Anthropicは、十分な能力を持つすべてのモデルが、そのウェイトがオープンかクローズドか、あるいはその原産国にかかわらず、公開前に生物学的、サイバー、およびアライメントのリスクに関する義務的な安全性試験を受けることを提案しています。Amodeiは、AI駆動型の生物兵器の開発を防ぐことに関しては、中国を含む限定的な国際協力が可能である可能性を示唆しています。これは、中国自身の利益にもかなう結果を避けることが目的だからです。
オープンウェイト論争に関する見解
オープンウェイトモデルを支持する公開書簡への回答として、Amodeiは、オープンウェイトが経済的アクセスを拡大し、競争を強化することに同意しています。しかし、彼は、オープンウェイトモデルが必ずしも防御策の開発を容易にしたり、あるいは攻撃者よりも防御側に利益をもたらしたりするという主張には異議を唱えています。
Amodeiは、生物学における特定の「攻撃者と防御者の非対称性」を強調しています。有能なモデルがウイルスを兵器化することを迅速に行える一方で、防御(ワクチン開発など)は数年におよぶ運用上のタスクです。彼は、これらのリスクが事前に想定されるのではなく、公開前の実証的な試験を通じて判断されるべきであると主張しています。
Sources
関連
- Dispatch
- Dispatch
- Dispatch
- Dispatch
- Dispatch