DeepSeekは、米中コンピューティングギャップに関するリークされたコメントにより資金調達を一時停止
DeepSeekは、米中コンピューティングギャップに関するリークされたコメントにより資金調達を一時停止
DeepSeekは、投資家ミーティングから漏洩したトランスクリプトが創業者梁文豊の率直な評価、「コンピューティングギャップ」中国と米国の間のものを明らかにした後、資金調達の第2ラウンドを一時停止しました。このリークは、DeepSeekが中国のAIラボが米国のフロンティアモデルに匹敵することを妨げている主要なボトルネックだと考えている、ハードウェアの可用性における大きな格差を浮き彫りにしています。
ハードウェア不足と「算術問題」
梁文豊は、中国のAI開発の不利を才能の不足ではなくリソースの問題として捉えています。リークされた発言によると、人員の格差は最小限であり、チームはスキルと背景において基本的に同じです。主な障害は、利用可能なコンピューティングの膨大な量です。
リークされた投資家ディスカッションからの重要な詳細は以下の通りです:
- チップ調達ギャップ: Liang reportedly stated that he required 200,000 Huawei 950 chips to train a frontier model but received only 16,000.
- サプライチェーン制約: 不足はHuaweiの能力不足によるものとされ、 Liangはこれが少なくとも3年間続くだろうと予想している。
- 財務規模: 梁は、調達に1年間で20億ドル( presumably USD )を費やすと、その部門にとって「優れたパフォーマンス」とみなされると指摘し、現在の支出レベルが、利用可能な最大のグローバルモデルを訓練するために必要な水準よりもはるかに低いことを示唆している。
モデルトレーニングへの戦略的アプローチ
ハードウェアの制約にもかかわらず、DeepSeekは、米国の競合が使用するコンピューティングの一部を利用することにより、米国のラボとのギャップを3〜6か月の窓に縮めようとしています。この戦略は、生のハードウェアパワーの不足を補うためにアルゴリズムの効率性に焦点を当てています。
米国技術からの移行については、トランスクリプトから、V3のトレーニング中にNVIDIA GPUが使用されていたものの、NVIDIAエコシステムはもはや使用されていないことが示されています。これは、将来の混乱を避けるために米国ベースのソフトウェアスタックからの脱却を図る戦略的な動きを示唆しています。
コミュニティ分析と反論
- 絶対フロンティアの価値: 一部のアナリストは、中国のモデルがコストの一部でニアフロンティアレベルのパフォーマンスに到達できる場合、「絶対フロンティア」を達成することが必要かどうかを疑問視しています。これによりAIが商品化され、米国ラボの巨額の投資からのリターンが減少する可能性があります。
- 戦略的シグナリング: 梁の率直な発言が、中国政府または国内チップメーカーに資源配分の増加を迫る戦略的な動きであるかどうかについて、懐疑的な見方があります。
- 国内産業のシフト: 一部の観察者は、中国企業がますますNVIDIAチップの購入を禁止されているという広範なトレンドを指摘しています。これは米国によるものではなく、中国政府によるもので、国内半導体産業の成長を強制することを目的としています。
"私たちと米国の間の最大のギャップはリソースにあります。" — Liang Wenfeng