DeepSeek 在泄露的关于中美算力差距的评论中暂停融资
DeepSeek 在泄露的关于中美算力差距的评论中暂停融资
DeepSeek 在投资者会议的泄露 transcripts 中暂停了第二轮融资,透露了创始人梁文峰对中美“算力差距”的坦率评估。泄露凸显了硬件可用性的显著差异,DeepSeek 认为这是阻碍中国 AI 实验室赶上美国前沿模型的主要瓶颈。
硬件短缺和“算术问题"
梁文峰将中国 AI 开发的劣势框定为资源问题而非人才不足。根据泄露的言论,人员差距微乎其微,因为团队在技能和背景方面基本相同。主要障碍是可用算力的巨大规模。
Key details from the leaked investor discussions include:
- Chip Procurement Gap: 梁据称表示,为了训练前沿模型,他需要 200,000 颗华为 950 芯片,但只收到了 16,000 颗。
- Supply Chain Constraints: 短缺归因于华为产能不足,梁预计这一瓶颈将至少持续三年。
- Financial Scale: 梁指出,一年内在采购上花费二十亿( presumably 美元)将被视为其部门的“突出表现”,这意味着当前的支出水平远低于训练全球最大可用模型所需的水平。
模型训练的战略方法
尽管存在硬件限制,DeepSeek 旨在通过仅使用美国竞争对手所用算力的一小部分,将与美国实验室的差距缩小到三到六个月的窗口。该策略侧重于算法效率,以弥补原始算力的不足。
关于远离美国技术的转变, transcripts 表明虽然在 V3 的训练过程中使用了 NVIDIA GPU,但不再使用 NVIDIA 生态系统。这表明这是一种战略举措,旨在脱离基于美国的软件栈,以避免未来的中断。
社区分析与反驳
技术观察者和投资者就这些泄露的影响提出了几点看法:
- The Value of the Absolute Frontier: 一些分析师质疑,如果中国模型能够以极低的成本达到接近前沿的性能,是否真的有必要实现“绝对前沿”,这可能会导致 AI 商品化,削弱美国实验室巨额投资的回报。
- Strategic Signaling: 人们对梁文峰的坦率是否是一种战略举动,以施压中国政府或国内芯片制造商增加资源分配持怀疑态度。
- Domestic Industry Shift: 一些观察者指出,中国公司越来越被禁止购买 NVIDIA 芯片——这不是美国的禁令,而是中国政府的禁令——以推动国内半导体产业的增长。
"我们与美国之间最大的差距在于资源。" — 梁文峰
SUMMARY: DeepSeek 在创始人梁文峰就国内算力资源相较于美国的严重短缺所发表的泄露言论之后,暂停了第二轮融资。
TITLE: DeepSeek 在泄露的关于中美算力差距的评论中暂停融资