AI 成本危机:渗透定价与即将到来的市场修正

当前的 AI 领域呈现出许多人所描述的“渗透定价”阶段。长期以来,运行大语言模型 (LLMs) 的成本实际上一直由大规模的风险投资和前沿模型提供商的战略目标所补贴。然而,随着行业向可持续商业模式迈进,问题随之而来:当补贴消失,智能的真实成本变得显而易见时,会发生什么?

经济后果:从泡沫到修正

许多观察者认为我们目前正处于 AI 泡沫中。风险在于,企业已经围绕着无法维持的补贴成本构建了其整个运营框架。如果价格大幅上涨,对于那些在没有计算长期成本轨迹的情况下就用 AI 替换了人力劳动的中小企业 (SMBs) 来说,后果可能是严重的。

一些人认为,这可能会导致一场市场修正,那些“大而不能倒”的公司——即那些围绕专有第三方服务重新组织了其整个生存方式的公司——发现自己处于危险境地。正如一位评论者所言:

"对于几乎每一个现存的企业和政府来说,AI 都是生存所依赖的……你最终会不得不支付那该死的赎金,并且持续支付,因为你已经围绕一个封闭的专有第三方服务的商业模式重新组织了你的整个生存方式,并抵押了你的未来。"

相反,其他人则暗示了一种更传统的市场周期:泡沫破裂,发生修正,然后行业稳定进入一个合理的阶段,即 LLMs 被视为一种专门的工具,而不是解决所有问题的通用方案。

架构转向:混合 AI 的兴起

随着“Token 焦虑”的到来,行业可能会从对前沿模型“一刀切”的方法转向。趋势正朝着优先考虑效率而非原始能力的混合架构发展。

1. 特定任务的小语言模型 (SLMs)

企业不再对每一次交互都使用前沿模型,而是开始转向更小、针对特定任务的模型。这些模型针对狭窄的任务——例如分类、路由或重复性的高容量工作——进行了优化,在这些任务中,前沿模型的成本和延迟是无法证明其合理性的。

2. 本地化执行

推动本地模型发展的动力不仅在于成本,还在于隐私、合规性和可预测性。在用户硬件或私有基础设施上本地运行模型可以减少对外部 API 的依赖,并消除按 Token 计费的成本模型。

3. 智能路由

为了降低成本,技术实现方案已经开始出现。例如,在固定系统提示词 (system prompts) 上使用提示词缓存 (prompt caching) 可以大幅降低账单。正如一位开发者分享的所说:

"在固定系统提示词上使用提示词缓存,一夜之间让我的 Anthropic 账单减少了约 60%。大多数开发者并没有意识到,在 Claude 上,缓存写入的成本比输入 Token 的成本要便宜 25 倍。"

重新定义软件消费

AI 成本的上升可能会迫使软件定价和交付方式发生根本性变化。目前的订阅模式——即每月支付固定费用以覆盖无限(或高限额)的使用量——如果底层计算成本波动剧烈,可能就是不可持续的。

有一种日益增长的理论认为,软件将向“公用事业”模式转型,类似于电力。在这种情况下,用户将像使用公用事业一样为 AI 付费,软件应用将通过其“Token 效率”而非仅仅是功能丰富程度来竞争。这将使关注点从原始能力转向效率工程。

结论:前进的道路

虽然有人预测会出现一波公司倒闭潮,但也有人认为这与 Linux 的早期阶段相似,暗示社区将通过约束寻找优化和创新的方法。无论是通过开源模型的民主化,还是通过转向混合架构,AI 成本的必然上升很可能会迫使行业从鲁莽的实验阶段转向可持续、工程化的效率阶段。

Sources