不可预测的 AI 模型访问:AWS Bedrock 上 Claude Opus 4.7 配额被撤销
云端 AI 模型访问的格局不断演变,但来自 AWS Bedrock 用户的最新报告凸显了一个重大挑战:对关键前沿模型的访问被突然且未提前通知地撤销。该问题特别涉及 Anthropic 的 Claude Opus 4.7,使开发者陷入紧急处理生产受损的局面,并引发了关于主要云平台上第三方模型供应的稳定性和透明性的更广泛疑问。
本文深入探讨了用户面对意外配额变更的经历、收到的官方回应以及社区的反应,提供了对依赖这些先进 AI 能力的企业可能产生的影响的洞见。
Claude Opus 4.7 突然的配额撤销
Hacker News 的一位用户报告称其 AWS Bedrock 对 Claude Opus 4.7 的配额突然被改为 0 令牌每分钟(TPM)。这对该用户而言并非孤立事件,表明了不可预测的访问变更的反复模式。直接后果是依赖该模型的应用开始出现限流错误,导致生产中断。
用户分享了从 AWS 支持收到的更新,详细说明了情况:
"经过与我们内部团队的彻底调查,我们已确定了您 Claude Opus 4.7 模型访问中发生的情况。您的账户此前拥有该模型的访问权限,并一直成功使用至昨天。然而,针对特定账户的模型访问可能会基于包括地区因素、付款历史和使用模式等多种因素进行更新,以维护服务性能并确保 Amazon Bedrock 的适当使用。最近的一次系统更新调整了访问控制,导致您的账户配额自 2026 年 5 月 1 日起被设为 0。这就是为何您的应用今天开始出现限流错误的原因。"
支持信息进一步指出,虽然 AWS 客户经理会探索恢复访问的选项,但无法保证批准,因为“可访问性会根据各种因素自动变化”。
对生产的影响及推荐的替代方案
此类配额变更的直接影响非常严重,尤其是对生产环境中的应用。AWS 支持团队建议通过迁移到替代模型来缓解“生产受损”,具体为 Claude Opus 4.6。他们提供了 Opus 4.6 的当前配额,强调其作为“以最小代码改动实现的有效替代方案”,可用于恢复服务。
此事件凸显了在集成第三方 AI 服务时,尤其是面向客户或关键任务的应用,必须具备稳健的回退策略和多模型架构的关键需求。
社区关注及更广泛的可靠性问题
Hacker News 社区呼应了原帖作者的沮丧,凸显了 AWS Bedrock 不可靠的模式。一位评论者强烈表达了不满:
"一家企业对付费客户的生产工作流做出这种行为简直疯狂。"
另一位用户指出,即使是拥有企业支持的用户,也有类似问题的历史:
"Amazon Bedrock 会随机对你进行限流。Quinnypig 已经广泛讨论过此事,以及他们多次对即使拥有企业支持的关键生产系统进行‘抽走’的情况。它是一个糟糕的推理提供商。考虑转向 Google 或直接使用 Claude 本身。"
“rugpulled”(抽走)一词生动地描绘了关键服务被意外撤回的感受,即使是成熟的企业客户也不例外。这表明问题可能并非孤立的故障,而是 Bedrock 在管理底层模型访问时面临的更广泛挑战。建议考虑如 Google 等替代提供商或直接使用 Claude(Anthropic)本身,反映出对更稳定、可预测的推理环境的需求。
对潜在原因的猜测
虽然 AWS 支持将“地区因素、付款历史和使用模式”列为因素,并将“最近的系统更新”视为直接原因,但有评论者提出了另一种假设:
"我注意到 opus 4.7 的令牌计数至少是应该的两倍。我在想他们是否在进行修复?"
这让人怀疑配额变更可能与底层技术调整或修复有关,或许是为了解决不准确的令牌计数等问题,这些问题会影响资源分配和计费。如果这些技术问题确实是因素,提供商更好的沟通能够帮助用户理解并为服务调整做好准备。
探索 AI 模型访问的前沿
在 AWS Bedrock 上使用 Claude Opus 4.7 的经历提醒我们,依赖第三方平台获取前沿 AI 模型本身就蕴含复杂性和潜在波动性。尽管云提供商提供了便利和可扩展性,但模型访问缺乏透明度和可预测性可能对生产系统构成重大风险。
开发者和企业必须保持警惕,通过构建弹性架构、探索多提供商策略以及与云合作伙伴保持开放沟通来规划潜在的中断。能够快速转向替代模型或提供商可能成为在快速演变的 AI 领域中的关键能力。