不可預測的 AI 模型存取:AWS Bedrock 上的 Claude Opus 4.7 配額被撤銷

雲端 AI 模型存取的環境持續變化,但近期來自 AWS Bedrock 使用者的報告突顯了一項重大挑戰:對關鍵前沿模型的存取被突然且未事先通知地撤銷。此問題,特別涉及 Anthropic 的 Claude Opus 4.7,使開發者急於解決生產受損的情況,並引發對主要雲平台上第三方模型供應的穩定性與透明度的更廣泛疑問。

本文深入探討面臨意外配額變更的使用者經驗、收到的官方回應以及社群的反應,提供對依賴這些先進 AI 能力之企業可能產生的影響之見解。

Claude Opus 4.7 突然的配額撤銷

一位在 Hacker News 的使用者報告稱,他們的 AWS Bedrock Claude Opus 4.7 配額突然變更,瞬間被設定為 0 Tokens Per Minute(TPM)。這對該使用者而言並非孤立事件,顯示出不可預測的存取變更的重複模式。直接的結果是依賴此模型的應用程式開始遭遇節流錯誤,導致生產中斷。

該使用者分享了從 AWS 支援收到的更新,說明了情況:

在與我們內部團隊進行徹底調查後,我們已確認您 Claude Opus 4.7 模型存取發生的情況。您的帳戶先前已取得此模型的存取權,且一直順利使用至昨日。然而,基於區域考量、付款歷史與使用模式等不同因素,特定帳戶的模型存取可能會被更新,以維持服務效能並確保 Amazon Bedrock 的適當使用。最近一次系統更新調整了存取控制,導致您的帳戶配額自 2026 年 5 月 1 日起被設定為 0。這就是為何您的應用程式今天開始遭遇節流錯誤的原因。

支援訊息進一步指出,雖然 AWS 客戶經理會探索恢復存取的選項,但無法保證批准,因為「存取權會根據各種因素自動變更」。

對生產的影響與建議的替代方案

此類配額變更的直接影響相當嚴重,尤其是對於生產環境中的應用程式。AWS 支援團隊建議的緩解「生產受損」方式是遷移至替代模型,具體為 Claude Opus 4.6。他們提供了 Opus 4.6 的目前配額,強調其作為「以最小程式碼變更即可有效取代」以恢復服務的潛力。

此事件凸顯在整合第三方 AI 服務時,特別是面向客戶或關鍵任務的應用程式,必須具備穩健的備援策略與多模型架構的關鍵需求。

社群關切與更廣泛的可靠性問題

Hacker News 社群呼應了原貼作者的挫折感,突顯出 AWS Bedrock 不可靠的模式。某位評論者表達了強烈的不滿:

對於一家企業在付費客戶的生產工作流程上做出這種行為,實在是瘋狂。

另一位使用者指出,即使是擁有企業支援的客戶,也有類似問題的歷史:

Amazon Bedrock 會隨機對你進行節流。Quinnypig 已廣泛討論過此情況,以及他們多次對即使擁有企業支援的關鍵生產系統也進行「rugpulled」的情形。這是一個不佳的推論提供者。考慮轉移至 Google 或直接使用 Claude 本身。

「rugpulled」一詞生動地說明了即使是已建立的企業客戶,其關鍵服務也會被意外撤回的情緒。這暗示此問題可能不是孤立的故障,而是 Bedrock 在管理底層模型存取時所面臨的更廣泛挑戰。建議考慮如 Google 等替代供應商或直接使用 Claude(Anthropic)本身,反映出對更穩定且可預測的推論環境的需求。

對根本原因的推測

雖然 AWS 支援提到「區域考量、付款歷史與使用模式」作為因素,且將「最近的系統更新」視為直接原因,但有評論者提出了另一種假設:

我注意到 opus 4.7 的 token 計數似乎至少是應有的兩倍。我在想他們是否正在進行修正?

這提出了配額變更可能與底層技術調整或修正有關的可能性,或許是針對不準確的 token 計數等問題,這會影響資源分配與計費。若此類技術問題確實是因素,提供者更好的溝通能協助使用者了解並為服務調整做好準備。

探索 AI 模型存取的前沿

在 AWS Bedrock 上使用 Claude Opus 4.7 的經驗,鮮明提醒了依賴第三方平台取得前沿 AI 模型所固有的複雜性與潛在波動性。雲端供應商雖提供便利與可擴展性,但模型存取缺乏透明度與可預測性,可能對生產系統構成重大風險。

開發者與企業必須保持警覺,透過建構彈性架構、探索多供應商策略,並與雲端合作夥伴保持開放的溝通管道,以規劃潛在的中斷。快速轉向替代模型或供應商的能力,可能成為在快速演變的 AI 版圖中關鍵的競爭力。

Sources