Meta Platforms 障害レポート

Meta Platformsは、FacebookやInstagramを含む複数のプラットフォームに影響を与えるサービス中断を経験しました。一部のサービスは稼働し続けている一方で、他のサービスにはアクセスできないという報告があり、ユーザーによる障害報告と公式のステータス監視との間に乖離があることが浮き彫りになりました。

サービスへの影響と不一致

ユーザーはFacebookとInstagramにおける広範なアクセシビリティの問題を報告しました。しかし、公式のMeta Statusページ(metastatus.com)はこれらの報告を即座に反映しておらず、あるユーザーは、ページには「Facebook Ads Manager」に関する問題のみが記載されていたと指摘しました。

プラットフォーム別の観察

  • Facebook: 多数のユーザーによってダウンしていると報告されました。
  • Instagram: 報告は混在しており、一部のユーザーは動作していると述べ、他のユーザーはダウンしていると報告しました。
  • WhatsApp: ユーザー間のメッセージングは稼働し続けているようですが、WhatsApp用のMeta APIsが中断を経験しているという報告もありました。

コミュニティによる分析と技術的な推測

Metaが即座に技術的な根本原因を提供しなかったため、コミュニティは大規模インフラにおけるいくつかの一般的な故障モードについて推測を行いました。

潜在的なインフラの故障

技術的な議論は、この規模のグローバルな障害における一般的な原因に集中しました:

  • DNS and BGP: ユーザーは、Domain Name System (DNS) の失敗、または Border Gateway Protocol (BGP) の設定ミスが原因であるかどうかを推測しました。これらはどちらも大規模なクラウド障害における一般的な原因です。
  • AI-Assisted Code Changes: 一部のユーザーは、AI支援によるコード変更、またはAIエージェントが自動的なパフォーマンス最適化を実行した際に、誤って重要なコンポーネントを削除してしまったことが原因であるという仮説を立てました。

歴史的背景

ユーザーは過去のMetaの障害を振り返り、New York Times経由のBBCのレポートを引用して、過去のインシデントでは、インフラの故障によりエンジニアが修正作業のために自社のビルに物理的に入ることができなかった事例があったと述べました。 ",

Sources