Amazon Web Services(AWS)のインフラストラクチャに広範囲にわたる障害が発生し、世界各国の数千ものプラットフォームやアプリケーションで断続的なサービス停止が発生しています。接続障害、レイテンシの問題、読み込み失敗などのユーザーからの報告が今朝早くから急増し、特に米国で顕著な影響が出ており、ヨーロッパでも目に見える形で影響が出ています。
同社のステータスダッシュボードによると、この問題はUS-EAST-1リージョン(バージニア州北部)で発生し、複数のAPIでエラー率が異常に上昇した。午前中には、AWSは多くのサービスで復旧の兆候が見られると報告したが、チームは問題の完全な解決とすべての運用の正常化に向けて引き続き作業を進めている。
事件の経緯
最初のアラートは午前9時頃(スペイン本土時間)に届き、その後まもなくインシデントがピークに達し、DownDetectorなどの監視ツールに通知が絶えず送信されました。午前11時以降、同社は考えられる原因を特定し、さまざまなレイヤーにわたる復旧を加速させる緩和策の実施を開始したと報告しました。
正午頃、AWSはほとんどの運用が正常に戻りつつあると報告したが、影響を受けた地域では一部のリクエストや特定のサービスに時折制限が生じていると指摘した。午後早い時間帯には、安定化作業が継続される中で、依然として影響が残っていた。

技術的な起源はどこだったのか
同社は、マネージドキーバリューデータベースサービスであるAmazon DynamoDBに注目した。US-EAST-1リージョンのエンドポイントで障害が発生し、複数の依存関係に連鎖的なエラーが広がった。AWSは、根本的なDNSの問題が原因であると指摘し、段階的に対応を進めている。
実際には、ドメインネームシステム(DNS)が正しく名前解決できない場合、アプリケーションはリソースを特定できず、接続エラー、タイムアウト、データ読み込みの失敗が発生します。AWSは、継続的な問題が発生しているお客様に対し、DNSキャッシュをクリアして正しいエンドポイントへの名前解決を回復することを推奨しています。
影響を受けた人
影響は広範囲に及んだ。Amazon自身もAlexaとPrime Videoで問題が発生したと報告したほか、 Canva、Duolingo、Snapchatといったサードパーティサービスでも不具合が発生した。AWSクラウドに依存する生成型AIプラットフォームやコラボレーションアプリケーションでも障害が観測された。
デジタルエンターテインメントも例外ではなかった。フォートナイト、Roblox、クラッシュ・ロワイヤルなど、ユーザー数の多いタイトルやサービスでは、ログインエラーや接続エラーが報告された。また、一部のゲームストアやランチャーは、トラフィックが安定するまで影響を軽減するための対策を講じた。
スペインでの影響
全国的に、特に午前中にかけて、多くのユーザーがデジタルサービスアプリやウェブサイトへのアクセスに問題が発生したと報告した。チケットマスターなどのチケット販売プラットフォームも影響を受け、正午に予定されていた発売が遅れ、人気のコンサートのチケットなども販売された。
金融機関や主要な消費者向けプラットフォームは、オンラインシステムで散発的な障害が発生したと報告したが、その影響は地域やサービスによって異なった。影響を受けた米国地域で対策が実施されるにつれ、ヨーロッパでは徐々にアクセスが回復しつつあることが確認された。
現状と提言
時間が経過するにつれ、AWSはほとんどのサービスで著しい回復の兆しが見られると発表しましたが、US-EAST-1リージョン内の一部の運用については引き続き制限を設けています。同社は引き続きパフォーマンスを監視し、問題の完全解決に向けて調整を実施していきます。
引き続き個別の障害が発生する場合は、AWS の公式ステータスを確認し、必要に応じてDNS キャッシュをクリアするか、影響を受けるリージョンのエンドポイント解決に依存するクライアントとサービスを再起動してください。重要なデプロイメントでは、遅延や一時的なエラーの影響を最小限に抑えるため、フェイルオーバー、ネットワーク依存関係、および再試行ポリシーを確認することも推奨されます。
このエピソードは、クラウドコンピューティングのインフラがデジタル経済にとってどれほど構造的なものになっているかを浮き彫りにしている。重要なハブにおける局所的な障害は、ストリーミングやビデオゲームから金融や生産性向上アプリケーションに至るまで、世界規模での連鎖反応を引き起こす可能性があるのだ。