Amazon、EC2の大規模障害について謝罪と説明 長期化の原因は複数のバグ
米Amazon Web Services(AWS)は7月2日(現地時間)、6月29日に発生したElastic Compute Cloud(EC2)など複数サービスにわたる大規模障害について正式に謝罪し、経緯を説明した。
この障害は、米太平洋時間の6月29日午後8時過ぎに北バージニアにあるデータセンターで発生し、修復がほぼ終わったのは翌30日の午後7時ごろだった。この影響で、同サービスを利用しているInstagram、Pinterest、Netflix、Herokuをはじめとする多数の顧客のサービスが長時間にわたってダウンした。
障害発生の最初の原因は、既報の通り同日に北バージニアを襲った激しい雷雨による停電だったが、復旧に時間がかかったのは、複数サービスに潜んでいた幾つかのバグのせいという。
同日、暴風雨の警報に従って米東海岸リージョンでのすべてのアクティビティ変更は中止し、増員して待機した。午後7時24分に同地域の複数のデータセンターの変電装置に強い電圧ノイズがあったため、バックアップの発電装置に切り替えたが、ここでまず1つのデータセンターで問題が発生した。さらに、サーバの起動プロセスが未知の問題によりボトルネックになり、EBSボリュームの復旧が大幅に遅れた。こうした問題は、「Elastic Load Balancer(ELB)」で発生した未知のバグによるものという。ELBは、複数のEC2インスタンスにトラフィックを自動的に分散する、AWSサービスの耐障害性を担う機能だ。また、幾つかのRDSインスタンスもソフトウェアのバグにより、フェイルオーバーに失敗した。
AWSは説明の最後に障害について謝罪し、数週間をかけて原因のさらなる究明と改善に努めると語った。
Copyright © ITmedia, Inc. All Rights Reserved.
この記事の著者
関連記事
こんなメディアも見られています
ITmedia NEWSに関連する情報をお探しであれば、こちらのメディアもお役に立てるかもしれません。
SpecialPR
本日の新着記事
アクセスランキング
-
1
ドローン攻撃を受けたAWS中東データセンター、半年の復旧作業の末に「一部データは回復不能」
-
2
メルカリ株が大幅安、1カ月で3割下落 最新ポケカ出品禁止を嫌気、転売・不正利用の批判も相次ぐ
-
3
ドラマ「VIVANT」のワンシーンに映像制作界隈が「ぞっとする」 microSDカードを端子むき出しで手渡し
-
4
「POPOPO」サービス終了 開始から約半年
-
5
旅客機並みの巨大通信衛星「スターリンクV3」がもたらすもの
-
6
Salesforceで大規模障害 「夕方以降に落ちるなんて」阿鼻叫喚 PayPayのフォームにも影響【復旧】
-
7
次のパンデミックでワクチンを打ちますか? 日本人2万人以上を調査 東大などNature系列誌で発表
-
8
SBIがライブドアを買収か 親会社のミンカブ「概ね報道の通り」
-
9
マンガ原稿をクラウドに上げただけでGoogleアカウントBAN Gmailも道連れ……日本では合法なのになぜ?
-
10
アットコスメ、ユーザー1万人超のメアド漏えいの可能性 ファイル転送サービスの設定ミスで
ITmedia NEWS SNS
インフォメーション
注目情報をチェック
ITmediaNEWSをフォロー
あなたにおすすめの記事PR