OpenAIとAnthropicが同時ダウン、原因は謎のまま

OpenAIとAnthropicが同時ダウン、原因は謎のまま

今週水曜日、稀に見る「連鎖ダウン」がグローバルなAI業界を直撃した。WIREDの報道によると、OpenAIのChatGPT、AnthropicのClaude、そしてxAIのGrokがほぼ完全に同じ時間帯にサービス中断を起こし、障害は数十分から数時間にわたって続いた。本稿執筆時点では、3社の公式ステータスページはいずれも「調査中」または「修復済み」と表示するのみで、具体的な原因を公開した企業は一社もない。

不気味な同期障害

障害はUTC時間の14時30分頃に発生した。監視プラットフォームDowndetectorによると、ChatGPTの障害報告は1時間以内に数万件に急増し、ClaudeとGrokのフィードバック曲線もほぼ同期したスパイクを示した。ユーザーはウェブ版へのアクセスが不可能になっただけでなく、APIインターフェースでもタイムアウトや5xxエラーが返されることを確認した。

「同じ時間に、異なる企業が、異なるインフラで、同時に障害を起こした――これは極めて稀な偶然か、背後に共通の上流要因があるかのどちらかだ。」――独立系クラウドサービスアナリスト、James Sutter

不可解なのは、OpenAIとAnthropicがこれまで異なるクラウドプロバイダーと独立したネットワークアーキテクチャを使用していると公言してきた点だ。xAIは大規模な自社算力クラスターを構築している。3社が同時に障害を起こしたことは、単一のクラウドプロバイダーによる障害という可能性をほぼ排除するとともに、「偶然の一致」という説明も説得力を失わせている。

憶測と否定

障害発生後、ソーシャルメディア上にはさまざまな憶測が飛び交った。DNSルートサーバーへの攻撃を疑う声、海底ケーブルの切断を指摘する声、さらにはある国家によるサイバー戦演習との推測まで登場した。しかし現時点では、世界主要なDNSサービスおよび海底ケーブル運営事業者はいずれも異常報告を発表していない。米国サイバーセキュリティ・インフラセキュリティ庁(CISA)も関連する警告を発していない。

一方で、電力システムに着目する専門家もいる。テキサス州とバージニア州北部(AIデータセンターの集積地)では当日の午後に雷雨が記録されていたが、現地の電力網運営事業者は大規模な電圧降下は発生していないと述べている。

また、CloudflareやAkamaiといったCDNプロバイダーの公開ステータスページは障害時間帯においても「すべて正常」を示しており、コンテンツデリバリー層の問題も排除された。

透明性の欠如への不満

開発者コミュニティがさらに憤慨しているのは、対応メカニズムの機能不全だ。Anthropicはステータスページに「一部のAPIリクエストがタイムアウト」と更新するにとどまり、OpenAIは「上流ネットワークイベント」という言葉を初期説明として用いた――しかしこの表現は極めて曖昧で、上流が誰なのかも、タイムラインも何も示していない。

スタンフォード大学のネットワーク政策研究員Elena Marshは、AI企業はデジタル時代の「ライフラインインフラ」になりつつあるが、障害に関する透明性は従来の公共事業者には遠く及ばないと指摘する。「送電網が停電したとき、電力会社は原因・影響範囲・復旧時間を公表しなければならない。しかしAI企業は、企業秘密とセキュリティリスクという二つの名目を使って、あらゆる説明責任を免除しようとしているように見える。」

「AIが真にインフラになるためには、インフラレベルの説明責任を受け入れなければならない。」――Elena Marsh

実際、OpenAIが情報開示の不足を理由に批判されるのは今回が初めてではない。2025年にはChatGPTでユーザーの会話データが流出する事件が起き、OpenAIが詳細なレポートを公開するまでに約1週間を要した。Anthropicも2026年初頭の長時間障害の後、「技術的な問題」の一言で公衆をかわした経緯がある。

産業への反省:AIインフラの脆弱性

注目すべき点として、今回の障害はGoogleのGeminiやMetaのLlamaには及んでいない。これは大手総合テクノロジー企業の冗長アーキテクチャの方が堅牢性に優れていることを示唆しているかもしれない。一方、純粋なAI企業はクラウドのレンタルやサードパーティネットワークへの依存度が高く、構築した「デジタルブレイン」は物理レベルでは意外なほど脆弱だ。

Gartnerのアナリスト、Mark Rayanは、AIモデルの学習と推論はGPUクラスターと低遅延ネットワークに高度に依存しており、どこか一点でミリ秒単位の異常が生じただけで連鎖的なタイムアウトが引き起こされる可能性があると指摘する。しかしほとんどのAI企業は物理インフラの制御権を持っておらず、「彼らは巨大な計算エコシステムの最上階の入居者に過ぎない――下の階でどこかの配管が破裂すれば、最初に浸水するのは彼らだ」と述べた。

ビジネスの観点からも、今回のダウンはひとつの収益モデルへの依存リスクを露わにした。APIコール課金に依存するスタートアップにとって、たとえ30分の停止であっても数十万ドルの直接損失をもたらす可能性があり、それを補償する契約条項はほぼ存在しない。

編集後記:沈黙は答えではない

今回の事件で最も残念なのは、3大AIプラットフォームが同時にダウンしたことではなく、その後に3社がそろって「戦略的沈黙」を選んだことだ。公式の説明がない状況では、陰謀論と流言飛語が情報の空白を自然に埋めていく。

AI業界は、従来のテクノロジー大企業よりも優れた存在になると約束してきた――よりオープンで、より責任感があり、より安全を中心に据えると。しかしユーザーの信頼に最も直結する障害コミュニケーションにおいて、彼らは旧時代のブラックボックスのように振る舞った。「説明できない」こと自体が、一種のマネジメントの失敗ではないだろうか。一度の停電すら説明する勇気がないのなら、AGIを安全に開発できると公衆にどうやって信じさせるつもりなのか。

私たちはOpenAIとAnthropicがより詳細な事後分析レポートを公開することを期待するとともに、業界全体で統一された障害開示基準の策定を提言する。人々が会話・執筆・プログラミング、さらには意思決定までをAIに委ねるようになった今、彼らにはその権利がある――なぜこれらのサービスが、ある日突然そろって沈黙したのかを知る権利が。

本稿はWIREDより編訳