ニュース
ニュース

OpenAIのブラックアウトウィーク:ChatGPTとSoraの障害がクラウドの脆弱なコアを露呈

2025-06-17 1074


10年2025月XNUMX日、OpenAIは壊滅的な技術的障害に見舞われ、混乱に陥りました。ChatGPTとSoraが同時にダウンしたのです。数時間にわたり、世界中の何百万人もの人々がAIワークフローを突然遮断され、ライター、プログラマー、研究者、そして企業が麻痺状態に陥りました。これは単なる不具合ではなく、AIの巨人でさえ脆弱な基盤の上に成り立っていることを痛感させるものでした。

障害は世界中で発生し、ユーザーはウェブ、アプリ、デスクトップインターフェースから締め出されました。OpenAIのステータスページには、ChatGPTの全ユーザーに「重大な障害」が発生したことが記載されていましたが(APIサービスは引き続き機能していました)、明確な原因は示されていませんでした。時間が経つにつれ、人々の不満は高まりました。Xのあるユーザーが投稿した次のような抗議の声が、広く反響を呼びました。
「これは警鐘です。製品リリース時やクライアントの危機の際に重要なツールを紛失したら?壊滅的な打撃です。」
合計ダウンタイムは8時間近くになった—OpenAI にとって 90 日間で最も長く、最も深刻な障害。

ドミノ効果:一つの雲が崩れると、多くのサービスがそれに続く

ChatGPTがフリーズすると、予想通りの混乱が始まりました。ユーザーはGoogleのGeminiやAnthropicのClaudeといった代替サービスに殺到しました。 ジェミニは約60%上昇372,000万XNUMX件のクエリを記録し、ChatGPTのバックアップとして最高の地位を確立した。しかし、安堵は長くは続かなかった。
数時間後、Gemini、Claude、そしてPerplexityはトラフィックの急増に耐えきれず、サーバーエラーを表示しました。一方、Perplexityは「キャパシティオーバーです」と認めました。ある観察者は、その状況を的確に捉えていました。

「ドミノ倒しのように、一つの雲が割れると、他の雲もその重みで崩れ落ちる。」
これは新しいことではありませんでした。ほんの数日前の13月XNUMX日には Google CloudのIAMの失敗 同様の攻撃は、OpenAI、Shopify、そして世界中の決済システムを3時間以上にわたって麻痺させました。そこから得られる教訓は?集中型のクラウドインフラは、現代のウェブにとって単一障害点となるということです。


1 回の障害で AI の世界を「破壊」したのはなぜでしょうか?

1. 集中型クラウドの脆弱なバックボーン
OpenAIは、他の多くのAI大手企業と同様に、Google Cloudのようなハイパースケーラー上で稼働しています。アイデンティティ管理(IAM)や負荷分散システムに障害が発生すると、APIが停止し、下流のすべてがクラッシュします。「99.99%の稼働率」を謳っているにもかかわらず、複雑さゆえに隠れた脆弱性が生まれます。

2. 冗長性の幻想
企業がマルチクラウド戦略(例:OpenAI + Google Cloud + Azure)を採用したとしても、単一のプロバイダーとの緊密な統合はフェイルオーバー時に遅延を引き起こします。あるエンジニアはこう皮肉を込めて言いました。

「『クラウド』って空だと思っていたんだけど、実は誰かの天井だったんだ。」 

3. 社会のAI依存の深まり
コーディングからコンテンツ作成まで、 1.8億人のユーザーがChatGPTを利用 毎日。それがなくなると、生産性は急落します。私たちはレジリエンスを利便性と引き換えにしてきました。そして、停止は大きな代償を払うことになります。


単なる不具合ではない:OpenAIの体系的な課題

この障害により、インフラストラクチャを超えた亀裂が露呈しました。

  • データと人材の不足GPT-5の開発は質の高いデータが不足し、主要な科学者の流出が続いている

  • 合成データの障害: 希少な実データを補うために使用されるが、「報酬ハッキング」や不安定な出力のリスクがある

  • セキュリティの盲点過去の障害にはDDoS攻撃が関与していたが、防御は依然として反応的である

エドワード・ジトロン氏のような批評家は、生成AIの「持続不可能なバブル」が崩壊し、テクノロジー大手が過度に危険にさらされ、国民が不信感を抱くことになるかもしれないと警告している。


OpenAIと業界の対応

OpenAIの動き:

  • サイバー脅威などの「壊滅的なリスク」に対抗するための「準備チーム」を結成

  • オープンソースモデルについての議論(サム・アルトマン: 「オープンソースに関して私たちは間違っていました」

  • 「Deliberative Alignment」フレームワークをアップグレードし、モデル推論に安全性を組み込む

業界の変化:

  • マルチクラウドハイブリッド設定: ベンダーロックインを回避し、単一プロバイダーのクラッシュを乗り切る

  • エッジコンピューティング: クラウドへの依存を減らすためにデータをローカルで処理する

  • より厳しい規制EUのAI法では、障害発生時に企業に世界売上高の最大7%の罰金を課すことになった。


将来に向けた停電対策:3つの道

  1. 失敗のための建築家: クラウドは誤りがあるものとして扱い、マルチクラウドの即時フェイルオーバーを備えたアプリを設計します。

  2. 基本的なスキルを取り戻すAI倫理学者が推奨するように、過度の依存は避けるべきです。ChatGPTが消滅したら、あなたは仕事ができるでしょうか?

  3. 透明性を求めるOpenAI などのプロバイダーに稼働時間のログと復旧計画を開示するよう求めてください。そうしないと、法的措置を受けることになります (Google Cloud のクラッシュ後の Shopify のように)。

10月XNUMX日の停電は単なる一時的な問題ではなかった。それはAI依存時代のストレステストだった障害のコストが増大し、範囲が拡大するにつれ、レジリエンスは後付けでは考えられない。AIを支えるクラウド自体が、破られない存在でなければならない。