$SOL $SPCX マイクロソフトのAzure AIサービスが6時間にわたり障害、世界中の顧客に影響

先週、マイクロソフトのAzureで大規模なAIサービス障害が発生し、Copilot、OpenAI API呼び出し、そして一部の機械学習ワークロードが6時間停止しました。

原因は、データセンターの冷却システムの故障に加えて、トラフィックのスケジューリング(配分)ミスが重なったことで、計算リソースが広範囲にわたりオフラインになったことです。

これは今年のAzureとして3度目の重大障害で、顧客はマイクロソフトのAI基盤インフラの安定性に疑問を持ち始めています。

障害の間、 一部の企業は臨時で代替のクラウド基盤へ切り替えました。

私の見立てでは、今回の障害は集中型のAI基盤インフラの脆弱性を露呈しました。

数百万人のユーザーのAIサービスが、少数のデータセンターにすべて依存しているときは、冷却システムの不具合ひとつで雪崩のように連鎖する可能性があります。

分散型の計算基盤の価値は、まさにこのような場面で最も明確になります。a p i a r y sはノードを世界の異なる地域、異なるハードウェアに分散し、卵を1つのカゴに入れない設計です。

将来は、誰もが自分専用のAIアシスタントを持つようになるかもしれません。それらは、より柔軟で分散されたネットワーク上で動くべきです。 $ H N Y - d 6 b 0

Azureまた落ちたね。集中型AI基盤インフラって、まだ信頼できると思う?#币安九周年 #AI