微軟 Azure 服務中斷:發生了什麼事?如何解決的?

微軟Azure雲端運算平台週三遭遇重大故障。事件發生在10月29日15:45 UTC至10月30日00:05 UTC之間。使用Azure Front Door (AFD)的微軟服務受到影響,包括應用程式服務、媒體服務、Microsoft Purview和Plus。

微軟 Azure 服務中斷:發生了什麼事?如何解決的?

此外,由於 Azure 是全球三大雲端基礎架構供應商之一,許多網站都出現了服務中斷。使用者也在Downdetector 上報告了 Microsoft 365、Minecraft、Xbox 及相關網站的問題。

根據Azure 的初步事後審查,這起事件是由「無意的租戶配置變更」造成的。這導致多個 AFD 節點無法正確載入,進而引發延遲、連線錯誤和逾時。本質上,錯誤的租戶配置引發了一系列連鎖故障。

為了解決這個問題,Azure暫時阻止了所有客戶配置更改,並發布了最新的已知穩定版本。

在事件發生期間,微軟官方的Microsoft 365 狀態Azure 支援帳號一直在發布 X 的更新資訊。一度,就連Microsoft 服務運作狀況狀態頁面也無法存取。 10 月 29 日 UTC 時間 18:30 左右,微軟逐步推出了全球修復配置。

Microsoft 365 Status X 帳戶聲明:“我們正在部署受影響基礎架構先前運行正常的配置來解決此問題。與此同時,我們也在努力重新平衡正常基礎架構上的流量,以快速減輕影響。”

最終,微軟確認,Azure 服務故障 (AFD) 對客戶的影響已於 2025 年 10 月 30 日 00:05 UTC 得到緩解。用戶可在 14 天內收到最終事件後評估報告,屆時將有更多詳細資訊發布。 Azure 服務運作狀況警報還可以透過電子郵件、簡訊和網頁通知提醒使用者。

不幸的是,這並非近期首次發生此類故障。就在九天前,亞馬遜網路服務 (AWS) 發生重大故障,導致許多網站和服務離線。根據AWS 服務運作狀況頁面顯示,故障原因是網域名稱系統 (DNS) 解析出現問題。

這說明,即使像網路這樣覆蓋範圍廣、全球性的系統也可能很脆弱。 AWS、微軟Azure和Google服務是支撐大部分基礎架構的三大雲端運算巨頭。如果其中任何一家發生故障,都將造成巨大的影響。

亞馬遜在2025年第二季以30%的雲端運算市佔率領先市場。 Azure則位居第二,佔全球雲端運算市場約20%的份額。同時,Google服務佔據13%的市場。由於近期發生的服務中斷,成千上萬的用戶和系統可能會受到這種市場格局變化的影響。

評論被關閉。