3 أغسطس 2026

AWS 大規模宕機揭示了互聯網的哪些方面

AWS 大規模宕機揭示了互聯網的哪些方面

一片巨大的雲 週一早上,源自亞馬遜網絡服務核心 US-EAST-1 區域(其位於弗吉尼亞州北部靠近美國國會大廈的中心)的中斷導致全球網站和平台大範圍中斷。亞馬遜的主要電子商務平台和其他資產,包括 Ring Doorbells 和 Alexa 智能助理,在早上都遭遇了斷電和斷電,Meta 的消息平台 WhatsApp、OpenAI 的 ChatGPT、PayPal 的 Venmo 支付平台、Epic Games 的多項網絡服務、許多英國政府網站等也是如此。

此次中斷源於 US-EAST-1 的 Amazon DynamoDB 數據庫 API,AWS 告訴 狀態更新 該問題與 DNS 解析問題特別相關。 “域名系統”是一項基本的互聯網服務,其工作原理類似於自動電話簿查找,將 www.wired.com 等 Web URL 轉換為數字服務器 IP 地址,以便 Web 瀏覽器向用戶顯示正確的內容。當 DNS 服務器無法準確連接這些點時,就會出現 DNS 解析問題,並且繼續與電話簿類比,為特定名稱提供錯誤的號碼,反之亦然。

AWS 在周一的狀態更新中寫道:“根據我們的調查,該問題似乎與 US-EAST-1 上 DynamoDB API 端點的 DNS 解析有關。”不久之後,該公司補充道:“如果您在解析 US-EAST-1 上的 DynamoDB 服務端點時仍然遇到問題,我們建議您刷新 DNS 緩存。”

當被問及有關故障性質的詳細信息時,AWS 代表沒有立即做出回應。 DNS 解析問題可能是惡意的(稱為 DNS 劫持),但沒有跡象表明周一的 AWS 中斷是惡意的。

“當系統無法正確解析連接到哪台服務器時,連續的故障就會導致互聯網服務癱瘓,”數據基礎設施公司 Inrupt 的長期安全與合規運營總監兼副總裁 Davi Ottenheimer 說。 “今天的 AWS 中斷是一個典型的可用性問題,我們需要開始將其更多地視為數據完整性故障。”

問題在凌晨 3 點左右開始。等。截至凌晨 5:22,AWS 已實施“初步緩解措施”並已生效。早上 6 點 35 分,亞馬遜表示已經完全解決了潛在的技術問題,但“某些服務將會出現積壓,這可能需要額外的時間才能完全處理。”

AWS 還經歷過其他大規模中斷,例如 重要事件 2023 年。 5 月份,對 AWS、微軟 Azure 和谷歌云服務等巨頭的集中式雲服務的依賴提高了全球網絡安全性和穩定性,為所有客戶奠定了防護和最佳實踐的基礎。但這種標準化伴隨著重大的權衡,因為平台成為大部分關鍵服務的單點故障。

“失敗越來越多地導致誠信,”奧滕海默說。 “數據損壞、驗證失敗,或者在這種情況下,名稱解析損壞,從而毒害了每個後續依賴項。在我們更好地理解和保護完整性之前,我們對運行時的完全關注只是一種幻想。”

來源連結

Copyright © All rights reserved. | Newsphere بواسطة AF themes.