Gangguan bekalan elektrik yang meluas yang menjejaskan infrastruktur Perkhidmatan Web Amazon (AWS) telah mengganggu perkhidmatan untuk beribu-ribu platform dan aplikasi di pelbagai negara secara berkala. Laporan pengguna tentang isu sambungan, masalah latensi dan kegagalan pemuatan telah melonjak awal pagi ini , dengan tumpuan yang sangat tinggi di Amerika Syarikat dan kesan yang ketara di Eropah.
Menurut papan pemuka status syarikat, isu tersebut berasal dari rantau US-EAST-1 (Virginia Utara) dan menyebabkan lonjakan kadar ralat yang luar biasa merentasi beberapa API. Menjelang pertengahan pagi, AWS melaporkan melihat tanda-tanda pemulihan yang jelas merentasi pelbagai perkhidmatan, walaupun pasukan masih berusaha untuk menyelesaikan sepenuhnya isu tersebut dan memulihkan semua operasi kepada normal.
Kronologi kejadian
Amaran pertama datang sekitar jam 9:00 pagi (waktu semenanjung Sepanyol), dengan kemuncak insiden sejurus selepas itu dan pemberitahuan berterusan pada alat pemantauan seperti DownDetector. Dari jam 11:00 pagi dan seterusnya, syarikat itu melaporkan bahawa ia telah mengenal pasti kemungkinan punca dan mula melaksanakan langkah-langkah mitigasi yang mempercepat pemulihan merentasi pelbagai lapisan.
Sekitar tengah hari, AWS melaporkan bahawa kebanyakan operasi kembali normal , walaupun ia menyatakan sekatan sekali-sekala terhadap permintaan tertentu dan perkhidmatan tertentu di rantau yang terjejas. Pada awal petang, kesan sisa masih dirasai ketika usaha penstabilan diteruskan.

Di manakah asal-usul teknikal
Syarikat itu memberi tumpuan kepada Amazon DynamoDB , perkhidmatan pangkalan data nilai kunci terurusnya, yang titik akhirnya dalam US-EAST-1 mengalami kegagalan yang mengakibatkan ralat bertingkat merentasi pelbagai kebergantungan. AWS menunjukkan isu DNS yang mendasari sebagai pencetus, yang sedang ditangani secara berperingkat.
Dalam praktiknya, apabila Sistem Nama Domain (DNS) gagal menyelesaikan masalah dengan betul, aplikasi tidak dapat mencari sumbernya , mengakibatkan ralat sambungan, tamat masa dan kegagalan pemuatan data. Sebagai langkah kontingensi, AWS mengesyorkan agar pelanggan yang mengalami masalah berterusan memadamkan cache DNS mereka untuk memulihkan resolusi pada titik akhir yang betul.
Siapa yang terkena
Kesannya meluas: Amazon sendiri melaporkan masalah dengan Alexa dan Prime Video , manakala perkhidmatan pihak ketiga seperti Canva , Duolingo dan Snapchat mengalami masalah . Gangguan juga diperhatikan dalam platform AI generatif dan aplikasi kolaboratif yang bergantung pada awan AWS.
Hiburan digital juga tidak terkecuali. Permainan dan perkhidmatan dengan pangkalan pengguna yang besar, seperti Fortnite , Roblox dan Clash Royale , melaporkan ralat log masuk atau sambungan, manakala beberapa kedai permainan dan pelancar melaksanakan mitigasi untuk mengurangkan impak sehingga trafik stabil.
Kesan di Sepanyol
Di seluruh negara, ramai pengguna melaporkan masalah mengakses aplikasi dan laman web perkhidmatan digital, terutamanya sekitar pertengahan pagi. Platform tiket seperti Ticketmaster turut terjejas, melambatkan pelancaran yang dijadualkan pada tengah hari, termasuk tiket untuk konsert yang sangat dinanti-nantikan.
Institusi kewangan dan platform pengguna utama melaporkan insiden terpencil dalam sistem dalam talian mereka, walaupun kesannya berbeza-beza mengikut rantau dan perkhidmatan. Memandangkan langkah-langkah mitigasi dilaksanakan di rantau AS yang terjejas, pemulihan akses secara beransur-ansur diperhatikan di Eropah.
Situasi semasa dan cadangan
Ketika waktu berlalu, AWS menunjukkan bahawa ia melihat tanda-tanda pemulihan yang ketara merentasi kebanyakan perkhidmatannya, sambil mengekalkan sekatan terhad ke atas operasi tertentu dalam US-EAST-1. Syarikat itu terus memantau prestasi dan melaksanakan pelarasan untuk menyelesaikan sepenuhnya isu tersebut.
Jika anda masih mengalami kegagalan terpencil, adalah dinasihatkan untuk menyemak status rasmi AWS dan, jika sesuai, kosongkan cache DNS atau mulakan semula klien dan perkhidmatan yang bergantung pada resolusi titik akhir di rantau yang terjejas. Dalam penggunaan kritikal, adalah disyorkan untuk mengesahkan failover , kebergantungan rangkaian dan cuba semula dasar untuk meminimumkan kesan latensi dan ralat sementara.
Episod ini mengetengahkan sejauh mana infrastruktur pengkomputeran awan telah menjadi struktur untuk ekonomi digital: kegagalan setempat dalam hab utama boleh diterjemahkan kepada tindak balas berantai pada skala global, daripada penstriman dan permainan video kepada aplikasi kewangan dan produktiviti.