Az Amazon Web Services (AWS) infrastruktúráját érintő széles körű szolgáltatáskiesés időszakosan több ezer platform és alkalmazás szolgáltatását zavarta meg különböző országokban. A felhasználói bejelentések a csatlakozási problémákról, a késleltetési problémákról és a sikertelen betöltésekről ma kora reggel megugrottak , különösen az Egyesült Államokban koncentrálódva, és látható hatásokkal Európában.
A vállalat állapotfelmérésén alapuló dashboard szerint a probléma az US-EAST-1 régióban (Észak-Virginia) keletkezett , és szokatlanul megugró hibaszázalékot okozott számos API-nál. Délelőtt közepére az AWS számos szolgáltatásban a helyreállás egyértelmű jeleiről számolt be, bár a csapatok még mindig dolgoztak a probléma teljes megoldásán és az összes működés visszaállításán.
Az esemény kronológiája
Az első riasztások spanyol idő szerint reggel 9:00 óra körül jelentek meg , majd röviddel ezután tetőzött az incidensek száma, és folyamatos értesítések jelentek meg olyan megfigyelőeszközökön, mint a DownDetector. 11:00 órától kezdődően a vállalat arról számolt be, hogy azonosított egy lehetséges okot , és olyan enyhítő intézkedéseket kezdett bevezetni, amelyek felgyorsították a helyreállítást a különböző rétegekben.
Dél körül az AWS arról számolt be, hogy a legtöbb művelet visszatér a normális kerékvágásba , bár az érintett régióban bizonyos kérések és szolgáltatások esetenkénti korlátozásait észlelte. A kora délutáni órákban a stabilizációs erőfeszítések folytatódása közben még mindig érezhetők voltak a fennmaradó hatások .

Hol volt a technikai eredet?
A vállalat az Amazon DynamoDB -re, a menedzselt kulcs-érték adatbázis szolgáltatására összpontosított , amelynek az US-EAST-1 régióban található végpontján hibák jelentkeztek, amelyek több függőségen átívelő hibákat eredményeztek. Az AWS egy mögöttes DNS-problémát jelölt meg kiváltó okként, amelyet szakaszosan kezeltek.
A gyakorlatban, amikor a domainnév-rendszer (DNS) nem képes megfelelően feloldani a címeket, az alkalmazások nem tudják megtalálni az erőforrásaikat , ami csatlakozási hibákhoz, időtúllépésekhez és adatbetöltési hibákhoz vezet. Vészhelyzeti intézkedésként az AWS azt javasolta, hogy a tartós problémákkal küzdő ügyfelek ürítsék ki a DNS-gyorsítótáraikat a megfelelő végpontok feloldásának visszaállítása érdekében.
Kit érintett
A hatás széles körű volt: maga az Amazon is problémákat jelentett az Alexával és a Prime Videóval , míg harmadik féltől származó szolgáltatások, mint például a Canva , a Duolingo és a Snapchat , problémákat tapasztaltak . Kimaradásokat figyeltek meg a generatív mesterséges intelligencia platformokon és az AWS felhőre támaszkodó együttműködésen alapuló alkalmazásokban is.
A digitális szórakoztatás sem kímélte a problémát. A nagy felhasználói bázissal rendelkező játékok és szolgáltatások, mint például a Fortnite , a Roblox és a Clash Royale , bejelentkezési vagy kapcsolódási hibákat jelentettek , míg egyes játékboltok és indítóprogramok enyhítő intézkedéseket vezettek be a hatás csökkentése érdekében, amíg a forgalom stabilizálódott.
Hatás Spanyolországban
Országszerte számos felhasználó számolt be problémákról a digitális szolgáltatási alkalmazások és weboldalak elérésével kapcsolatban, különösen a délelőtt folyamán. A jegyértékesítő platformok , mint például a Ticketmaster, is érintettek voltak, ami a délre tervezett megjelenéseket késleltette, beleértve a nagy várakozással várt koncertek jegyeinek megjelenését is.
A pénzügyi intézmények és a nagyobb fogyasztói platformok elszigetelt incidensekről számoltak be online rendszereikben, bár a hatás régiónként és szolgáltatásonként eltérő volt. Ahogy az érintett amerikai régióban enyhítő intézkedéseket vezettek be, Európában a hozzáférés fokozatos helyreállása volt megfigyelhető.
Jelenlegi helyzet és ajánlások
Az órák múlásával az AWS jelezte, hogy a legtöbb szolgáltatásában jelentős fellendülés jeleit látja , miközben az US-EAST-1 régión belüli bizonyos műveletekre vonatkozóan továbbra is korlátozott korlátozásokat tart fenn. A vállalat továbbra is figyelemmel kíséri a teljesítményt, és a probléma teljes megoldása érdekében módosításokat hajt végre.
Ha továbbra is elszigetelt hibákat tapasztal, ajánlott ellenőrizni a hivatalos AWS állapotot, és adott esetben törölni a DNS-gyorsítótárat, vagy újraindítani azokat a klienseket és szolgáltatásokat az érintett régióban, amelyek végpontfeloldásra támaszkodnak. Kritikus telepítések esetén a késleltetés és az átmeneti hibák hatásának minimalizálása érdekében ajánlott ellenőrizni a feladatátvételeket , a hálózati függőségeket és az újrapróbálkozási szabályzatokat is.
Az epizód rávilágít arra, hogy a felhőalapú számítástechnikai infrastruktúra milyen mértékben vált strukturálissá a digitális gazdaság számára: egy kulcsfontosságú központban bekövetkező lokalizált meghibásodás globális szintű láncreakciókat indíthat el , a streamingtől és a videojátékoktól kezdve a pénzügyi és termelékenységi alkalmazásokig.