Globální výpadek služeb Amazon Web Services: Co se stalo a koho to ovlivnilo?

  • Globální incident AWS s původem z US-EAST-1 (Virginie), identifikovaný jako problém DNS.
  • Průřezový dopad: Amazon, Alexa, Prime Video, banky (BBVA, Santander, CaixaBank), datové telefony, Ticketmaster a videohry jako Fortnite nebo Roblox.
  • Varování začala vycházet kolem 08:40 (CST). Známky oživení se očekávaly v polovině dopoledne a základní problém se začal zmírňovat do časného odpoledne.
  • AWS doporučila vyprázdnění DNS cache a varovala před občasnými omezeními během normalizace systémů.

Globální dopad na AWS

Výpadek cloudu Amazon Web Services (AWS) způsobil v pondělí globální narušení provozu, které ovlivnilo webové stránky, aplikace a videohry. Brzy ráno hlásila řada uživatelů ve Španělsku problémy s přístupem a pomalý výkon oblíbených služeb, což naznačuje neobvykle rozsáhlý globální výpadek .

První upozornění na monitorovacím webu DownDetector se začala objevovat kolem 08:40 (polostrovního času). Od té doby jsou sociální média zaplavena zprávami popisujícími chyby v připojení, nekonečné doby načítání a občasné výpadky na kritických platformách, které se spoléhají na infrastrukturu AWS.

Které služby byly ovlivněny

Mezi postiženými platformami byly jak vlastní produkty Amazonu, jako je jeho internetový obchod, asistent Alexa a Prime Video , tak i služby třetích stran. Incidenty byly hlášeny u společností Canva , Duolingo , vyhledávače s umělou inteligencí Perplexity a sociálních sítí, jako je Snapchat , přičemž herní komunity znepokojovaly zejména problémy s hrami Fortnite , Roblox a Clash Royale.

Finanční sektor pocítil dopad: platformy od BBVA , CaixaBank , Banco Santander a platební služby jako Bizum zaznamenaly chyby, stejně jako pokladní terminály ve fyzických obchodech. Ve Spojených státech zaznamenala problémy i společnost Venmo (podobná společnosti Bizum), což odráží kaskádový efekt výpadku.

Přerušení provozu ovlivnilo i vydávání a prodej vstupenek. Live Nation hlásil selhání v systémech Ticketmasteru , což vedlo k nutnosti odložit vydání, jako například turné La Oreja de Van Gogh , zatímco prodej jiných skladeb, například Erica Claptona , mohl pokračovat normálněji.

V oblasti konektivity a veřejných služeb hlásili incidenty operátoři jako Movistar , Orange a Vodafone a společnost Aena hlásila problémy s placením kartou na parkovištích letišť . Mezitím některé nástroje pro spolupráci a streamování, stejně jako mediální platformy a platformy elektronického obchodování zaznamenaly občasné výpadky.

Kde byl technický původ

Podle oficiálního přehledu stavu se incident odehrál v regionu US-EAST-1 (Severní Virginie, USA), jednom z největších a nejstarších regionů společnosti AWS. Společnost identifikovala jako hlavní příčinu problém s DNS , což je kritická součást, která překládá názvy služeb na IP adresy, aby mezi počítači mohla komunikovat.

Výpadek DNS ovlivnil rozlišení jmen v regionu a zabránil více službám v nalezení jejich koncových bodů . Mezi nejvíce postižené patřila Amazon DynamoDB , jejíž přístupový bod zaznamenal chyby, které se rozšířily do řady aplikací závislých na této databázi.

Společnost AWS uvedla, že pokud problémy s připojením k koncovým bodům DynamoDB v oblasti US-EAST-1 přetrvávají i po zmírnění problémů, je vhodné vyprázdnit mezipaměti DNS . Zároveň varovala před částečnými omezeními určitých požadavků, zatímco se stabilizují všechny vrstvy platformy.

Dopad ve Španělsku a dalších zemích

Ve Španělsku se dopad projevil v online bankovnictví a platbách v obchodech, v široce používaných aplikacích a při nákupu jízdenek. Některé společnosti uvedly, že pokladní terminály přestaly v některých částech dopoledne zpracovávat transakce a uživatelé měli potíže s přihlášením nebo dokončením transakcí v běžně používaných aplikacích.

Výpadek byl globální, s jasným zaměřením na Severní Ameriku kvůli lokalizaci problému, ale ovlivnil i Evropu a další trhy. Na platformách sociálních médií, jako jsou X a Reddit, došlo k nárůstu zpráv o nezodpovězené Alexě , rutinách, které se nespouštěly, a aplikacích uvízlých na obrazovce načítání – typický vzorec, když selže překlad DNS.

Došlo také k časovým shodám s incidenty nesouvisejícími s AWS, jako například k dočasnému výpadku v Redsysu , který ovlivnil platby ve Španělsku. Ačkoli se AWS formálně distancovala od problému s Amazonem, současné události zesílily pocit kolapsu v některých odvětvích.

Časová osa a stav zotavení

Výpadky začaly ve Španělsku kolem 08:40 . V polovině dopoledne společnost AWS oznámila, že po zavedení zmírňujících opatření již pozoruje známky zotavení . Kolem poledne se provoz začal normalizovat u stále většího počtu služeb , přičemž v hlášeních DownDetector došlo k jasnému poklesu.

Po prvních několika hodinách společnost oznámila, že základní problém s DNS byl vyřešen a že většina operací funguje normálně. Varovala však před možnými občasnými omezeními specifických požadavků, dokud nebude dokončena úplná obnova postižené oblasti.

Proč výpadek AWS paralyzuje polovinu internetu

AWS umožňuje firmám a vývojářům pronajímat si výpočetní zdroje (výpočetní techniku, úložiště, databáze, sítě, umělou inteligenci) namísto jejich údržby v místních podmínkách. Tento model z platformy udělal páteř internetu: od hlavních streamovacích služeb až po mobilní aplikace a platební systémy, vše přímo či nepřímo závisí na její infrastruktuře.

Když se v kritickém regionu, jako je US-EAST-1 , vyskytne problém s DNS, má to obrovský dopad: služby nejsou schopny přeložit jména, databáze nejsou schopny dosáhnout svých koncových bodů a řetězce závislostí jsou přerušeny. V důsledku toho se jediný incident může rozvinout do rozsáhlých selhání v různých odvětvích, jako je bankovnictví, vzdělávání, zábava a elektronický obchod.

Tato zkušenost zdůrazňuje potřebu navrhovat odolné a diverzifikované systémy: redundanci napříč regiony, plány pro přepnutí na záložní systém a strategie řízené degradace. Zatímco mnoho služeb se obnovilo rychle, jiným to trvalo déle, což ukazuje, jak důležité je předvídat scénáře výpadků .

Přestože většina provozu byla obnovena, technické týmy stále sledují finální detaily a zajišťují, aby nedošlo k žádným vedlejším účinkům; společnost zdůrazňuje, že po zmírnění hlavní příčiny mohou úpravy přetrvávat , dokud nebude provoz v postižené oblasti plně normalizován.

Z tohoto dne vyplývá jeden jasný závěr: incident DNS v oblasti US-EAST-1 spustil výpadky desítek služeb, od Amazon.com, Alexy nebo Prime Video až po banky, platební terminály kartou , Ticketmaster a videohry, s varováními od 08:40 a postupným zotavováním od poledne; připomínka toho, jak moc internet závisí na infrastruktuře AWS.

Nejlepší agenti Rainbow Six Siege roku 2021
Související článek:
Nejlepší agenti Rainbow Six Siege roku 2021

Přidat jako preferovaný zdroj v Googlu