Läbikukkumine pilves Amazon Web Services (AWS) põhjustas esmaspäeval ülemaailmse katkestuse, mis mõjutas veebisaite, rakendusi ja videomänge. Täna varahommikul teatasid arvukad kasutajad Hispaanias juurdepääsuprobleemidest ja populaarsete teenuste aeglusest, viidates a-le maailma krahh oma ulatuselt ebatavaline.
Esimesed hoiatused jälgimisveebisaidil DownDetector hakkasid ilmuma umbes 08:40 (Poolsaare aeg). Sellest ajast alates on võrgud täis sõnumeid, mis kirjeldavad ühenduvusvigu, lõputuid üleslaadimisi ja vahelduvaid katkestusi kriitilistel platvormidel, mis sõltuvad AWS-i infrastruktuur.
Milliseid teenuseid see on mõjutanud
Mõjutatud platvormide hulgas olid Amazoni enda tooted, näiteks veebipood ja abiplatvorm. Alexa y Prime Video, samuti kolmandate osapoolte teenuseid. Juhtumitest teatati Canva, Duolingo, tehisintellekti otsingumootor Piinlikkus ja sotsiaalvõrgustikud nagu Snapchat, mängukogukondades erilise müraga probleemide tõttu Fortnite, Roblox y Clash Royale.
Finantssektor sai löögi: platvormid BBVA, CaixaBank, Banco Santander ja makseteenused, näiteks bizum kogesid vigu, nagu ka andmetelefonid füüsilistes kauplustes. Ameerika Ühendriikides Venmo (sarnaselt Bizumiga) registreeriti samuti probleeme, mis peegeldavad kaskaadefekti esinemissagedus.
Häire ulatus ka piletite väljastamise ja müügini. Live Nation teatatud süsteemide rikkeid Ticket, kuni punktini, kus tuli edasi lükata selliseid väljaandeid nagu tuur Van Goghi kõrv, samas kui muud müügid, näiteks Eric Clapton, said normaalsemalt jätkata.
Ühenduvuse ja avalike teenuste valdkonnas teatati intsidentidest selliste operaatorite puhul nagu Movistar, Oranž y Vodafoneja Aena hoiatas kaardiga maksmise probleemide eest lennujaama parkimineSamal ajal süüdistati mõningaid koostöö- ja voogedastustööriistu ning meedia- ja e-kaubanduse platvorme vahelduvad vead.
Kus oli tehniline päritolu?
Ametliku staatusepaneeli andmetel leidis intsident aset piirkonnas. USA IDA-1 (Põhja-Virginia, USA), mis on üks AWS-i suurimaid ja vanimaid enklaave. Ettevõte märkis a aluseks olev DNS-i probleem algpõhjusena kriitiline komponent, mis tõlgib teenuste nimed IP-aadressideks, et masinad saaksid omavahel suhelda.
DNS-i tõrge mõjutas piirkonna nimede lahendamist, mistõttu mitmed teenused ei suutnud enam oma domeene leida. lõpp-punktidKõige rängemalt kannatanute seas oli Amazon DynamoDB, mille pääsupunktis esines vigu, mis levisid paljudesse rakendustesse, mis sellest andmebaasist sõltuvad.
AWS märkis, et kui pärast leevendamist püsisid ühenduse probleemid lõpp-punktidega DynamoDB US-EAST-1 piirkonnas oli see mugav tühjendage DNS-vahemäludSamal ajal hoiatas ta osaliste piirangute eest teatud taotluste puhul, samal ajal kui kõik kihid platvorm.
Mõju Hispaanias ja teistes riikides
Hispaanias oli mõju tunda online pangandus ja maksed kauplustes, masskasutusega rakendustes ja piletite ostmisel. Mõned ettevõtted teatasid, et andmetelefonid lõpetas tehingute töötlemise hommikupoolikul ja kasutajatel tekkisid takistused sisselogimisel või tehingute lõpuleviimisel apps tavaline.
Mõju oli globaalne, keskendudes probleemi asukoha tõttu selgelt Põhja-Ameerikale, kuid sellel olid tagajärjed ka Euroopas ja teistel turgudel. Sellistes võrgustikes nagu X ja Reddit mitmekordistusid probleemi puudutavad sõnumid. Alexa reageerimatud, rutiinid, mis ei käivitu, ja rakendused, mis ei jõua laadimisekraanist kaugemale – tüüpiline muster, kui DNS-i lahendus.
Samuti esines ajalisi kokkusattumusi AWS-iga mitteseotud juhtumitega, näiteks ajutine langus Redsys mis mõjutas makseid Hispaanias. Kuigi see oli formaalselt Amazonase probleemist eraldi, võimendas samaaegsus tunnet kokkuvarisemine mõnes sektoris.
Ajajoon ja taastumise staatus
Hoiatused algasid umbes kell 08:40 Hispaanias. Keskhommikuks teatas AWS, et nad juba jälgivad taastumise märke pärast leevendusmeetmete rakendamist. Keskpäeva paiku hakkas liiklus üha enamates kohtades normaalseks taastuma. teenused, DownDetectori aruannetes on näha selgeid langusi.
Pärast esimesi tunde teatas ettevõte, et DNS-baasi probleem oli leevendatud ja et enamik operatsioone toimis normaalselt. Siiski hoiatas ta võimaliku konkreetsed piirangud konkreetsete taotluste alusel samal ajal, kui kahjustatud piirkonna täielik taastamine oli lõpule viidud.
Miks AWS-i katkestus halvab poole internetist
AWS võimaldab ettevõtetel ja arendajatel rentida arvutiressursse (arvutus, salvestusruum, andmebaasid, võrgustamine, tehisintellekt) selle asemel, et neid kohapeal hoida. See mudel on platvormi muutnud selgroog Internet: alates suurtest voogedastusteenustest kuni mobiilirakenduste ja maksesüsteemideni sõltuvad kõik otseselt või kaudselt selle infrastruktuurist.
Kui piirkond on nii kriitiline kui USA IDA-1 Kui DNS-iga on probleeme, siis selle mõju kasvab hüppeliselt: teenused ei suuda nimesid lahendada, andmebaasid ei jõua oma lõpp-punktideni ja sõltuvusahelad katkevad. Seega viib üksainus intsident probleemini laialt levinud ebaõnnestumised nii erinevates valdkondades nagu pangandus, haridus, meelelahutus ja e-kaubandus.
Meie kogemus rõhutab vajadust kujundada süsteeme, mis elastsus ja mitmekesistamine: piirkondadevaheline koondamine, tõrkesiirde plaanid ja kontrollitud halvenemise strateegiad. Kuigi paljud teenused taastusid kiiresti, võttis teistel kauem aega, mis rõhutab, kui oluline on ette näha stsenaariumid sügisest.
Kuigi enamik tegevusi on nüüdseks taastunud, jälgivad tehnilised meeskonnad endiselt viimaseid üksikasju ja tagavad, et kõrvalmõjusid ei esine; ettevõte rõhutab, et pärast algpõhjuse leevendamist võivad need püsida. seaded kuni liiklus mõjutatud piirkonnas on täielikult normaliseerunud.
Päev jätab selge jälje: juhtum, kus DNS US-EAST-1 vallandas katkestused kümnetes Amazon.com-i teenustes, Alexa o Prime Video isegi pangad, andmetelefonid, Ticketmaster ja videomängud, märguanded algavad kell 8.40 ja taastuvad järk-järgult keskpäevast alates; meeldetuletus sellest, kui palju internet sõltub infrastruktuurist AWS.