„Amazon“ 150 milijonų dolerių rašybos klaida yra žaibolaidis, padedantis išspręsti didelių debesų problemą

Jei ketinate įdėti visus savo duomenis į debesį, norite, kad tai būtų gerai sukurtas debesis. Šią savaitę „Amazon“ – didžiausia pasaulyje tokios infrastruktūros tiekėja – parodė, kad vis dar trūksta statybos įgūdžių.





Antradienį didelė dalis interneto tiesiog nustojo veikti. „Slack“ neleis žmonėms bendrauti su kolegomis, „Trello“ neleis jums valdyti projekto ir, deja, MIT technologijų apžvalga svetainė neleis skaityti apie naujas technologijas. Taip pat buvo skundų dėl netinkamo išmaniųjų namų aparatinės įrangos veikimo.

Priežastis: „Amazon“ S3 debesų saugojimo sistema sugedo . „Amazon“ yra didžiausia pasaulyje debesų kompiuterijos paslaugų teikėja, todėl daugelis juo besiremiančių paslaugų taip pat negalėjo tinkamai veikti. Ir tai nebuvo tik blykstė: problemai išspręsti prireikė mažiausiai keturių valandų.

Sunku tiksliai apskaičiuoti tikrąją tokio sutrikimo kainą. bet, pagal „Wall Street Journal“. , analitikos įmonė „Cyence“ apskaičiavo, kad tai S&P 500 kompanijoms kainavo mažiausiai 150 mln. Srauto stebėjimo įmonė „Apica“ teigia, kad 54 iš 100 geriausių internetinių mažmenininkų pastebėjo, kad svetainių našumas sumažėjo bent 20 procentų. Taigi negalima apeiti fakto, kad jis buvo brangus.



Dėl to priežastis, kodėl taip atsitiko, yra dar labiau gėdinga. A pareiškimas, kuriame aprašoma, kas nutiko „Amazon“ pripažino, kad pagrindinė gedimo priežastis buvo neteisinga komanda, kurią jos Šiaurės Virdžinijos padalinio darbuotojas įvykdė įprastinės priežiūros metu. Deja, tai sukėlė katastrofišką įvykių kaskadą.

Darbuotojas turėjo atjungti nedidelį skaičių serverių, tačiau padarė klaidą ir išėmė daugiau serverių, nei buvo numatyta, įskaitant du, kurie buvo naudojami pagrindiniai procesai, naudojami visoje sistemoje. Klaida iš esmės panaikino įrenginio galimybę apdoroti vartotojų užklausas.

„Amazon“ valdo kelias debesies „sritis“, išdėstytas visame pasaulyje, o jos paslaugų klientai gali saugoti failus ir paleisti kodą daugiau nei vienoje iš jų. Bet jis yra brangesnis ir kaip pažymi Registras , net įmonės, teikiančios savo paslaugas įvairiose geografinėse vietovėse, pastebėjo, kad jų sistemos apvirto, greičiausiai dėl pajėgumo problemų.



Likus vos keturioms dienoms iki gedimo, apibūdinome būdingą centralizuotų žiniatinklio paslaugų riziką ir spėliojome apie poveikį, kuris būtų jaučiamas, jei „Amazon“ debesies paslauga sugestų. Tuo metu mes perspėjome, kad statymas yra didelis, teigdami, kad saugumas, patikimumas ir kompetencija yra gyvybiškai svarbūs ir galbūt nepakankamai atstovaujami įmonėms, teikiančioms centralizuotas žiniatinklio paslaugas.

Atrodo, kad „Amazon“ sutinka. Jame jau įdiegtos apsaugos priemonės, kad tokie incidentai, kaip įvykęs dėl kumščio turinčio personalo nario, ateityje negalėtų taip greitai išjungti tiek daug serverių.

Tai pradžia. Tačiau šiuo metu aišku, kad debesijos paslaugoms reikia papildomų draudimo polisų, kad jos būtų tvirtos. Pavyzdžiui, „Amazon“ net negalėjo susidoroti, kai iš karto gali sugesti visas jos Šiaurės Virdžinijos įrenginys – vietoj to jis turėtų būti suskirstytas į atskirus posistemius, kurie veikia nepriklausomai.



Net ir tada centralizuotos žiniatinklio paslaugos vis tiek gali būti pažeidžiamos. Jei įsilaužėlis surengs didžiulę ataką prieš vieną teikėją, pavyzdžiui, naudodamas botnetą, jis vis tiek gali priversti didelę žiniatinklio dalį vėl atsijungti. Bet bent jau tai nebūtų rašybos klaidos rezultatas.

(Skaityti daugiau: „Wall Street Journal“. , t jis Registruokis , AP , „Amazon“ žiniatinklio paslaugos , Centralizuotos žiniatinklio paslaugos yra nuostabios – kol jos suklysta , 10 proveržio technologijų: daiktų robotai )

paslėpti