Ако днес сте се събудили с автоматичен имейл от Amazon Web Services (AWS), че текущата ви месечна сметка е надхвърлила няколко милиарда долара, не бързайте да обявявате фалит. В момента в ИТ средите по целия свят се вихри истинска вълна от паника и хумор, след като масиран бъг в изчислителната система за таксуване на AWS започна да генерира космически суми за обикновени потребители.
В реално време десетки системни администратори и собственици на компании споделят в платформи като Reddit и Hacker News скрийншотове на прогнозни сметки от 1.7 милиарда, 56 милиарда и дори 109 милиарда долара – за инфраструктури, които обикновено струват под $100 на месец.
Какво точно се случи?
От Amazon официално потвърдиха за проблема в техния AWS Health Dashboard, определяйки го като софтуерен инцидент с подсистемата за изчисление на прогнозни разходи (estimated billing computation subsystem).
Бъгът е в модула за определяне на единичните цени (unit pricing). Системата е започнала грешно да умножава реалното потребление по абсурдни тарифи, което автоматично е задействало „Billing Alerts“ (алармите за превишен лимит) и е заляло пощите на управителите с критични известия за колосални дългове. От компанията уверяват, че това са само грешни визуализации и реалните банкови карти няма да бъдат таксувани с тези суми.
ИТ уроците от „милиардния срив“
Въпреки че ситуацията е по-скоро комична, тя поставя няколко много важни въпроса за управлението на фирмената ИТ инфраструктура:
- Значението на Billing Alerts (Имейл аларми): Инцидентът доказа, че настройките за лимити работят безотказно. Всяка компания трябва да има конфигурирани аларми, които да сигнализират веднага, ако разходите скочат необичайно – било то заради бъг, забравена работеща машина или реална хакерска атака (например криптомайнинг в облака).
- Запазване на самообладание и проверка: При получаване на подобни критични известия първата стъпка винаги е проверка на официалните канали за статус (Status Dashboards) и консултация с ИТ специалисти, преди да се предприемат панически действия.
- Облакът не е безгрешен: Дори най-големите технологични мастодонти в света допускат софтуерни грешки в най-критичните си системи. Това показва, че следенето и управлението на облачната среда не трябва да се оставя на самотек.
Подобни софтуерни аномалии показват, че управлението на технологиите не е просто въпрос на първоначална настройка, а на денонощно следене и адекватна реакция. Ние от Simplex Systems сме плътно до бизнеса, за да превеждаме сложните ИТ казуси на разбираем език и да гарантираме, че инфраструктурата ви е в сигурни ръце. Като част от нашата ит поддръжка и компютърна поддръжка, ние поемаме контрола над вашите облачни услуги, настройките за киберсигурност и сигурността на корпоративните компютърни мрежи. Независимо дали става въпрос за правилно конфигуриране на автоматични аларми, текуща поддръжка на сървъри, или внедряване на виртуализация на сървъри, екипът ни следи за всеки детайл. С нашата абонаментна компютърна поддръжка получавате спокойствието, че до вас стои екип от специалисти, които знаят как да реагират веднага – без значение дали става въпрос за реален хардуерен проблем, или за фалшива сметка за милиарди.



