Przeczytasz w 3 min.
Przeczytano 1 089 razy
Ostatnia aktualizacja 2025-04-25

Awaria chmury Google - co się wydarzyło w centrum danych w Ohio?

Google padło na kilka godzin

Pod koniec marca 2025 roku w jednym z centrów danych Google w regionie Columbus (Ohio) doszło do niespodziewanej awarii, która ujawniła, jak bardzo nawet najbardziej zaawansowane systemy mogą być bezbronne wobec jednego słabego ogniwa. Przez sześć godzin ponad 20 usług Google Cloud było niedostępnych, a pełne przywrócenie infrastruktury zajęło niemal dwie doby.

Przyczyną incydentu – jak się właśnie oficjalnie potwierdziło – był uszkodzony akumulator w systemie zasilania awaryjnego. W efekcie zawiodły nie tylko podstawowe źródła prądu, ale i zabezpieczenia, które miały je zastępować.

Kłopotliwy zasilacz w centrum cyfrowego świata

Awaria rozpoczęła się 29 marca o godzinie 12:54 czasu PST. Problem dotyczył strefy us-east5-c – jednej z dostępnościowych stref usług Google Cloud. Wśród niedostępnych systemów znalazły się m.in. Google Compute Engine, Cloud SQL, BigQuery i Kubernetes Engine. Jak się później okazało, zawiódł jeden z akumulatorów UPS (Uninterruptible Power Supply), który miał zapewnić ciągłość zasilania do momentu włączenia się generatorów awaryjnych.

Nie dość, że zasilacz nie zadziałał, to prawdopodobnie zablokował automatyczne przełączenie się systemu na tryb awaryjny. Dopiero ręczna interwencja inżynierów pozwoliła na obejście usterki i uruchomienie generatorów diesla.

Naprawa trwała dłużej niż zakładano

Choć część usług zaczęła wracać do działania już po dwóch godzinach, wiele z nich wymagało indywidualnego restartu. Pełne przywrócenie funkcjonalności zakończyło się dopiero 1 kwietnia nad ranem.

Google opublikowało szczegółowy raport z incydentu, przepraszając klientów i zapowiadając modernizację infrastruktury zasilającej. Firma nie ujawniła jednak nazwy producenta feralnego systemu UPS ani szczegółowych ustaleń dotyczących przyczyn awarii.

Wnioski na przyszłość – technologia to nie wszystko

Zdarzenie z marca 2025 roku po raz kolejny pokazało, że awarie systemów IT nie zawsze wynikają z błędów oprogramowania. Często źródłem problemów są pozornie stabilne elementy infrastruktury – jak właśnie zasilacze, systemy chłodzenia czy błędy w konfiguracji.

Chociaż Google, Amazon Web Services i Microsoft Azure inwestują ogromne środki w zabezpieczenia, żadna infrastruktura nie jest w pełni odporna na awarie. Przykłady z ostatnich lat – od eksplozji sprzętu w centrach danych po globalne zakłócenia wywołane aktualizacją oprogramowania – pokazują, jak delikatna bywa nowoczesna sieć IT.

Czytaj także:

Czy firmy OZE oszukują klientów? Sprawdza to UOKiK

Czy firmy OZE oszukują klientów? Sprawdza to UOKiK

UOKiK sprawdza firmy sprzedające fotowoltaikę i pompy ciepła za sto

Więcej
Obowiązkowe czujniki dymu i czadu – nowy krok w ochronie przeciwpożarowej

Obowiązkowe czujniki dymu i czadu – nowy krok w ochronie

Nowe przepisy MSWiA wprowadzają obowiązek instalacji czujników dymu

Więcej
Kompaktowy strażnik fotowoltaiki - PV Inline nagrodzony na Intersolar 2025

Kompaktowy strażnik fotowoltaiki - PV Inline nagrodzony n

Nowy ogranicznik przepięć PV Inline zdobył prestiżową nagrodę The S

Więcej
Wszechstronność w kieszeni: zestaw narzędzi Wera Tool‑Check PLUS

Wszechstronność w kieszeni: zestaw narzędzi Wera Tool‑Che

Zestaw Tool-Check PLUS od Wera to niepozorne pudełko skrywające aż

Więcej
Japoński przełom w bezprzewodowym przesyłaniu energii. AI projektuje systemy lepiej niż człowiek

Japoński przełom w bezprzewodowym przesyłaniu energii. AI

Japonia znowu wyprzedza świat – tym razem w dziedzinie bezprzewodow

Więcej
Starlink bez tajemnic. Mity i fakty o satelitarnym internecie, który zmienia rynek łączności

Starlink bez tajemnic. Mity i fakty o satelitarnym intern

Jeszcze kilka lat temu internet satelitarny kojarzył się z drogim,

Więcej