23/06/2026
Van egy bizonyos fajta némaság, amit minden üzemeltető ismer. Az a pár másodperc, amikor a monitoring riaszt, megnyitod a terminált, lefuttatod az első kubectl get pods parancsot, és a kimenet nem azt mutatja, amire számítottál. Nem egyetlen piros sor. Hanem tíz. Húsz. Több namespace-ben, több node-on. És a gyomrod összeszorul, mert tudod: ez nem egyetlen szolgáltatás hibája.
Ez a cikk egy ilyen estéről szól. Egy anonimizált, valós production incidensről, ahol egy három node-os MariaDB-Galera klaszter teljesen szétesett egy látszólag ártalmatlan karbantartási lépés után. Leírjuk a teljes diagnózist, a konkrét parancsokat, a valós hibaüzeneteket, és ami a legfontosabb: a helyreállítás helyes sorrendjét — azt a részt, amit a legtöbb tutorial kihagy. A galera cluster helyreállítás ugyanis önmagában nem nehéz. A nehéz az, hogy felismerd, mikor nem a Galera a probléma, hanem csak a tünet.