- Specjalizujemy się w naprawach laptopów, z jakimi nie poradziły sobie inne serwisy
- Naprawa laptopów po zalaniu
- Naprawa laptopów po upadku
- Specjalistyczne naprawy płyt głównych
W małych firmach rolę serwerowni pełni często szafa w pokoju socjalnym albo wydzielony kąt w magazynie. Zasady są jednak te same co przy większych instalacjach — zaniedbane pomieszczenie zamienia drobiazg w awarię dotykającą całą firmę naraz.
Uszkodzony dysk w macierzy nie zatrzymuje pracy — od tego macierz jest. Problem polega na tym, że bez powiadomienia nikt się o nim nie dowiaduje, a awaria drugiego dysku oznacza już utratę danych. To najczęstsza droga od dobrze zabezpieczonego serwera do poważnego przestoju.
W zamkniętym pomieszczeniu bez wymiany powietrza temperatura rośnie szybciej, niż większość osób się spodziewa. Czujnik z powiadomieniem to najtańsze zabezpieczenie, jakie można tam zastosować — ostrzega, gdy klimatyzacja przestaje działać, a nie wtedy, gdy serwery już się wyłączyły.
Opisane przewody i uporządkowana szafa skracają każdą przyszłą naprawę. W plątaninie nieopisanych kabli nawet proste przełączenie zamienia się w godzinę śledzenia, co dokąd prowadzi.
Prace wymagające wyłączenia serwerów wykonujemy poza godzinami pracy firmy.
Czyszczenie wnętrza urządzeń jest ważne, lecz stanowi tylko część przeglądu. Konserwacja powinna obejmować również kontrolę komunikatów sprzętowych, dzienników systemowych oraz mechanizmów powiadamiania. Dziennik systemowy to zapis zdarzeń zgłaszanych przez system operacyjny i działające usługi. Pozwala odnaleźć powtarzające się błędy, które nie spowodowały jeszcze widocznego przestoju.
Sprawdzane są także kontrolery zarządzania serwerem, jeżeli dane urządzenie je ma. Kontroler zarządzania to niezależny moduł umożliwiający odczyt temperatur, stanu wentylatorów, zasilaczy i innych podzespołów. Może działać nawet wtedy, gdy główny system operacyjny nie odpowiada. Sam dostęp do takiego panelu nie wystarcza. Trzeba jeszcze potwierdzić, że ostrzeżenia są przekazywane osobie, która może na nie zareagować.
Weryfikacji wymagają ponadto aktualizacje oprogramowania układowego, czyli firmware sterującego pracą podzespołów. Nie każdą aktualizację należy instalować automatycznie. Najpierw ocenia się jej przeznaczenie, zgodność z używanym sprzętem oraz wpływ na działające usługi. Zmiana wykonywana bez przygotowania może spowodować przerwę w pracy albo utrudnić powrót do wcześniejszej konfiguracji.
Podwyższona temperatura nie zawsze oznacza awarię klimatyzacji. Przyczyną może być niedrożny filtr, warstwa kurzu na radiatorze, zatrzymany wentylator, zasłonięty wlot powietrza albo nieprawidłowe ustawienie urządzeń w szafie. Radiator to metalowy element odprowadzający ciepło z procesora lub innego podzespołu. Gdy jego powierzchnia zostanie pokryta kurzem, przepływ powietrza słabnie, a wentylatory muszą pracować szybciej.
Znaczenie ma również obieg powietrza wokół szafy. Chłodne powietrze powinno trafiać do wlotów urządzeń, a ogrzane nie powinno natychmiast do nich wracać. Niewłaściwie zamontowany sprzęt, puste przestrzenie lub bałagan przed szafą mogą zaburzyć ten przepływ. Objawem bywa głośniejsza praca wentylatorów, okresowe spowolnienia albo wyłączenia pojawiające się dopiero przy większym obciążeniu.
Odczyt pojedynczej temperatury również może nie pokazywać całego problemu. Czujnik umieszczony przy wejściu do pomieszczenia może wskazywać poprawną wartość, gdy za szafą gromadzi się gorące powietrze. Dlatego podczas oceny warunków uwzględnia się miejsce pomiaru, kierunek przepływu powietrza i zachowanie urządzeń pod normalnym obciążeniem.
Macierz dyskowa łączy kilka nośników w jeden kontrolowany zestaw i może utrzymać dostęp do danych po uszkodzeniu określonego dysku. Nie chroni jednak przed każdym zdarzeniem. Przypadkowe usunięcie plików, działanie złośliwego oprogramowania, błąd aplikacji albo uszkodzenie większej liczby elementów może dotknąć cały zestaw. Z tego powodu sprawna macierz i kopia zapasowa pełnią różne funkcje.
Podczas konserwacji warto sprawdzić nie tylko stan nośników, lecz także przebieg odbudowy macierzy. Odbudowa to proces odtwarzania wymaganej nadmiarowości danych po wymianie uszkodzonego dysku. W tym czasie system może pracować wolniej, a pozostałe nośniki są intensywniej używane. Należy również zweryfikować, czy zamontowany dysk zapasowy rzeczywiście może przejąć rolę uszkodzonego elementu.
Kopia zapasowa wymaga osobnej kontroli. Sam komunikat o zakończeniu zadania nie potwierdza, że zapisane dane da się odzyskać. Test odtworzenia polega na pobraniu wybranych plików lub uruchomieniu przygotowanej procedury odzyskiwania w bezpiecznych warunkach. Pozwala wykryć problemy z dostępem, hasłem, nośnikiem albo niepełnym zakresem kopii, zanim wystąpi rzeczywista awaria.
UPS, czyli zasilacz awaryjny, podtrzymuje pracę urządzeń po zaniku napięcia i może chronić je przed częścią zakłóceń zasilania. Świecąca kontrolka nie potwierdza jednak dobrej kondycji akumulatorów. Zużyty zestaw może wyglądać na sprawny podczas normalnej pracy, a wyłączyć się natychmiast po odłączeniu zasilania sieciowego.
Próba pod obciążeniem pozwala ocenić zachowanie zasilacza w warunkach zbliżonych do rzeczywistych. Musi być wykonana w sposób kontrolowany, po ustaleniu skutków ewentualnego niepowodzenia. Nie należy wyciągać wtyczki bez przygotowania, szczególnie podczas pracy usług firmowych. Bezpieczny test uwzględnia stan serwerów, możliwość ich prawidłowego wyłączenia oraz dostęp do urządzeń po zakończeniu próby.
Istotna jest komunikacja między UPS-em a serwerem. Jeżeli przerwa w zasilaniu się przedłuża, oprogramowanie powinno zainicjować kontrolowane zamknięcie systemu. Chroni to dane przed uszkodzeniem wskutek nagłego odcięcia energii. Podczas przeglądu sprawdza się, czy połączenie działa, usługa monitorująca jest uruchomiona, a konfiguracja dotyczy właściwych urządzeń.
Jednym z częstych błędów jest czyszczenie pracującego serwera sprężonym powietrzem. Kurz zostaje wtedy przemieszczony głębiej do urządzenia lub osiada na sąsiednim sprzęcie. Niekontrolowany podmuch może także rozpędzić wentylator do prędkości, do której nie został przeznaczony. Czyszczenie wymaga odpowiedniego przygotowania stanowiska, zabezpieczenia podzespołów i ustalenia, które urządzenie można bezpiecznie wyłączyć.
Ryzykowne jest również odłączanie nieopisanych przewodów w celu poprawienia porządku. Dwa podobnie wyglądające kable mogą obsługiwać zupełnie różne połączenia. Odpięcie niewłaściwego przewodu sieciowego może przerwać dostęp do systemu, telefonu internetowego, kopii zapasowej lub połączenia między przełącznikami. Przełącznik sieciowy to urządzenie łączące komputery, serwery i inne elementy sieci lokalnej.
Nie należy usuwać ostrzeżeń przez samo kasowanie komunikatów albo wyłączanie powiadomień. Alarm może wynikać z chwilowego zdarzenia, ale może też wskazywać rozwijającą się usterkę. Najpierw trzeba ustalić źródło komunikatu, zapisać jego treść i sprawdzić, czy problem nadal występuje. Dopiero potem można potwierdzić alarm lub zmienić sposób raportowania.
Kolejnym błędem jest instalowanie wszystkich dostępnych aktualizacji podczas jednej wizyty bez planu kolejności. Jednoczesna zmiana systemu, sterowników, firmware i konfiguracji utrudnia ustalenie przyczyny, gdy po ponownym uruchomieniu pojawi się problem. Bezpieczniejsza jest kontrolowana procedura z kopią konfiguracji, ustalonym zakresem zmian i możliwością wycofania.
Brak dostępu do programu firmowego nie zawsze oznacza awarię serwera. Podobny objaw może spowodować uszkodzenie przełącznika, błąd routera, problem z usługą nazw albo przerwane połączenie internetowe. Usługa nazw, określana jako DNS, tłumaczy czytelne nazwy urządzeń i usług na adresy używane w sieci. Jej nieprawidłowe działanie może sprawić, że serwer jest dostępny technicznie, ale komputery nie potrafią go odnaleźć pod używaną nazwą.
Powolna praca aplikacji może mieć źródło w przeciążonej sieci, stanowisku użytkownika, bazie danych albo zadaniu kopii zapasowej uruchomionym w niewłaściwym czasie. Baza danych to uporządkowany zbiór informacji obsługiwany przez specjalne oprogramowanie. Samo ponowne uruchomienie serwera może chwilowo ukryć objaw, lecz nie wyjaśni jego przyczyny.
Głośna praca urządzenia również nie przesądza o awarii wentylatora. System chłodzenia może zwiększać obroty z powodu wysokiej temperatury otoczenia, zapchanego filtra lub intensywnego obciążenia procesora. Rozpoznanie wymaga zestawienia dźwięku z odczytami czujników, komunikatami sprzętowymi i aktualnym obciążeniem.
Konserwacja przynosi więcej korzyści, gdy jej wynik zostaje zapisany. Dokumentacja może obejmować listę urządzeń, sposób ich zasilania, połączenia sieciowe, stan nośników, wykryte ostrzeżenia i zalecane działania. Nie chodzi o rozbudowany opis dla samego opisu. Potrzebny jest czytelny zapis, który ułatwi następną kontrolę oraz reakcję podczas awarii.
Warto odnotować także zmiany wykonane podczas wizyty. Informacja o wymienionym przewodzie, przeniesionym urządzeniu czy zmienionym ustawieniu powiadomień pozwala później odtworzyć przebieg prac. Dane dostępowe powinny być przechowywane oddzielnie i bezpiecznie. Domyślnie nie prosimy o hasło użytkownika. Jeżeli wykonanie konkretnej czynności bez dostępu administracyjnego nie jest możliwe, wyjaśniany jest cel i niezbędny zakres takiego dostępu.
Przegląd może zostać wykonany na miejscu przez serwisanta. Prace planuje się tak, aby czynności wymagające wyłączenia urządzeń nie zakłócały bieżącej pracy firmy. Na życzenie podpisywane jest bezpłatne NDA, czyli umowa o zachowaniu poufności. Naprawy nie są przekazywane podwykonawcom.
Kontrolki pomagają szybko zauważyć część problemów, ale nie pokazują całego stanu instalacji. Ostrzeżenie może być widoczne wyłącznie w panelu zarządzania albo w dzienniku systemowym. Niektóre usterki pojawiają się okresowo i znikają przed kolejnym spojrzeniem na obudowę. Dlatego kontrolę wizualną łączy się z odczytem komunikatów i sprawdzeniem powiadomień.
Nie każda czynność wymaga wyłączenia. Odczyt stanu podzespołów, analiza komunikatów czy sprawdzenie warunków w pomieszczeniu mogą być wykonywane podczas pracy. Wyłączenie jest potrzebne przy części prac wewnątrz obudowy, zmianach okablowania zasilającego lub innych działaniach, których nie można bezpiecznie przeprowadzić na działającym urządzeniu. Zakres i kolejność ustala się przed rozpoczęciem prac.
Nie. UPS zapewnia ograniczone podtrzymanie i umożliwia kontrolowane zakończenie pracy, ale nie zastępuje źródła energii działającego bez ograniczeń. Jego możliwości zależą od stanu akumulatorów i rzeczywistego obciążenia. Przestój może ponadto wynikać z awarii sieci, dysków, systemu lub aplikacji, na które zasilacz awaryjny nie ma wpływu.
Zwykle potrzebny jest jeszcze proces odbudowy. Do jego zakończenia zestaw może pozostawać w stanie obniżonej odporności na kolejną awarię. Należy obserwować przebieg operacji, komunikaty kontrolera i stan pozostałych nośników. Samo fizyczne zamontowanie nowego dysku nie potwierdza zakończenia naprawy.
Potrzebna jest informacja, które usługi są krytyczne, jakie urządzenia można wyłączyć i kto może potwierdzić ich poprawne działanie po konserwacji. Warto wskazać zależności między serwerami, pamięcią masową i siecią. Taki plan ogranicza ryzyko przypadkowego zatrzymania usługi, której powiązanie z danym urządzeniem nie było wcześniej oczywiste.
Regularna kontrola pozwala wykryć zużyty akumulator, przegrzewający się podzespół, niesprawne powiadomienie lub pogarszający się stan dysku, zanim pojedynczy problem połączy się z kolejnym. Celem konserwacji nie jest samo odkurzenie szafy, lecz potwierdzenie, że chłodzenie, zasilanie, pamięć masowa, kopie zapasowe i procedury reagowania tworzą spójny system. Dzięki temu podczas rzeczywistej awarii wiadomo, co się wydarzyło, kogo powiadomić i w jakiej kolejności przywracać działanie usług.
Nie wiesz, od czego zacząć? Opisz objaw przez telefon
Zadzwoń, umów wizytę serwisanta — dotrze do Ciebie w ciągu godziny.