Diagnostyka Sophos Switch: zabezpieczanie logów i danych pomocy technicznej
Dobra diagnostyka nie zaczyna się od restartu ani maksymalnego logowania. Należy wyjść od objawu, wykonać najmniejszy przydatny test i zebrać dowody. Nie jest to projektowanie VLAN-ów, routingu ani architektury.
Szybka procedura
- Określ objaw i kryterium sukcesu na podstawie poniższej tabeli.
- Zapisz tożsamość i stan początkowy switcha.
- Przed każdą zmianą zachowaj liczniki związane z objawem.
- Wykonaj najmniejszy odpowiedni test diagnostyczny.
- Pobierz logi RAM i flash; poziom zwiększaj tylko tymczasowo i w razie potrzeby.
- Porównaj wynik z kryterium sukcesu lub ze sprawnym portem odniesienia.
- Cofnij tymczasowe logowanie i Remote Assistance, a następnie potwierdź stan docelowy.
- Jeśli problem pozostaje otwarty, utwórz zgłoszenie albo dołącz zredagowany pakiet do istniejącego zgłoszenia.
Najpierw sprecyzuj objawy
Przed pierwszą ingerencją zapisz jeden pełny zestaw informacji:
- Czas: pierwsza i ostatnia obserwacja z datą i strefą czasową; objaw ciągły lub sporadyczny.
- Wpływ: całkowita awaria, utrata pakietów, niska przepustowość, brak PoE, brak synchronizacji Fusion albo tylko ostrzeżenie.
- Zakres: numer seryjny, lokalizacja, port, VLAN, podłączone urządzenie oraz użytkownicy lub usługi objęte problemem.
- Wcześniejsza zmiana: konfiguracja, okablowanie, firmware, zasilanie lub topologia wraz z czasem.
- Odtworzenie: dokładne źródło i cel, wynik oczekiwany i rzeczywisty oraz częstotliwość.
- Obejście: czy działa inny port, ścieżka lub źródło zasilania.
- Wpływ biznesowy: lokalizacje i usługi objęte problemem oraz dostępna redundancja.
Nie zaokrąglaj później godzin z pamięci: dokładny czas łączy obserwacje, liczniki, zdarzenia, komunikację Fusion i dane supportu.
Powiąż objaw z pierwszą kontrolą
| Objaw | Najpierw sprawdź | Widok/funkcja |
|---|---|---|
| Switch/klienci niedostępni | Fusion, kontakt, zasilanie, zarządzanie | System details, Alerts |
| Straty na porcie | RX/TX, błędy, peer, kabel | Port Statistics, Cable Diagnostics |
| Złe urządzenie/VLAN | MAC, port, VLAN | MAC Address Table |
| Brak PoE | budżet, prąd, napięcie, moc | PoE Power Usage |
| Sieć niedostępna | źródło, ścieżka L3, powrót | Network Diagnostics |
| Podejrzany SFP | moduł/możliwości | SFP Module Info |
| Błąd zadania Fusion | alarm, kontakt, zadanie, czas, agent | System details, System time, Task queue, Sophos error reporting |
| CPU/pamięć | obciążenie podczas objawu | Resource Usage |
Pojedynczy pomiar nie dowodzi przyczyny; porównuj ten sam przedział lub sprawny port.
Sprawdź dostęp i uprawnienia
Konto musi mieć dostęp do właściwego Tenant i My Products > Switches. Odczyt wystarcza do obserwacji; Log settings, Remote assistance i zmiany wymagają zapisu. Sprawdź tenant, przypisanie i rolę. Diagnostics otwiera konsolę lokalną: klient w tej samej podsieci i osobne konto lokalne.
Sprawdź stan początkowy w Sophos Fusion
W My Products > Switches > Switches zapisz Serial no., Model, Name, MAC Address, firmware, State, ostatnie zdarzenie/komunikację, Alerts, Task queue, SNTP status, serwery/porty NTP, Timezone, czas letni i Configuration source. Tylko gdy istotne: Powered on, Connection usage, site/tagi, Parent Site/Stack i PoE.
Koreluj czasy tylko przy znanej strefie, czasie letnim i odchyleniu. System time nie dowodzi widocznego aktualnego zegara; użyj datowanego logu/zdarzenia lub zweryfikowanego widoku lokalnego dla modelu/firmware. Koryguj po pierwszym zebraniu i zgodnie z change control.
Interpretuj stany Fusion
Waiting for sync: połączenie/Task queue, bez kolejnych zmian. Pending: zadanie i poprzedniki. Syncing: czekaj, nie zapisuj lokalnie. Out of sync: zapisz źródło, różnice, błędy. Suspended: kontrolowana konserwacja firmware. Manual synchronization needed: zachowaj przyczynę/kolejkę; nie zaczynaj od Reapply all settings. Dokumentuj stronę, pole, wartość i Configuration source.
Używaj widoków diagnostycznych selektywnie
Jeśli nie działa tylko link Diagnostics, najpierw sprawdź tę samą podsieć. Open local switch management używa tej samej drogi.
Zasoby, porty i tabela adresów
Resource Usage otwiera Monitor > Realtime Meters; MAC Address Table — Monitor > Dynamic MAC Address i Monitor > Static MAC Address; Port Statistics — Monitor > Statistics > Ports z pakietami i błędami TX/RX. Porównaj port wadliwy i sprawny. W centralnym widoku Statistics > Port zachowaj RX discard i TX discard; lokalnie tylko po weryfikacji dla modelu/firmware. Porównuj przyrosty w tym samym czasie, nie licznik skumulowany jako szybkość. W razie potrzeby użyj centralnych widoków Statistics: L2, L3, 802.1X security, Port i RMON.
PoE, kabel i SFP
PoE Power Usage otwiera Monitor > Dashboard > PoE Power Settings; Cable Diagnostics — Analyze > Diag Tools; SFP Module Info — Monitor > SFP Module Information. Przed Test zapisz liczniki/link i oceń ryzyko produkcyjne oraz zarządzania. Zapisz port, peer, kabel, czas i wynik; nie uogólniaj.
Ping i traceroute
Network Diagnostics otwiera Analyze > Ping Test i Analyze > Trace Route. Zapisz cel, oczekiwaną ścieżkę/dostępność, start i pełny wynik. Najpierw sprawdź znany cel na tej samej ścieżce. Jeśli też zawiedzie, badaj część wspólną; inaczej rozbieżność. Dowolny host internetowy nie dowodzi wewnętrznego błędu VLAN/routingu.
Zabezpiecz zdarzenia i logi
Event Logging otwiera Monitor > Local Logging i Monitor > Log Table. Użyj Download w Diagnostics > RAM logs i Diagnostics > Flash logs, aby zachować oba zestawy. RAM logs znikają po wyłączeniu lub restarcie; Flash logs pozostają, ale szczegółowe logowanie zwiększa liczbę zapisów. Pełne logi nadpisują najstarsze wpisy.
Kontrolowana zmiana poziomów
W Diagnostics > Log settings opcja Not set używa ustawienia lokalnego. Kolejność: Emergency (0), Alert (1), Critical (2), Error (3), Warning (4), Notice (5), Info (6) i Debug (7); wybrany poziom obejmuje wszystkie poziomy o wyższej ważności, a flash domyślnie używa Critical. Tylko gdy trzeba: zapisz custom Log settings, RAM log level, Flash log level i pobierz logi; określ okno, warunek stop i osobę; ustaw minimum przez Update; odtwórz raz; pobierz; natychmiast przywróć, odśwież i potwierdź On/Off/Not-set. Przerwij przy większym wpływie lub utracie zarządzania. Poziom Debug, zwłaszcza dla flash, utrzymuj jak najkrócej.
Funkcje supportu ze skutkami ubocznymi
Sophos error reporting i Remote Assistance
Sophos error reporting, domyślnie aktywne, wysyła logi agenta przy błędach firmware/backup/sync i ponownym połączeniu; opis wyklucza konfigurację/dane sieciowe. Włącz Remote assistance tylko dla istniejącego zgłoszenia: zapisz numer, cel, zgodę, kontakt, najkrótszy czas, Activate, początek/koniec; potem Deactivate i sprawdź.
Tylko na polecenie Support
Take a switch snapshot wykonuje polecenia i zapisuje wynik w Task queue; Restart Sophos Fusion agent restartuje procesy agenta; Clear core files usuwa pliki core utworzone po zatrzymaniu odpowiedzi procesu, aby zwolnić miejsce. Zapisz zgłoszenie, instrukcję, czas, stan i oczekiwany wynik; przed usunięciem potwierdź, że Sophos Support nie potrzebuje już tych dowodów.
Utwórz i zredaguj pakiet dowodów
Oryginały zachowaj bez zmian w folderze z ograniczonym dostępem; udostępniaj kopię i zapisuj każdą edycję. Pełny pakiet zawiera:
- Opis zgłoszenia: usterkę, bieżący wpływ, początek i strefę czasową, odtworzenie, wynik oczekiwany i rzeczywisty, obejście i wpływ biznesowy.
- Tożsamość urządzenia: model, numer seryjny, firmware, wersję agenta Fusion, site, parent, stan zarządzania i uptime.
- Podstawę czasu: SNTP, serwery i porty NTP, strefę, czas letni, źródło konfiguracji i znane odchylenie; aktualny czas switcha tylko z datowanego logu/zdarzenia lub zweryfikowanego widoku lokalnego.
- Stan: alerty, ostatni kontakt, zadania, porty, VLAN-y i źródło konfiguracji.
- Testy i pomiary: cel, czas, pełny wynik, liczniki przed/po oraz dane ping, traceroute, kabla, PoE, SFP lub zasobów zależnie od objawu.
- Logi: pobrane RAM i flash przed/po odtworzeniu, z nazwą pliku i czasem zebrania.
- Zmiany: każdą zmianę diagnostyczną, początek, koniec, wynik i potwierdzone cofnięcie; oznacz aktywny dostęp, taki jak Remote Assistance, i jego wygaśnięcie.
- Ocenę: oddziel fakty od interpretacji i wskaż treść zredagowaną lub spseudonimizowaną.
Usuń hasła, tokeny sesji/API, klucze prywatne, community SNMP i sekrety; unieważnij ujawnione dane i minimalizuj dane osobowe. Zachowaj relacje, czasy, strefę, kody i liczniki; używaj stałych pseudonimów CLIENT-A i SWITCH-UPLINK-1, zachowując oryginał wewnętrznie.
Eskaluj do Sophos Support
Osobisty support i Advanced RMA wymagają Switch Support and Services dla każdego switcha; zobacz Jak licencjonowany jest Sophos Fusion?. Potrzebna jest Sophos ID z dostępem do klienta/Tenant. Support obejmuje instalację, administrację, działanie, zachowanie niezgodne z dokumentacją i pytania ogólne, nie nową implementację.
W Sophos Support Assistant zaloguj się, opisz/odpowiedz, poproś o zgłoszenie, sprawdź/wyślij i czekaj na numer. Przechowuj pod nim dowody. Oceniaj zalecenia pod kątem okna, wpływu i rollbacku; nie otwieraj równoległych zgłoszeń, dopisuj zmiany z dokładnym czasem. Portal, czat i telefon zależą od regionu.
Granica między supportem a RMA
Brak dostępu, zły port lub restarty nie potwierdzają wady sprzętu. Udokumentuj zasilanie, kable, peer, firmware/sync i logi; Sophos decyduje o wymianie. Nie resetuj, otwieraj, wyrzucaj ani wysyłaj bez instrukcji. Factory Reset i Clear core files niszczą dowody. Po potwierdzeniu przekaż serię, model, zakres, adres, ryzyko prywatności i instrukcje do Przygotowanie usterki sprzętu Sophos i RMA.
Kontrola końcowa i bezpieczne cofnięcie
Potwierdź pierwotne poziomy RAM/flash i custom Log settings; wyłączone lub zatwierdzone wygasanie Remote assistance oraz Sophos error reporting względem początku; prawidłowe zarządzanie, porty, PoE i uplinki; brak otwartego błędu Task queue lub zmiany źródła; ponowny test od użytkownika i sieci; przy otwartej usterce okno obserwacji i następną eskalację.
„Nie można odtworzyć” nie oznacza naprawy. Udokumentuj zmianę, której nie można cofnąć, powiadom właściciela i użyj niezależnej ścieżki zarządzania lub uzgodnionego odtwarzania.