NetWorker: Konserwacja bazy danych nośników i rozwiązywanie problemów
Summary: W tym artykule opisano metody identyfikacji i rozwiązywania problemów związanych z bazą danych nośników, a także najlepsze praktyki w zakresie konserwacji i ochrony.
Symptoms
- Nie można uruchomić usług.
- Błąd codziennego przepływu pracy tworzenia kopii zapasowej serwera ochrony >serwera.
- Niekompletne lub wprowadzające w błąd informacje dotyczące zestawów zapisów lub klientów zwróconych przez
mminfolub podczas wysyłania zapytań lub przeglądania zbiorów zapisu w administracji konsoli NetWorker Management Console (NMC) lub interfejsu użytkownika NetWorker Web User Interface (NWUI). - Problemy z tworzeniem kopii zapasowych, odzyskiwaniem lub klonowaniem związane z niemożnością zlokalizowania zestawów zapisu, klientów lub woluminów.
- Błędy w dzienniku demona serwera lub konsolach związane z bazą danych nośnika:
nsrmmdbd WiSS code assertion error (st_nextrec: rec loop detected)
nsrmmdbd error, ss_clone_ensure_clone_eligibility: assertion, invalid parameters or code segment
nsrmmdbd XCHK ssid:saveset_short_ssid host:saveset_hostname name:saveset_name has a fragment with an invalid volid:saveset_volid
nsrmmdbd NSR warning WiSS code assertion error (ST_readvdir: directory read failed)
nsrmmdbd NSR critical Unexpected error reading long record directory: an invalid slot number
nsrmmdbd NSR warning partial record error, ssid: saveset_short_ssid saveset_long_ssid flags:0x00010101 size:0 files:0 tm:datetime cloneid
nsrmmdbd NSR notice media db must be scavenged
nsrmmdbd NSR critical media db scavenge failed
nsrmmdbd NSR warning Cannot scavenge path_to_mmvolume6 (Permission denied) - recover from backup media
nsrmmdbd NSR warning Cannot scavenge path_to_mmvolume6 (unknown error code) - recover from backup media
nsrmmdbd MDB warning can't fetch save set <saveset ID>
nsrmmdbd MDB warning Unable to fetch child save set <saveset ID> for cover set <saveset ID>
- Nagła utrata wielu zestawów zapisu z bazy danych nośnika lub nagły skok ilości wolnego miejsca w pamięci dyskowej.
- Oprogramowanie nie wygasa lub nie usuwa zestawów zapisu, co prowadzi do szybkiego zużycia pamięci masowej.
Cause
Jak każda baza danych, baza danych multimediów może zostać uszkodzona w różnym stopniu, jeśli istnieje jakiekolwiek wnioskowanie z jej normalnych operacji, takich jak.
- Nieoczekiwane zamknięcie
nsrmmdbd(zrzut rdzenia, awaria systemu, ponowne uruchomienie lub utrata zasilania). - Przerwana transakcja (ingerencja zewnętrznego oprogramowania zabezpieczającego lub wyczerpanie miejsca na dysku).
- Wewnętrzny problem logiczny (wada kodu lub nieobsługiwane warunki).
- Bezpośrednia ingerencja w pliki multimedialnej bazy danych lub pliki zestawu zapisu w pamięci masowej zarządzanej przez NetWorker.
Baza danych multimediów jest najlepiej chroniona przed uszkodzeniem za pomocą następujących ogólnych praktyk:
- Jeśli to możliwe, użyj oddzielnej partycji dysku lokalnego dla
/nsr/mm, który pomaga chronić przed warunkami, takimi jak wyczerpanie miejsca na dysku przez inne procesy. Partycja ta powinna być co najmniej 3 razy większa od wielkości bazy danych multimediów; duża baza danych multimediów miałaby 10 GB; 100 GB powinno wystarczyć dla każdej instalacji. - Codziennie wykonywany jest przepływ pracy tworzenia kopii zapasowej serwera, tak aby kopie zapasowe bazy danych nośników i krytycznych zasobów odzyskiwania po awarii ( Bootstrap) były dostępne w przypadku awarii.
- Sprawdź lokalizację Bootstrapów za pomocą polecenia
mminfo -Bpolecenia okresowo. - Nigdy nie zezwalaj na jednoczesny dostęp do woluminów pamięci masowej serwera NetWorker przez inny serwer NetWorker, ponieważ może to prowadzić do utraty danych.
- Jeśli na serwerze NetWorker zainstalowano oprogramowanie antywirusowe, utwórz wykluczenia dla
/nsr, aby zapobiec skanowaniu, modyfikowaniu lub usuwaniu plików NetWorker przez oprogramowanie antywirusowe. - Nie usuwaj ręcznie plików z pamięci masowej NetWorker w celu zwolnienia miejsca. NetWorker ma procedury odzyskiwania miejsca, które działają codziennie. W razie niepowodzenia należy skontaktować się z pomocą techniczną.
- Ogólnie rzecz biorąc, w przypadku planowania stref danych należy przechowywać dane tego samego typu w tych samych pulach, takie jak zestawy zapisu vProxy, zestawy zapisu systemu plików i zestawy zapisu bazy danych Oracle w oddzielnych pulach.
- Nie ignoruj komunikatów związanych z błędami baz danych multimediów — w razie wątpliwości skontaktuj się z pomocą techniczną.
Należy pamiętać o bazie danych multimediów NetWorker i relacji pamięci masowej oraz chronić woluminy za pomocą flagi Potrzebne do skanowania:
- NetWorker codziennie uruchamia proces wygaśnięcia w ramach przepływu pracy tworzenia kopii zapasowej serwera. To zadanie oblicza retencje i zależności oraz wygasa zestawy zapisu, które są po ich przechowywaniu i nie mają niewygasłych elementów zależnych. Po zakończeniu tej czynności NetWorker próbuje usunąć wszystkie wygasłe zestawy zapisu woluminu dysku. Następnie operacja odzyskiwania miejsca zostanie uruchomiona dla każdego woluminu, usuwając pliki zestawu zapisu z nośników, które nie mają odpowiednich wpisów w bazie danych nośników. Oznacza to, że jeśli baza danych multimediów zostanie uszkodzona lub zostanie przywrócona do wcześniejszego punktu w czasie, prawidłowe dane mogą zostać usunięte.
- Jeśli uważasz, że wystąpił problem z jakimikolwiek woluminami dysków, upewnij się, że wolumin jest odmontowany i oznaczony jako Potrzebne skanowanie, aby upewnić się, że prawidłowe dane nie zostały usunięte. Dotyczy to również woluminów po odzyskaniu do poprzedniego punktu w czasie (gdzie na dysku utworzonym po punkcie odzyskiwania mogą istnieć prawidłowe zestawy zapisu i nie mieć wpisów w odzyskanej bazie danych).
- Opcja Wymagane skanowanie umożliwia normalne tworzenie kopii zapasowych, odzyskiwanie lub klonowanie, ale zapobiega normalnemu wygaśnięciu lub usunięciu, dlatego upewnij się, że jest używana tylko do ochrony woluminów postrzeganych jako zagrożone i usuwana po powrocie do normalnego działania. Aby ustawić lub usunąć tę flagę, należy odmontować woluminy. Często zdarza się, że woluminy są oznaczone jako "wymagane skanowanie" po zakończeniu odzyskiwania po awarii serwera NetWorker (
nsrdr), aby zapobiec niepożądanej utracie danych w scenariuszu odzyskiwania po awarii.
Resolution
Istnieje kilka sposobów weryfikacji i rozwiązywania problemów z bazą danych multimediów. Przed przystąpieniem do któregokolwiek z tych działań, aby ocenić wpływ, utwórz raporty przed i po, aby sprawdzić, czy zestawy zapisów, woluminy, klienty lub inne elementy zostały usunięte.
W wierszu polecenia, w katalogu do danych wyjściowych hosta, uruchom następujące polecenia, aby porównać właściwości bazy danych multimediów przed i po procedurze:
mminfo -C mminfo-C_pre.mmimminfo -X mminfo-X_pre.mmimminfo -ar "volid,type,location,pool,volume,state,volflags,written,savesets" -q family=disk -xc, > mminfo-vol_pre.mmi
Po zakończeniu konserwacji uruchom ponownie każdy z nich w osobnym pliku (na przykład *_post.mmi) i porównaj wartości.
nsrim - Codzienna ochrona serwera
Każdego dnia uruchamiany jest przepływ pracy Kopia zapasowa serwera ochrony > serwera, a wraz z nim akcja Wygaśnięcie. Czynność Wygaśnięcie zostanie uruchomiona nsrim, który jest natywnym narzędziem konserwacyjnym NetWorker. Można to również uruchomić bezpośrednio, ale może to potrwać od kilku minut do kilku godzin, w zależności od obciążenia serwera i rozmiaru bazy danych multimediów:
nsrim -X > nsrim.out 2>&1
O ile ten proces nie działa codziennie, nie jest mało prawdopodobne, aby cokolwiek to zmieniło. Sprawdź dziennik demona pod kątem nsrim Codzienne uzupełnianie. Aby uzyskać więcej informacji, patrz: NetWorker: Jak zaplanować operacje konserwacji indeksu plików i multimediów NetWorker Online
Ponowne uruchomienie usługi
Ponowne uruchomienie usług NetWorker wymusza różne kontrole uruchamiania, które mogą ujawnić problemy w komunikatach o błędach dziennika demona i potencjalnie naprawić wszelkie z nich. Jeśli przed wstrzymaniem usług problemy z bazą danych wydają się poważne, upewnij się, że dostępna jest wystarczająca ilość wolnego miejsca, a lokalizacje rozruchu są znane (mminfo -B wyjście). Najlepiej uruchomić nsrmmdbasm -s /nsr/mm/mmvolrel_path > mm.xdr Pierwsza, aby spróbować wyodrębnić bieżącą kopię bazy danych multimediów. Przed ponownym uruchomieniem usług utwórz kopię /nsr/mm/mmvolrel , ponieważ może być później wymagany do celów kryminalistycznych lub odzyskiwania. Aby uzyskać więcej informacji, patrz: Eksportowanie bazy danych nośników NetWorker za pomocą nsrmmdbasm
Eksport i ponowny import bazy danych multimediów.
Ten proces pozwala uniknąć pełnego odtwarzania po awarii, wyodrębniając tylko realne rekordy bazy danych multimediów i importując je ponownie na serwer bez zatrzymywania usług. Jednak — należy to robić tylko wtedy, gdy serwer jest bezczynny i nigdy nie należy podejmować prób z uruchomionymi zadaniami. Użyj pełnej ścieżki zamiast mmvolrel (która może się różnić w zależności od instalacji lub systemu operacyjnego)
- Przed rozpoczęciem oznacz wszystkie woluminy dyskowe jako Potrzebne skanowanie po odmontowaniu. Jeśli dla urządzeń hostujących woluminy dysków ustawiono automatyczne zarządzanie multimediami , należy to wyłączyć w pierwszej kolejności. Woluminy taśm nie wymagają tego kroku.
UWAGA: W poniższym artykule opisano, jak oznaczyć woluminy jako "Skanowanie NIE jest potrzebne"; Można go jednak również użyć do oznaczenia woluminów jako "Wymagane skanowanie". Aby to zrobić, postępuj zgodnie z instrukcjami, ale ustaw "potrzebne skanowanie" zamiast "niepotrzebne". NetWorker: przenoszenie woluminu z „Scan is needed” do „scan is NOT needed”
- Uruchom
mminfopolecenia opisane w preambule do przygotowania wstępnych raportów. - Sprawdź rozmiar bazy danych multimediów
mmvolrelTeczka i rekord - Upewnij się, że żaden z
nsrck,nsrim,nsrmmdbasmprocesy są uruchomione; Jeśli w folderze nadrzędnym MM znajdują się duże, stare lub nie ostatnio modyfikowane pliki, takie jakmm/[alphanumerics], przenieś lub usuń, jeśli nie są zablokowane przez żaden proces. - Wyodrębnij bazę danych multimediów do pliku XDR: Eksportowanie bazy danych nośników NetWorker za pomocą nsrmmdbasm
- Porównaj rozmiar nowego pliku z rozmiarem pliku
mmvolrelfolder — jeśli powinien mieć podobny rozmiar. Jeśli jest mały (4 B lub garść KB), polecenie nie powiodło się. Jeśli jest mniejszy — w ramach procesu mogły zostać usunięte uszkodzone rekordy. - Przygotuj serwer do odzyskania bazy danych multimediów, ustawiając pole stanu serwera na odtwarzanie po awarii w NMC/NWUI lub używając polecenia
nsradmin. - Odzyskaj dane bezpośrednio z pliku wyodrębnienia bazy danych multimediów przy użyciu
nsrmmdbasmPoleć ponownie:nsrmmdbasm -r -2 < mm.xdr - Po zakończeniu uruchom to samo
mminfozgodnie z opisem w preambule i porównać zapisane wartości zestawu i zapisu dla każdego woluminu, upewniając się, że wszystkie woluminy są obecne; Podobniemminfo -CWartości powinny być identyczne. - W przypadku jakichkolwiek rozbieżności należy wziąć pod uwagę i dokładnie rozważyć sposób postępowania, a jeśli nie masz pewności co do wyników, skontaktuj się z pomocą techniczną:
- W przypadku woluminów, które wydają się być sprawne, można usunąć flagę Potrzebne skanowanie i zamontować woluminy, ponieważ nie powinno być niebezpieczeństwa usunięcia zestawu zapisu, jeśli wydaje się, że żadne zestawy zapisu nie zostały usunięte z woluminu, jeśli zestawy zapisu i zapisane wartości są spójne.
- Woluminy, które pokazują mniej zestawów zapisu lub niższą zapisaną sumę, powinny pozostawić flagę Potrzebne do skanowania i uruchomić skaner:
scanner -i devicename, aby ponownie wprowadzić pliki znalezione na woluminie, które nie mają już rekordów. Gdyscannerdla każdego woluminu, ponownie sprawdź liczbę zapisanych zbiorów i usuń flagę Wymagane skanowanie. Patrz: NetWorker: przenoszenie woluminu z „Scan is needed” do „scan is NOT needed” - Zamontuj ponownie wolumin, gdy uzyskasz pewność
scannerzastąpił zestawy zapisów, których może brakować.
Odzyskiwanie po awarii serwera NetWorker (nsrdr)
Pełne odtwarzanie po awarii wykonywane przez nsrdr Odzyskuje nie tylko bazę danych multimediów, ale także inne elementy serwera, takie jak baza danych zasobów i baza danych zadań. Przed podjęciem dalszych działań zapoznaj się z przewodnikiem po najlepszych praktykach dotyczących odtwarzania po awarii i dostępności serwerów dla swojej wersji.
To polecenie oczekuje, że węzły pamięci masowej będą w trybie online i będzie można się z nimi skontaktować w celu ukończenia działania. Zobacz także: NetWorker: odtwarzanie po awarii serwera NetWorker (NSRDR)