Data Domain: Direct Connect Networking zwischen Data-Protection-Systemen
Summary: Direct Connect ist eine Netzwerktopologie, bei der zwei Data Domain-, PowerProtect Data Domain-, IDPA- oder andere Data-Protection-Systeme direkt über dedizierte Schnittstellen ohne einen zwischengeschalteten Switch oder Router verbunden sind. In diesem Artikel werden die Anforderungen an Direct-Connect-Netzwerke, häufige Bereitstellungsszenarien, bekannte Probleme und Troubleshooting-Methoden für Konnektivitäts-, Routing-, Leistungs- und Schnittstellenfehler erläutert. ...
Symptoms
- Direkt verbundene Systeme können sich nicht gegenseitig anpingen.
- Replikationsberichte
"No route to host",connection failedoderdestination unreachableFehler - Der Schnittstellenstatus zeigt
DOWN,DisconnectedoderNot Connected. Interface Connectivity DownWarnmeldungen werden ausgegeben:- Die Verbindungsgeschwindigkeit ist niedriger als erwartet.
- Der Durchsatz ist niedriger als während des Tests erwartet.
- Schnittstellen flattern oder verlieren periodisch die Konnektivität.
- MTree-, Sammelreplikations-, Backup-, Wiederherstellungs-, Migrations- oder Vault-Vorgänge führen ein Failover über das Direct Connect-Netzwerk durch.
- Direkte Verbindungsanschlüsse sind nur in bestimmten Zeitfenstern in Cyber-Recovery-Umgebungen online.
- Neu installierte Direct-Connect-Links bleiben nach der Konfiguration offline.
Cause
- Probleme mit der Netzwerkkonfiguration
- Direkt verbundene Schnittstellen werden in verschiedenen Subnetzen konfiguriert.
- Falsche Subnetzmasken verursachen Routingprobleme.
- Statische Routen fehlen, wenn mehrere Netzwerkpfade vorhanden sind.
- Der Datenverkehr wird über eine andere Schnittstelle statt über den direkten Verbindungspfad geleitet.
- Die Verbindungshost- oder Zielkonfiguration referenziert die falsche IP-Adresse.
- Probleme mit der physischen Konnektivität
- Es sind falsche physische Ports angeschlossen.
- Fehlerhafte Kabel, optische Kabel, DAC-Kabel oder SFP/QSFP-Module.
- Nicht unterstützte oder nicht übereinstimmende Transceiver.
- Fehler bei automatischer Verhandlung der Verbindungsgeschwindigkeit.
- NIC-Firmware- oder Hardwarefehler.
- Probleme mit der Schnittstellenkonfiguration
- Schnittstelle administrativ deaktiviert.
- Die Bonding-Konfiguration stimmt nicht überein.
- MTU-Nichtübereinstimmung zwischen Endpunkten.
- Falsche VETH-Konfiguration.
- Falsche LACP-Einstellungen.
- Verhalten bei Cyber Recovery
- Vault-Schnittstellen können zwischen Synchronisationsfenstern absichtlich deaktiviert werden.
- Replikationskontexte können durch die Cyber-Recovery-Automatisierung deaktiviert werden.
- Interface-Down-Warnmeldungen sind möglicherweise erwartetes Verhalten, wenn der Vault gesperrt ist.
- Plattformspezifische Probleme
- Bestimmte 25-Gbit-NIC- und SFP-Kombinationen haben in Direct-Connect-Bereitstellungen Instabilität oder Schnittstellenflattern gezeigt.
- Bei FC-Direct-Connect-Konfigurationen können Probleme mit der Topologie- oder Initiatorerkennung auftreten.
- Ein falscher Hostname oder eine falsche Replikationskonfiguration kann verhindern, dass mehrere Direct-Connect-Pfade wie vorgesehen verwendet werden.
Resolution
- Layer 1-Validierung
Beginnen Sie das Troubleshooting immer auf der physischen Ebene.
Überprüfen Sie, ob:
-
- Die Verbindungs-LEDs leuchten auf beiden Systemen.
- Die richtigen Schnittstellen sind miteinander verkabelt.
- Das Kabel ist für die ausgehandelte Geschwindigkeit zertifiziert.
- SFP/QSFP-Module stimmen an beiden Enden überein.
- Das Problem tritt nach dem Kabel auf oder bleibt während des Tests beim Anschluss.
- Physische Portzuordnung validieren
In Bereitstellungen mit direkter Verbindung ist es nicht immer offensichtlich, welcher physische NIC-Port auf der Rückseite der Appliance der in DDOS konfigurierten Schnittstelle entspricht. Dies tritt insbesondere bei Systemen mit mehreren NICs, Erweiterungskarten, verstärkten Schnittstellen oder nach Hardwareupgrades auf.
Ein häufiges Problem tritt auf, wenn der Administrator der Meinung ist, dass das Kabel an eine Schnittstelle angeschlossen ist, obwohl es tatsächlich an einen anderen physischen Port angeschlossen ist.
Schritte zum Troubleshooting:
-
- Konfigurieren Sie temporäre (Dummy-)IP-Adressen auf mehreren Kandidatenschnittstellen auf beiden Systemen.
- Aktivieren Sie die Schnittstellen administrativ.
- Beobachten Sie, welche Schnittstellen den Träger herstellen und in einen UP-Zustand übergehen.
- Überprüfen Sie die physischen Verbindungs-LEDs auf beiden Appliances.
- Verwenden Sie Schnittstellen- und Hardwarestatusbefehle, um die richtige Portzuordnung zu identifizieren.
- Sobald die richtigen Anschlüsse identifiziert wurden, entfernen Sie die temporäre Konfiguration und wenden Sie die vorgesehenen Produktionseinstellungen an.
Dieser Ansatz kann Unsicherheiten bei der Auswahl physischer Ports schnell beseitigen und unnötige Untersuchungen zu Routing-, Replikations-, Performance- oder softwarebezogenen Problemen verhindern, wenn das eigentliche Problem einfach eine falsche Kabel-zu-Schnittstelle-Zuordnung ist.
Warum das hilft
Viele Probleme mit der direkten Verbindung lassen sich schließlich auf Folgendes zurückführen:
-
- Kabel mit falscher NIC verbunden.
- Falsche Annahmen zur Zuordnung von Schnittstellen zu Ports.
- Mehrere NIC-Karten mit ähnlicher Portkennzeichnung.
- Die in DDOS konfigurierte Schnittstelle stimmt nicht mit dem vom Installationsprogramm verwendeten Port überein.
- Gebundene Mitglieder haben eine andere Verbindung hergestellt als erwartet.
Wenn Sie die Zuordnung physischer Ports bestätigen, bevor Sie mit dem Troubleshooting auf höherer Ebene fortfahren, kann der Zeitaufwand für die Untersuchung von Routing-, Subnetz-, Replikations- oder Cyber-Recovery-Verhalten erheblich reduziert werden, wenn diese nicht die eigentliche Ursache sind.
- Überprüfen der Netzwerkkonfiguration
Das häufigste Problem bei der direkten Verbindung ist ein falsches Subnetz.
Für die direkte Verbindungskommunikation:
-
- Beide Schnittstellen müssen sich im selben Subnetz befinden.
- Dedizierte Schnittstellen für direkte Verbindungen sollten ein von allen anderen Schnittstellen getrenntes Subnetz verwenden.
- Ein /30-Netzwerk (
255.255.255.252) wird empfohlen, da nur die zwei erforderlichen Hostadressen bereitgestellt werden und das Routing vereinfacht wird.
Beispiel:
System A: 192.168.100.1/30
System B: 192.168.100.2/30
Vorteile einer /30:
-
-
- Vereinfachtes Troubleshooting
- Minimaler ARP-Datenverkehr
- Keine Standardgateway-Anforderung.
- Übersichtliches Punkt-zu-Punkt-Routing
-
Wenn kein dediziertes Subnetz verwendet werden kann:
-
-
- Konfiguriert eine statische Route.
- Überprüfen Sie, ob der Datenverkehr die vorgesehene direkte Verbindungsschnittstelle verwendet.
-
- Schnittstellenstatus validieren
Überprüfen Sie, ob folgende Schnittstellen erfüllt sind:
-
- Auf beiden Systemen aktiviert.
- Use the correct IP address.
- Betrieb mit der erwarteten Geschwindigkeit.
- Konfiguriert mit übereinstimmenden MTU-Werten.
Eine direkte Verbindungsschnittstelle kann nicht kommunizieren, wenn:
-
- Die Remoteschnittstelle ist deaktiviert.
- Der Link hat keinen Träger hergestellt.
- Ein Endpunkt ist falsch konfiguriert.
- Überprüfen der Bonding-Konfiguration
Wenn mehrere Direktverbindungskabel verwendet werden:
-
- Stellen Sie sicher, dass die Bonding-Einstellungen auf beiden Systemen übereinstimmen.
- Überprüfen Sie, ob die Mitgliedsschnittstellen zur richtigen Bündelung gehören.
- Validieren Sie die Lastenausgleichs- und Aggregationskonfiguration.
Die praktische Erfahrung hat gezeigt, dass einige Umgebungen, in denen Verbindungsgeschwindigkeiten bei Verwendung von Round-Robin-Bonding niedriger als erwartet waren, nach der Migration zu LACP behoben wurden.
LACP ist in der Regel die bevorzugte Bündelungsmethode, wenn sie auf beiden Endpunkten unterstützt wird.
- Verstehen des Verhaltens bei Cyber Recovery
Cyber-Recovery-Bereitstellungen führen häufig zu scheinbar Netzwerkproblemen, die aber tatsächlich erwartetes Verhalten darstellen.
Die Cyber Recovery-Anwendung kann:
-
- Deaktivieren Sie die Vault-Schnittstelle.
- Aktivieren Sie die Schnittstelle nur während der Synchronisationsfenster.
- Deaktivieren Sie Replikationskontexte nach Abschluss der Synchronisierung.
Daraus folgt:
-
- Produktionssysteme melden möglicherweise
InterfaceConnectivityDownalerts - Ping-Fehler können außerhalb der Synchronisationsfenster auftreten.
- Die Replikation kann Folgendes melden:
"No route to host."
- Produktionssysteme melden möglicherweise
Vor der Eskalation:
-
- Überprüfen Sie, ob der Vault entsperrt ist.
- Überprüfen Sie, ob das Synchronisationsfenster aktiv ist.
- Vergewissern Sie sich, dass die Schnittstelle nicht absichtlich von der Cyber-Recovery-Automatisierung deaktiviert wurde.
- Fehlerbehebung bei niedrigeren Verbindungsgeschwindigkeiten als erwartet
Wenn ein 100-Gbit-Link mit 25 Gbit oder einer anderen reduzierten Geschwindigkeit verhandelt:
Überprüfen Sie, ob:
-
- Passende optische Typen.
- Unterstützte Kabellängen.
- Kompatible Transceiver.
- Bonding-Konfiguration.
- NIC-Firmware-Level.
Eine Bündelungs- oder Verhandlungsabweichung kann verhindern, dass Schnittstellen mit der beabsichtigten Geschwindigkeit arbeiten.
- Fehlerbehebung bei niedrigem Durchsatz
Ein niedrigerer Durchsatz weist nicht immer auf ein Netzwerkproblem hin.
Beachten Sie:
-
- CPU-Einschränkungen für Testtools wie iPerf.
- Single-Core-Engpässe.
- Sitzungsverteilung über Prozessorkerne hinweg.
- Auslastung des Quell- und Zielsystems.
Bei der Bewertung der Performance:
-
- Überprüfen von Anwendungs- oder Replikationsstatistiken
- Überprüfen Sie, ob tatsächlicher Rückstand oder Verzögerung vorliegt.
- Vergleichen Sie die Workload-Performance mit synthetischen Testergebnissen.
Verlassen Sie sich bei der Ermittlung der Gesamtdatenübertragungsperformance nicht ausschließlich auf die iPerf-Ergebnisse.
- Hardwarespezifische Probleme
In der Praxis wurden folgende Probleme identifiziert:
-
- Instabilität der 25-Gbit-NIC
- SFP-Kompatibilitätsprobleme.
- Schnittstellen-Flapping erfordert das Zurücksetzen von Ports.
- Direkte Verbindungsverbindungen, die vor der Recovery Schnittstellen-Bounce-Vorgänge erfordern.
Wenn die Softwarekonfiguration korrekt erscheint:
-
- Überprüfen Sie die Hardwarekompatibilität.
- Überprüfen Sie bekannte Fehler und Versionshinweise.
- Ersetzen Sie verdächtige optische Komponenten oder Kabel.
- Firmware- und DDOS-Versionen validieren.
Zusätzliche Informationen
Direct-Connect-Netzwerke können für Folgendes verwendet werden:
- MTree-Replikation
- Sammelreplikation
- Cyber Recovery-Vault-Umgebung, Cyber Recovery vault environment
- IDPA-zu-IDPA-Kommunikation
- IDPA-zu-Data-Domain-Kommunikation
- Datenmigration
- Backup- und Wiederherstellungsvorgänge
- Leistungstests
- Netzwerk-Troubleshooting
- Temporäre Bereitstellungskonnektivität
MRepl und CRepl Kann über ein Direct Connect-Netzwerk betrieben werden. Aus Sicht der Data Domain muss das verbundene Gerät kein Switch, Router oder eine andere Netzwerk-Appliance sein. Solange der Carrier eingerichtet ist und die Schnittstellen korrekt konfiguriert sind, kann die Kommunikation direkt zwischen den verbundenen Endpunkten erfolgen.
Für direkt angeschlossene Schnittstellen:
- Beide Endpunkte müssen im selben Subnetz konfiguriert werden, es sei denn, Routing wird absichtlich eingeführt.
- Nach Möglichkeit sollte eine physische Adresse verwendet werden.
- Wenn sich das Direktverbindungsnetzwerk mit anderen Schnittstellen überschneidet, sind möglicherweise statische Routen erforderlich, um sicherzustellen, dass der Datenverkehr den vorgesehenen Pfad verwendet.
- Die direkte Verbindungsfehlerbehebung wird häufig verwendet, um externe Netzwerkgeräte als potenzielle Quelle für Verbindungs- oder Leistungsprobleme zu isolieren.
Additional Information
Zugehörige Artikel:
- Troubleshooting von ausgefallenen oder zeitweilig nicht funktionierenden Schnittstellen für NutzerInnen
- Data Domain – Konfigurieren physischer Schnittstellen mit grafischer Benutzeroberfläche (GUI)
- Data Domain – Konfigurieren physischer Schnittstellen über die Befehlszeilenschnittstelle)
- Data Domain: Die Intel X710 NIC kennzeichnet VLAN möglicherweise nicht ordnungsgemäß, wenn sie in den Wiederherstellungsmodus wechselt.
Lesen Sie diesen Artikel, wenn VLAN-Datenverkehr nicht korrekt über eine Intel X710 Schnittstelle weitergeleitet wird. In diesem Artikel wird erläutert, wie sich der NIC-Recovery-Modus auf das VLAN-Tagging auswirken kann, und es werden Schritte zur Identifizierung und Behebung des Problems aufgeführt.
Verwenden Sie diesen Artikel, wenn die DD-CLI oder -Benutzeroberfläche meldet, dass keine Schnittstellen gefunden wurden. Es hilft bei der Identifizierung von Problemen bei der Schnittstellenerkennung und beschreibt Schritte zum Troubleshooting, um die normale Sichtbarkeit der Netzwerkschnittstelle wiederherzustellen.
Lesen Sie diesen Artikel, wenn Änderungen an der Netzwerkkonfiguration mit der Meldung "Net Setup Up Flag Failure" fehlschlagen. Es bietet Anleitungen zur Diagnose von Konfigurationsinkonsistenzen und zur Wiederherstellung der Schnittstellenfunktionalität.
Verwenden Sie diesen Artikel, wenn ethVX-Schnittstellen nach einem Softwareupgrade nicht mehr kommunizieren. Es beschreibt häufige Ursachen, Validierungsschritte und Korrekturmaßnahmen zur Wiederherstellung der Konnektivität.
Lesen Sie diesen Artikel, wenn Intel-basierte Netzwerkschnittstellen unerwartet ausfallen und tx_timeout Es werden Fehler beobachtet. Der Artikel hilft festzustellen, ob das Problem mit dem Treiber, der Firmware oder der Hardware zusammenhängt, und stellt Wiederherstellungsverfahren bereit.
Dieser Artikel gilt, wenn Cyber-Recovery-Netzwerkkonfigurationen fehlschlagen, weil die Fehlerkorrektur bei Weiterleitung (FEC) deaktiviert ist. Es werden die FEC-Anforderungen und die Konfiguration unterstützter Einstellungen erläutert.
Verwenden Sie diesen Artikel, wenn ein Intel X710-Adapter beim Systemstart fehlt oder nicht erkannt wird, wenn Netzwerkkabel angeschlossen sind. In diesem Artikel werden die Bedingungen beschrieben, die das Problem auslösen, sowie die empfohlene Lösung.
Lesen Sie diesen Artikel, wenn Sie die Bündelungsmodi auf Schnittstellen ändern, die mit LACP-konfigurierten Switches verbunden sind. Es wird beschrieben, wie Änderungen des Bündelungstyps dazu führen können, dass Schnittstellen nicht mehr verfügbar sind, und wie der Übergang sicher durchgeführt wird.
Dieser Artikel ist nützlich, wenn Änderungen an der Netzwerkkonfiguration aufgrund ungültiger Einstellungen im Zusammenhang mit QLogic-Adaptern fehlschlagen. Es enthält Schritte zur Fehlerbehebung und Anleitungen zur Korrektur der Konfiguration.
Lesen Sie diesen Artikel, wenn VLAN-Schnittstellen nach einem Neustart aufgrund von MTU-bezogenen Konfigurationsproblemen nicht online geschaltet werden können. In diesem Artikel werden das Symptom, die Ursache und die ordnungsgemäßen MTU-Validierungsanforderungen erläutert.
Verwenden Sie diesen Artikel, wenn gebundene Schnittstellen Warnmeldungen erzeugen, weil die Mitgliedsports mit unterschiedlichen Geschwindigkeiten arbeiten. Es wird erläutert, wie sich Geschwindigkeitskonflikte auf die Bonding-Integrität auswirken und welche Schritte zur Behebung des Problems erforderlich sind.
Lesen Sie diesen Artikel, wenn Netzwerkschnittstellen nach der Anwendung von Intel-bezogenen Workaround-Einstellungen unerwartet nicht mehr verfügbar sind. Es erläutert das Verhalten, betroffene Konfigurationen und Empfehlungen zur Aufrechterhaltung einer stabilen Netzwerkverbindung.