Data Domain: Cloudprofiel blijft niet verbonden na het oplossen van capaciteitsproblemen met de cloudprovider
Samenvatting: Op systemen waarop Long-Term Retention/Cloud Tier (LTR/CT) is geconfigureerd, kan het cloudprofiel de status Verbinding verbroken houden, zelfs nadat de capaciteitsproblemen met de cloudprovider zijn opgelost. ...
Symptomen
DDOS markeert een cloudprofiel als niet-beschikbaar of niet-verbonden als het protocol van of naar de geconfigureerde cloudprovider fouten retourneert. In het specifieke geval van capaciteitsproblemen in de cloudprovider of het account worden fouten van het type HTTP 507 geretourneerd.
Voor DDOS-releases vóór 7.7.2 wordt deze foutcode behandeld als elke andere, en het cloudprofiel en de provider zijn mogelijk niet beschikbaar als de fouten zich vaak herhalen.
Omdat HTTP/507 echter een speciale fout is, een fout die de cloudprovider gebruikt om te melden dat de capaciteit is bereikt, behandelt DDOS 7.7.2 en hoger dit op een speciale manier, namelijk door het cloudprofiel in te stellen op de status die hieronder wordt weergegeven:
Name Profile Status Reason --------- ----------------- ------------ ------------------------------------------- cloud_unit cloud_profile Disconnected Insufficient storage at the cloud provider. --------- ----------------- ------------ -------------------------------------------
Om ervoor te zorgen dat de DD-administrator weet waarom de cloudeenheid niet meer werkt, wordt een permanente registersleutel ingesteld, wat aangeeft dat de cloudprovider niet beschikbaar is. Het DD FS-proces maakt geen contact meer met de cloudprovider.
Nadat de capaciteitsproblemen in de cloudprovider zijn opgelost, blijven het cloudprofiel en de eenheid nog steeds hetzelfde. Er is geen indicatie van wolkenactiviteit te zien in de gebruikelijke "ddfs.info" en "csm.log" bestanden. Het opnieuw opstarten van de FS lost het probleem niet op.
Oorzaak
Hoewel dit probleem alleen is waargenomen voor ECS als cloudprovider, is er niets dat verhindert dat het optreedt voor andere cloudproviders, als ze HTTP 507-foutcodes kunnen retourneren naar de DD wanneer er capaciteitsproblemen zijn (dat wil zeggen, wanneer het account dat wordt gebruikt voor opslag een bepaald quotum heeft bereikt).
Oplossing
Er is een nieuwe opdracht in DDOS 7.7.2 en latere releases die moet worden gebruikt om de status van de cloudeenheid te wissen om er weer toegang toe te hebben nadat de verbinding met de cloud is verbroken vanwege capaciteit:
# cloud unit clear-state <unit-name> {nospace}
Clear the registry entry indicating
cloud unit is not available for writing
Voor het bovenstaande voorbeeld moet de onderstaande opdracht worden uitgevoerd na het oplossen van de capaciteitsproblemen van de cloudprovider om de cloudprovider opnieuw te kunnen gebruiken:
# cloud unit clear-state cloud-unit nospace