Isilon: Aumento dei valori di timeout di stallo dell'unità in OneFS
Résumé: Molte versioni di OneFS hanno valori di timeout obsoleti configurati per il timer di stallo dell'unità. L'aumento di questi valori può contribuire a evitare inutili eventi di stallo delle unità. ...
Cet article concerne
Cet article ne concerne pas
Cet article n’est associé à aucun produit spécifique.
Toutes les versions du produit ne sont pas identifiées dans cet article.
Symptômes
In OneFS, un'unità viene considerata bloccata se viene rilevata una delle seguenti condizioni:
Quando si verifica lo stallo di un'unità, il sistema tenta di impedire che le operazioni vengano inviate all'unità, preferendo altre unità nel sistema. Ciò tenta di migliorare le prestazioni evitando operazioni su unità già sovraccariche, ma può avere un effetto negativo se l'unità è stata contrassegnata come bloccata inutilmente. I flussi di lavoro sensibili alla latenza possono essere influenzati dai stalli delle unità. In genere, gli stalli dell'unità causano anche modifiche di gruppo, che a loro volta possono portare a un restriping dei job avviato inutilmente.
- Il completamento di una transazione di unità specifica richiede più tempo di un determinato periodo di tempo.
- Il completamento di 50 delle ultime 1.300 operazioni di input/output (I/O) ha richiesto più tempo di un determinato periodo di tempo.
Quando si verifica lo stallo di un'unità, il sistema tenta di impedire che le operazioni vengano inviate all'unità, preferendo altre unità nel sistema. Ciò tenta di migliorare le prestazioni evitando operazioni su unità già sovraccariche, ma può avere un effetto negativo se l'unità è stata contrassegnata come bloccata inutilmente. I flussi di lavoro sensibili alla latenza possono essere influenzati dai stalli delle unità. In genere, gli stalli dell'unità causano anche modifiche di gruppo, che a loro volta possono portare a un restriping dei job avviato inutilmente.
Cause
I limiti precedentemente impostati erano appropriati per le generazioni precedenti di hardware Isilon con caratteristiche di prestazioni e throughput diverse rispetto all'hardware moderno. Poiché la tecnologia dei nodi e del disco rigido è cambiata nel corso del tempo, questi valori sono stati determinati per essere severi sui tipi di nodi più recenti, causando l'attivazione inutilmente di eventi di stallo.
Résolution
NOTA: OneFS 8.0 dispone già dei valori corretti configurati per impostazione predefinita, quindi questa procedura non è necessaria nelle versioni OneFS 8.0.0.0 e successive.
Dovrebbero essere visualizzati output simili ai seguenti:
clustername-1: hw.disk_event.thresh.slowacc_usec: 3500000
clustername-2: hw.disk_event.thresh.slowacc_usec: 3500000
clustername-3: hw.disk_event.thresh.slowacc_usec: 3500000
- Accedere all'interfaccia della riga di comando del nodo utilizzando un client SSH o stabilire una connessione seriale al nodo.
- Eseguire il comando seguente per eseguire il backup del file /etc/mcp/override/sysctl.conf:
# touch /etc/mcp/override/sysctl.conf & cp /etc/mcp/override/sysctl.conf /etc/mcp/override/sysctl.conf.bku1
- Eseguire il comando seguente per modificare il valore del timeout di stallo dell'unità:
# isi_sysctl_cluster hw.disk_event.thresh.slowacc_usec=3500000
- Eseguire il comando seguente per verificare che il valore sia ora impostato correttamente:
# isi_for_array -s sysctl hw.disk_event.thresh.slowacc_usec
Dovrebbero essere visualizzati output simili ai seguenti:
clustername-1: hw.disk_event.thresh.slowacc_usec: 3500000
clustername-2: hw.disk_event.thresh.slowacc_usec: 3500000
clustername-3: hw.disk_event.thresh.slowacc_usec: 3500000
Produits concernés
Isilon, PowerScale OneFSPropriétés de l’article
Numéro d’article: 000052229
Type d’article: Solution
Dernière modification: 11 May 2026
Version: 9
Trouvez des réponses à vos questions auprès d’autres utilisateurs Dell
Services de support
Vérifiez si votre appareil est couvert par les services de support.