vCenter에 "High pnic rx generic error rate detected" 또는 "High pNic error rate detected" 경고가 표시됨
Summary: vCenter에 "경고: 높은 pnic rx 일반 오류율이 vmnicX에서 감지됨" 및 "높은 pNic 오류율이 감지됨, 자세한 내용은 호스트의 vSAN 성능 보기를 확인하십시오." 경고 메시지가 표시됩니다.
Symptoms
이 메시지에는 다르게 처리해야 하는 두 가지 문제가 있습니다.
문제 1: vCenter 웹 클라이언트에 여러 호스트에 대한 아래 메시지가 표시됩니다. 이 vmnic 경고에는 모든 것이 될 수 있습니다. vmnic 호스트가 네트워크에 연결되어 있는지 확인합니다.
이것은 문제 2 (다음에서 언급 됨)와 다릅니다. 이 vmnic 문제 2의 경보에는 활성 및(또는) 대기만 있습니다 . vmnic vSAN의.
Warning: High pnic rx generic error rate detected on vmnicX.
ESXi 호스트에서 다음 명령을 실행하면 rx (Receive) 길이 오류와 오류는 계속 커집니다. 이렇게 하면 경고가 트리거됩니다.
교체 'X' 적절한으로 vmnic 수.
esxcli network nic stats get -n vmnicX vmnic0 Packets received: 2611289 Receive length errors: 279662 Multicast packets received: 529478 Broadcast packets received: 512315 vmnic1 packets received: 5812398 Receive length errors: 279518 Multicast packets received: 538956 Broadcast packets received: 427913
All vmnics 호스트에서 거의 동일합니다. Receive length error 개수를 가집니다. 즉, Multicast packets received 또는 Broadcast packets received 경우가 다음의 원인이 됩니다. Receive length errors.
멀티캐스트 패킷은 일반적으로 브로드캐스트 패킷과 마찬가지로 동일한 VLAN에서 플러딩됩니다.
수신 길이 오류와 브로드캐스트 패킷의 비율 또는 수신 길이 오류와 멀티캐스트 패킷의 비율을 계산한 다음 다른 노드와 비교할 수 있습니다.
다른 노드에서도 멀티캐스트 또는 브로드캐스트로 인한 수신 길이 오류의 비율은 거의 동일합니다.
문제 1을 해결하려면 vmnic파일로 교체합니다.
- SSH를 통해 노드에 연결합니다.
- 다음 명령을 실행합니다. (
vmnicX로 바꿉니다.vmnic길이 오류를 수신한 경우)pktcap-uw --uplink vmnicX --dir 2 -o /tmp/lengtherror.pcap
- 오류 업링크 패킷을 캡처하고 ctrl+c로 중지합니다.
- 다운로드
.pcap파일을 로컬 데스크톱에 저장하고 Wireshark로 엽니다. - 브로드캐스트 패킷 필터:
ip.addr == 255.255.255.255 - 다중 캐스트 패킷 필터:
eth.dst == ff:ff:ff:ff:ff:ff - 를 찾아보십시오.
Malformed Packet필터 결과에서. - 때때로 이 필터가 작동합니다.(Wireshark 4.0.12에서만)
((eth.len != frame.len - 14) || eth.len != frame.len - 18)

문제 2:
알람 이름이 지정됩니다.
High pNic error rate detected Check the host's vSAN performance view for details.
사용자가 호스트의 vSAN 성능 보기를 확인하면 vmnic 알람에 언급된 것은 항상 활성 또는(및) 대기입니다. vmnic vSAN 트래픽의 수
대부분의 경우 vmnic 는 vSAN의 대기 상태입니다.
이 경보는 vSphere 7.0U2부터 발생합니다.
참조: https://knowledge.broadcom.com/external/article/312096/alarm-about-high-pnic-error-rate-being-d.html
다음 표에는 모니터링되는 vSAN에 사용되는 pNIC의 메트릭과 해당 경보 임계값이 나와 있습니다.

이러한 유형의 오류는 vSAN 성능에 영향을 줄 수 있습니다.
Cause
문제 1:
이 경우 패킷 캡처는 CAPWAP-Control 패킷을 전송하는 Cisco AP(Access Point) 컨트롤러를 표시합니다.
Wireshark에서는 이 패킷을 잘못된 것으로 표시합니다.
ESXi는 일반적으로 이러한 종류의 패키지도 처리할 수 없습니다.
Wireshark는 분석 중에 프로토콜의 예상 구조를 준수하지 않는 패킷을 발견하면 패킷을 Malformed로 표시합니다. 이는 일반적으로 패킷이 전송 중에 손상되었거나 프로토콜이 비정상적이거나 올바르지 않게 구현되었음을 나타냅니다.
다음 필터는 다른 유형의 출력을 제공할 수 있으며(프레임 길이가 지원되지 않기 때문에) received length error.
그러나 정확하지 않으므로 고객에게 보고서를 제출하기 전에 이 필터의 출력에 대해 더 많은 분석을 수행해야 합니다.
((eth.len != frame.len - 14) || eth.len != frame.len - 18)
문제 2:
VMware는 vSAN 성능에 영향을 줄 수 있는 오류를 모니터링하기 위해 이 경보를 도입했습니다.
오류 비율이 특수값에 도달하면 vSAN 성능을 해결해야 한다는 사실을 사용자에게 알리기 위해 알람이 트리거됩니다.
그러나 알람 트리거를 위한 알고리즘에는 문제가 있을 수 있는 것으로 관찰되었습니다. 오류 패킷 비율을 계산할 때 단기의 데이터 패킷 수와 총 오류 패킷 양이 사용됩니다.
따라서 대부분의 경우 오류는 vmnic 항상 대기 상태임 vmnic 에 트래픽이 적기 때문에 vSAN의 vmnic.
Resolution
문제 1:
- 소스 IP 주소는 VLAN 1에 연결된 Cisco AP 컨트롤러입니다.
- VxRail Cluster의 VDS 설정을 확인하여 VLAN 1을 사용하는 트래픽이 없는지 확인합니다.
- VxRail 호스트에 연결된 TOR 스위치 포트에서 VLAN 1을 제거합니다.
- VLAN 1에 없는 경우 동일한 단계에 따라 스위치 포트에서 VLAN을 제거합니다.
- VLAN이 클러스터 트래픽을 전달하는 경우 스위치 포트에서 VLAN을 제거할 수 없습니다. 사용자는 VxRail Cluster에서 수신된 길이 오류를 일으킨 트래픽을 분리하기 위해 네트워크 설계를 변경해야 할 수 있습니다.
문제 2:
이러한 유형의 문제를 처리할 수 있는 몇 가지 시나리오가 있습니다.
- 이
vmnic보고 오류는 대기 상태입니다.vmnicvSAN의 오류 패킷 증가가 느립니다.
이는 알고리듬으로 인해 발생하는 거짓 알람이며 vSAN 성능에는 영향을 주지 않습니다. 이 알람은 수시로 다시 나타나지만 고객은 이 알람을 무시하는 것이 좋습니다.
- 이
vmnic보고 오류는 활성 상태입니다.vmnicvSAN 또는 대기vminc하지만 오류 패킷은 계속 증가합니다.
오류의 유형마다 해결 방법이 다르며 CRC 오류, 수신 길이 오류 및 수신 일시 중지 프레임으로 인해 발생하는 알람이 종종 발생합니다.
-
에서 CRC 오류를 수신했습니다.
vmnic.
하드웨어 문제로 인해 일반적으로 CRC 오류가 발생합니다. 이는 대부분 케이블, SFP 및 네트워크 어댑터, 노드 및 스위치 측과 관련이 있습니다. 하드웨어 문제 해결 절차에 따라 문제를 찾습니다. -
에 수신된 길이 오류
vmnic.
근본 원인은 문제 1과 동일합니다. 이러한 상황에서는 문제 1의 문제 해결 과정을 따르면 됩니다. -
에서 수신된 일시 중지 프레임
vmnic.
일시 중지 프레임은 네트워크 흐름 제어에 사용됩니다.
흐름 제어 활성화 네트워크 불안정 또는 정체는 VxRail의 성능 저하의 원인이 되며 vSAN I-O 데이터 저장소 작업에 부정적인 영향을 미칩니다.
흐름 제어는 버퍼 오버런을 방지하기 위해 데이터 전송 속도를 관리하는 데 도움이 되는 스위치 기능입니다.
VxRail은 다음과 같은 방식으로 흐름을 제어할 것을 권장합니다.receive on및transmit off.
https://www.delltechnologies.com/asset/en-us/products/converged-infrastructure/technical-support/h15300-vxrail-network-guide.pdf 88페이지를 참조하십시오.
스위치가 흐름 제어를 활성화하는지 확인하는 방법:
Dell 스위치를 예로 들어 보겠습니다.
Run the command "show interface ethernet 1/1/1," replacing the switch interface number with the interface connecting the node
S5048-01# show interface ethernet 1/1/1 Ethernet 1/1/1 is up, line protocol is down Pluggable media present, SFP28 type is SFP28 25GBASE-SR-NOF Wavelength is 850 Interface index is 15 Internet address is not set Mode of IPv4 Address Assignment: not set Interface IPv6 oper status: Disabled MTU 1532 bytes, IP MTU 1500 bytes LineSpeed 0, Auto-Negotiation off Configured FEC is cl108-rs, Negotiated FEC is cl108-rs Flowcontrol rx on tx on ----- tx on means that the flow control is transmit on
흐름 제어 전송을 비활성화하는 방법:
S5048-01# configure terminal S5048-01(config)# interface e1/1/1 ----replace the switch interface number S5048-01(conf-if-eth1/1/1)# flowcontrol transmit off
vSAN에 연결된 모든 스위치 인터페이스 구성 vmnics 역 transmit off을 클릭합니다.
알람을 녹색으로 재설정하고 알람이 반환되는지 모니터링합니다.