PowerEdge: rendimiento de NAMD en R740 con GPU Volta

概要: PowerEdge R740, NAMD, GPU NVIDIA V100-PCIe, HPC, computación de alto rendimiento, HPC y laboratorio de innovación en IA, rendimiento

この記事は次に適用されます: この記事は次には適用されません: この記事は、特定の製品に関連付けられていません。 すべての製品パージョンがこの記事に記載されているわけではありません。

手順

Hay varias aplicacionesEste hipervínculo lo redirige a un sitio web fuera de Dell Technologies. de HPC que pueden beneficiarse del uso de GPU NVIDIA y NAMD es una de ellas. Nanoscale Molecular Dynamics (NAMD) es un software de código abierto para la simulación de dinámica molecular, utilizando el modelo de programación paralela CHARMM, diseñado para la simulación de alto rendimiento de grandes sistemas biomoleculares. 
Para beneficiarse de la aceleración de GPU, se necesita una compilación CUDA para NAMD. Las instrucciones para compilar NAMD con soporte CUDA se pueden encontrar aquíEste hipervínculo lo redirige a un sitio web fuera de Dell Technologies. .

En este artículo, analizaremos el rendimiento de NAMD con la GPU Volta V100-32GB más reciente de NVIDIA en un solo servidor Dell EMC PowerEdge R740.

PowerEdge R740 es un servidor de dos conectores de 2U con procesadores Intel Skylake. Se puede configurar para admitir hasta 3 GPU de doble ancho y un adaptador de red de alta velocidad.

En la tabla 1, se muestra información sobre la configuración de hardware y los detalles de las aplicaciones utilizados para las pruebas. Para esta prueba, se compiló una versión de compilación nocturna de NAMD con fecha 2018-08-17.

       

Tabla 1 Detalles de configuración de hardware y software

Servidor PowerEdge R740
Procesador 2 * Intel Xeon 6148 - procesador de 20 núcleos @ 2.4 GHz
Memoria    192 GB de 2666 MT/s
GPU   3 * NVIDIA Volta V100-PCIe (32 GB)
Fuente de alimentación  2*1600 W
Sistema operativo Kernel de RHEL 7.4
: 3.10.0-693.el7.x86_64
Opciones de BIOS Perfil del sistema - Rendimiento
Procesador lógico - Desactivado
Modo turbo - Activado
Versión y controlador de CUDA CUDA 9.2 (396.26)
NAMD Git-2018-08-17_Source (versión de compilación nocturna), compilación multinúcleo
Compilador Intel 2018 u3

 

 


Resultados de rendimiento

NAMD se probó con tres conjuntos de datos diferentes: ApoA1, F1ATPasa y STMV, que constan de 92 K, 327 K y 1066k átomos respectivamente. Apoa1 es un conjunto de datos más pequeño en comparación con F1ATPase y STMV. La métrica de rendimiento aquí es "ns/días". Los datos que se muestran en esta sección se basan en el promedio de 10 pruebas.
En la figura 1, se muestra el rendimiento de NAMD con CPU y varias GPU en tres conjuntos de datos. Se siguieron las instrucciones del sitio webEste hipervínculo lo redirige a un sitio web fuera de Dell Technologies. de Intel para compilar NAMD para los procesadores Intel Xeon. La mejora del rendimiento de CPU a GPU se observa en el siguiente gráfico.

Gráfico de barras NAMD  
                                                                         Figura 1 Rendimiento de NAMD en CPU y GPU

  •     El rendimiento es relativo a los resultados de CPU doble en los diferentes conjuntos de datos.
  •     Las versiones de GPU de NAMD proporcionan hasta 11,2 veces más velocidad en comparación con la versión de CPU para los tres conjuntos de datos.
  •     Se midió un aumento de rendimiento adicional del 23 % al 33 % cuando se agregó la segunda tarjeta GPU. Se observó un 6-9% más modesto de dos GPU a tres pruebas de GPU.
     

    NAMD también se probó con diferentes números de núcleos de CPU en 1, 2 y 3 GPU para identificar el número mínimo de núcleos de CPU necesarios para obtener el mejor rendimiento.

    Gráfico de líneas del STMV 

                                                          Figura 2 Rendimiento de STMV con diferentes conteos de núcleos de CPU y GPU

  •     Como se muestra en la Figura 2, el uso de muy pocos núcleos de CPU tiene un impacto negativo en el rendimiento, y el rendimiento mejora a medida que aumentamos la cantidad de núcleos
  •     La prueba de un V100 con 20+ núcleos de CPU logró un buen rendimiento. Hay una ventaja de rendimiento adicional del 2 % al 3 % cuando usamos más de 20 núcleos.
  •     Esta prueba también se realizó en los otros dos conjuntos de datos ApoA1 y F1ATPase. Se observó un comportamiento de rendimiento similar con ellos.
     


     


    Resumen

    Aquí se presentan los resultados de rendimiento de NAMD en el servidor Dell EMC PowerEdge R740 y las GPU NVIDIA Volta V100-32 GB. Hay una aceleración de ~6,6x-11,2x en las pruebas de solo CPU cuando se utilizan GPU. Un servidor R740 con 3 tarjetas V100 proporciona el mejor rendimiento, mientras que un servidor R740 con 2 tarjetas V100 se encuentra dentro del 91 % de la configuración de tres GPU. Si hay limitaciones presupuestarias, una GPU por R740 sería una buena opción, ya que ofrece hasta 8 veces más velocidad en comparación con la CPU. También se realizaron pruebas con diversos núcleos de CPU y GPU, y notamos que el uso de muy pocos núcleos de CPU (menos de 20 núcleos en nuestras pruebas) reduce el rendimiento de NAMD en las pruebas de GPU.



     



     

     

対象製品

High Performance Computing Solution Resources, PowerEdge R740

製品

OEMR R740
文書のプロパティ
文書番号: 000135113
文書の種類: How To
最終更新: 02 7月 2026
バージョン:  7
質問に対する他のDellユーザーからの回答を見つける
サポート サービス
お使いのデバイスがサポート サービスの対象かどうかを確認してください。