Analyse comparative MPI sur la révision de la plate-forme Google Compute

Modèle de blog 7

gce
Il y a trois ans, nous avons visité le service IaaS de Google – Google Compute Engine (GCE) pour ses performances réseau et Ryan a publié les résultats dans son article de blog. À l’époque, la conclusion était que les instances GCE étaient plus adaptées à une charge de travail typique d’hébergement de services Web, mais qu’il restait encore un espace de réglage des performances pour les applications HPC. Récemment, nous avons revisité les instances du GCE avec leur dernière offre.

Outils de référence
Pour rendre les résultats quelque peu comparables aux anciens, nous utilisons toujours le Micro-repères OSU mais avec la dernière Version 5.3.2. Et parmi tous les outils d'analyse comparative proposés, nous en choisissons deux les plus critiques : osu_latency pour le test de latence et osu_bibw pour le test de bande passante bidirectionnelle.

Environnement de test
Système d'exploitation : Debian GNU/Linux 8 (Jessie)
Saveur MPI : MPICH3

Instances de test
Puisque nous testons les performances d'interconnexion entre les instances de VM, nous voulons nous assurer que les instances de VM que nous avons lancées se trouvent réellement sur différents hôtes physiques afin que le trafic passe réellement par le réseau sous-jacent mais pas par la mémoire de la machine hôte.
Nous avons donc choisi la plus grande instance de chaque série :
n1-standard-32, n1-highmem-32 et n-highcpu-32

Résultats de test
Pour la latence (en microsecondes) :

Type d'instanceEssai n°1Essai n°2Essai n°3Normale
n1-standard-3245.6847.0348.4647.06
n1-highmem-3243.1743.0836.8741.04
n1-highcpu-3247.1148.5148.1747.93

(taille : 0 octet)
Pour une bande passante bidirectionnelle : (Mo/s)

Type d'instanceEssai n°1Essai n°2Essai n°3Normale
n1-standard-32808.28864.91872.36848.52
n1-highmem-321096.351077.331055.21076.29
n1-highcpu-32847.68791.16900.32846.39

(Taille: 1,048,576-octets)

Résumé des résultats
Pour la latence du réseau, nous pouvons constater que la moyenne est d'environ 40 à 45 microsecondes, ce qui est 4 fois plus rapide que le résultat précédent – ​​environ 180 microsecondes. Et la nouvelle latence est assez cohérente par rapport aux autres types d’instances plus petites.
Pour la bande passante, nous n'avons pas de résultat précédent auquel comparer, mais parmi tous les types d'instances GCE, nous avons constaté que n1-highmem-32 offre les meilleures performances, pouvant atteindre 1070 XNUMX Mo/s. Ce résultat est conforme au document officiel du GCE https://cloud.google.com/compute/docs/networks-and-firewalls#egress_throughput_caps.