Microsoft utilisera les racks Helios optimisés pour l'IA d'AMD dans Azure

Microsoft Corp. utilisera la prochaine conception de rack Helios d'Advanced Micro Devices Inc. pour alimenter certains services Azure.

Le géant du cloud et des systèmes d’exploitation a annoncé aujourd’hui le partenariat avec trois nouvelles familles d’instances.

Helios est une conception de référence, un modèle que les partenaires fabricants d'AMD peuvent utiliser pour fabriquer des racks de centres de données. Chaque système contient 72 des prochaines unités de traitement graphique Instinct MI455 du fabricant de puces. AMD n'a pour l'instant partagé que quelques détails sur le GPU. Il comportera 432 Go de mémoire HBM4, 19,6 térabits par seconde de bande passante et une nouvelle architecture de base appelée CDNA 5.

Les GPU Helios sont pris en charge par les unités de traitement de données Pensando et les unités centrales de traitement Epyc.

Les puces Pensando sont optimisées pour les tâches de gestion de l'infrastructure telles que la coordination des équipements de stockage et le cryptage du trafic réseau. Selon AMD, ils peuvent exécuter de telles charges de travail plus efficacement que les processeurs. Cela réduit les coûts tout en rendant plus de capacité CPU disponible pour les applications client.

Les processeurs d'Helios appartiennent à la prochaine série de processeurs pour centres de données Venice d'AMD. En mai, la société a commencé à accélérer la production de puces en utilisant le procédé à deux nanomètres de Taiwan Semiconductor Manufacturing Co. La série Venice utilise également une deuxième technologie TSMC appelée SoIC qui permet d'empiler des chipsets les uns sur les autres.

Helios organise ses CPU, GPU et DPU en modules appelés plateaux. Les plateaux sont plus larges qu'un serveur rack standard pour accueillir plus de matériel. Ils utilisent le refroidissement liquide pour dissiper la chaleur de leurs puces et échanger des données à l'aide d'un protocole réseau open source appelé UALoE.

« AMD et Microsoft ont passé des années à construire ensemble une infrastructure haute performance, et aujourd'hui nous étendons ce partenariat à l'ensemble des solutions AMD AI sur Azure », a déclaré Lisa Su, PDG d'AMD.

AMD commencera à expédier des racks Helios à Microsoft et à d'autres clients plus tard cette année. Le géant de la technologie utilisera les systèmes pour alimenter une nouvelle famille d’instances Azure appelée série ND MI455X v7. Selon Microsoft, les machines virtuelles sont optimisées pour les charges de travail d'inférence telles que les agents d'intelligence artificielle et les outils de recherche.

La société a lancé la série ND MI455X v7 aux côtés de deux autres familles d'instances qui fonctionneront également sur du silicium AMD.

La série HDv2 est optimisée pour les tâches que les applications d'IA effectuent à l'aide de processeurs plutôt que de processeurs. Cela inclut le processus de préparation des ensembles de données pour analyse par les agents d’IA. Chaque instance comprend jusqu'à 500 cœurs Epyc Vulcan, quatre téraoctets de mémoire et 32 ​​téraoctets de stockage flash.

Le troisième ajout au portefeuille de machines virtuelles d'Azure est une série d'instances appelée HXv2. Il s'agit d'une version améliorée d'une série d'instances Azure existante optimisée pour les applications EDA, ou automatisation de la conception électronique. Ce sont des programmes que les ingénieurs utilisent pour concevoir des puces. Microsoft affirme que HXv2 prend en charge un plus large éventail de charges de travail, notamment les simulations scientifiques.

Chaque machine virtuelle HXv2 comporte 176 cœurs Epyc Vulcan avec une vitesse d'horloge supérieure à 5 GHz. Selon Microsoft, chaque cœur comportera 50 % de cache en plus que le matériel de la génération précédente. Les clients peuvent configurer leurs machines virtuelles avec jusqu'à 4 Go de mémoire.

« L'augmentation significative des performances par VM et par cœur, ainsi que l'inclusion d'InfiniBand de 800 Go, permettent des simulations basées sur MPI à grande échelle et font de HXv2 la solution idéale pour une grande variété de clients HPC », a écrit Scott Guthrie, vice-président exécutif du cloud et de l'IA de Microsoft, dans un article de blog.

La nouvelle collaboration de l'entreprise avec AMD s'étend également à une technologie appelée Azure Boost. Il décharge les calculs impliqués dans l’exécution des logiciels de virtualisation des processeurs vers des puces spécialisées plus efficaces. Microsoft travaillera avec AMD pour optimiser Azure Boost pour les produits de cette dernière société.

Photo: DMLA

Newsletter

Rejoignez notre newsletter pour des astuces chaque semaine