Le calcul AWS EC2 évolue pour répondre à la demande d'IA agentique et d'IA physique

Vingt ans plus tard, le calcul AWS EC2 répond à la demande façonnée par l'IA agentique, l'IA physique et les clients poussant l'infrastructure cloud à usage général vers de nouveaux territoires que ses premiers architectes n'avaient jamais anticipés.

Cette croissance imprègne chaque couche de la plate-forme, selon Art Baudo (photo), principal responsable du marketing produit et responsable du marketing produit EC2 chez Amazon Web Services Inc. Les clients utilisent désormais des instances basées sur AMD pour les charges de travail d'inférence d'IA parallèlement aux tâches traditionnelles de calcul haute performance, et l'ampleur de ce qui se déplace vers le cloud a surpris même les défenseurs de longue date du cloud.

« À mesure que ces performances ont augmenté, les prix que nous avons offerts aux clients ont augmenté également », a déclaré Baudo. « Avec le décollage de l'IA, nous constatons que les gens l'utilisent dans de nombreux espaces différents à travers le secteur et dans tous les types d'instances également. »

Baudo a parlé avec les CUBE Dave Vellante et John Furrier à l'événement AMD Advancing AI, lors d'une diffusion exclusive sur theCUBE, le studio de diffusion en direct de SiliconANGLE Media. Ils ont expliqué comment le partenariat AWS et AMD a mûri depuis le lancement des premières instances EPYC en 2018, et comment le système Nitro soutient la sécurité et les performances dans l'ensemble du portefeuille EC2. Ils ont également expliqué ce que l'accélération des charges de travail de l'IA signifie pour le calcul EC2. (* Divulgation ci-dessous.)

L'expansion du calcul EC2 reflète la profondeur du partenariat AMD et la dynamique de l'IA agentique

AWS a introduit les processeurs AMD EPYC dans EC2 en 2018 et a expédié toutes les générations suivantes, y compris les instances basées à Turin lancées en 2026. Le passage d'instances multithread à des instances monothread entre la sixième et la septième génération a permis des gains de performances substantiels dont les clients des charges de travail d'IA et d'EDA ont pu profiter. Plus récemment, AWS a introduit des instances haute fréquence combinant des vitesses d'horloge de 5 GHz avec des configurations de mémoire étendue pour répondre aux charges de travail nécessitant un calcul de pointe et un accès rapide aux données.

« Nous avons essayé de veiller en permanence à optimiser les performances en matière de prix pour les clients », a déclaré Baudo. « Certaines de nos instances les plus récentes continuent de constater une réduction des prix. C'est une préoccupation constante du côté d'AWS, et ce n'est pas différent pour les instances AMD. »

Le système AWS Nitro réside au-dessous de tout cela en tant que base architecturale qui rend possible l'étendue et la sécurité du calcul EC2. En déchargeant les fonctions de l'hyperviseur sur du matériel et des logiciels dédiés, Nitro permet à AWS de déployer des types d'instances beaucoup plus rapidement et à plus grande échelle tout en n'appliquant aucun accès opérateur. Baudo a déclaré que le système s'étend naturellement aux charges de travail d'IA dans l'ensemble du portefeuille, des instances AMD et Graviton à Trainium et Inferentia, offrant aux clients une base de sécurité cohérente, quel que soit le niveau de calcul qu'ils choisissent.

« Les fondamentaux du cloud, la capacité à assurer la sécurité, la capacité à fournir des performances à la demande, sont encore plus importants aujourd'hui », a déclaré Baudo. « En particulier dans les charges de travail où vous avez une rafale très importante et un besoin de beaucoup de performances CPU, et puis tout d'un coup, vous n'en aurez peut-être plus besoin pendant un certain temps, le cloud est phénoménal pour y parvenir. »

Sur la question du coût, Baudo a déclaré qu'AWS applique aux charges de travail d'IA la même discipline d'optimisation centrée sur le client qu'elle a appliquée à la gestion générale des coûts du cloud en 2022. Le modèle est parallèle à ce qu'AWS a fait historiquement, faisant fonctionner l'économie afin que les clients achètent plus de calcul, pas moins.

« Nous avons également essayé d'aider les clients à obtenir plus d'informations sur les instances Spot afin qu'ils puissent profiter de ces véhicules économiques au sein de leur écosystème », a déclaré Baudo. « Montrez-leur où les instances sont disponibles et donnez-leur ces informations afin qu'ils puissent utiliser encore plus le côté spot. »

Voici l'interview vidéo complète, faisant partie de la couverture par SiliconANGLE et theCUBE de l'événement AMD Advancing AI :

(* Divulgation : TheCUBE est un partenaire média payant pour l'événement AMD Advancing AI. Ni AMD, le sponsor de la couverture de l'événement theCUBE, ni les autres sponsors n'ont de contrôle éditorial sur le contenu de theCUBE ou SiliconANGLE.)

Photo : SiliconANGLE

Newsletter

Rejoignez notre newsletter pour des astuces chaque semaine