Les systèmes d'infrastructure d'IA redéfinissent la rivalité AMD-Nvidia alors que l'inférence remodèle le marché

La course à la construction de systèmes d'infrastructure d'IA a dépassé les spécifications des puces pour devenir une bataille autour de plates-formes entières à l'échelle d'un rack, alors que les charges de travail d'inférence et d'agent redéfinissent ce qui compte comme un ordinateur.

Ce changement oblige les concurrents, autrefois jugés uniquement sur la base de références GPU, à prouver qu'ils peuvent fournir des systèmes complets et intégrés couvrant le calcul, la mémoire, la mise en réseau et les logiciels. Le sprint de cinq ans d'Advanced Micro Devices Inc. pour compresser ce qui a pris 15 ans à Nvidia Corp. montre à quel point cette transformation est devenue urgente, selon Dave Vellante (photo de droite), co-PDG de SiliconANGLE Media Inc. et co-animateur de theCUBE, le studio de diffusion en direct de SiliconANGLE Media.

« Ils ont dépensé 60 milliards de dollars en fusions et acquisitions, dont 49 milliards de dollars sur Xilinx, et ils ont ensemencé l'écosystème avec des logiciels comme ROCm », a déclaré Vellante. « Maintenant, pour répondre à votre question, ils sont désormais dans le secteur des systèmes. Ils ne sont plus seulement dans le secteur des puces, et c'est une transformation complète et une réinvention. Mon principe est qu'ils n'ont pas besoin de supprimer Nvidia – ils doivent simplement devenir le deuxième acteur essentiel, la deuxième source de cette vague d'IA. « 

Vellante et John Furrier (à gauche), co-fondateur et co-PDG de SiliconANGLE Media Inc. et co-animateur de theCUBE, ont tenu cette conversation lors de la couverture en direct par theCUBE d'AMD Advancing AI 2026, une diffusion exclusive sur theCUBE, le studio de diffusion en direct de SiliconANGLE Media. Ils ont expliqué le passage d'AMD du statut de fabricant de puces à celui de fournisseur de systèmes et comment l'inférence, les charges de travail agents et l'économie d'entreprise réorganisent les priorités de l'infrastructure de l'IA. (* Divulgation ci-dessous.)

Les systèmes d’infrastructure d’IA passent des puces aux plates-formes à l’échelle du rack

Au-delà du matériel, la conversation se concentre de plus en plus sur le routage des charges de travail vers la bonne ressource plutôt que sur le silicium le plus cher disponible. Les entreprises apprennent que toutes les tâches ne nécessitent pas un modèle de pointe ou un GPU de premier plan, a noté Furrier.

« Vous commencez à voir l'intelligence logicielle arriver pour soutenir l'expérience ascendante de l'utilisateur final », a déclaré Furrier. « Ce modèle va à ce processeur. Ce n'est pas si cher, ce n'est pas une priorité élevée, mais nous devons avoir une réponse suffisamment bonne. N'utilisez pas le GPU coûteux pour cela – allez à la bonne ressource d'IA. »

La réponse d'AMD à cette demande a consisté à consolider des acquisitions disparates en un seul système. Xilinx a apporté l'informatique adaptative via des réseaux de portes programmables sur site, ou FPGA, tandis que Pensando a ajouté les DPU et l'expertise en réseau comme élément essentiel du portefeuille. Cette croissance a coïncidé avec une ascension plus large du secteur des centres de données, la montée rapide d'AMD ayant écrit un nouveau chapitre de succès que les entreprises technologiques, avec leur type de longévité, voient rarement.

Vellante a néanmoins averti qu'AMD et Nvidia poursuivent des philosophies différentes, même si les deux se dirigent vers une intégration à l'échelle du rack – l'une favorisant une co-conception étroite et propriétaire et l'autre s'appuyant sur l'ouverture et les chipsets pour convaincre les clients qui se méfient du verrouillage.

« Le gagnant sera celui qui pourra, de la manière la plus rapide possible, repenser l'ensemble de l'expérience informatique en fonction de la façon dont les humains pensent et travaillent réellement », a déclaré Furrier. « Celui qui y arrivera le premier, personne ne se souciera de la façon dont cela se fera. »

Voici l'interview vidéo complète, qui fait partie de la couverture par SiliconANGLE et theCUBE d'AMD Advancing AI 2026 :

(* Divulgation : TheCUBE est un partenaire média payant pour l'événement AMD Advancing AI. Ni AMD, le sponsor de la couverture de l'événement theCUBE, ni les autres sponsors n'ont de contrôle éditorial sur le contenu de theCUBE ou SiliconANGLE.)

Photo : SiliconANGLE

Newsletter

Rejoignez notre newsletter pour des astuces chaque semaine