La modernisation du cloud privé passe d'une actualisation de la virtualisation à un effort plus large visant à construire une base opérationnelle pour l'intelligence artificielle de production. À mesure que les entreprises déplacent leurs modèles et leurs agents autonomes vers les flux de travail de base, les décisions en matière d'infrastructure doivent tenir compte du coût, de la sécurité, de la gouvernance et de l'endroit où les charges de travail de plus en plus diversifiées doivent s'exécuter.
Lors du salon VMware Explore de cette année, modernisation du cloud privé est devenu la conversation centrale. Dans une analyse d'ouverture, Christophe Bertrand de CUBE Research a prédit que l'événement relierait ses annonces et discussions individuelles à une transition d'entreprise plus large.
« Nous allons voir que la technologie VMware est au premier plan en matière de transformation de l'IA », a-t-il déclaré. « Et nous allons voir que les sujets autour de l'IA agentique, de l'économie, de la manière d'évoluer réellement dans ce nouveau monde, tant pour les partenaires qui soutiennent les clients que pour les utilisateurs finaux, vont devenir beaucoup plus clairs. »
Bertrand a proposé cette prévision aux côtés de la co-animatrice Alison Kosik lors de la couverture de VMware Explore par theCUBE. Ils ont également discuté avec des experts du secteur de la façon dont la modernisation du cloud privé se déroule à travers une infrastructure prête pour la production, une sécurité opérationnelle et des choix de déploiement dirigés par les partenaires. (* Divulgation ci-dessous.)
Voici l'analyse vidéo complète avec Christophe Bertrand et Alison Kosik :
Insight n°1 : La modernisation du cloud privé pose les bases de l'IA de production.
L’IA de production nécessite un environnement d’exploitation capable de répondre aux nouvelles demandes de charge de travail sans abandonner le contrôle que les entreprises attendent de leur propre infrastructure. Broadcom Inc. a positionné VMware Cloud Foundation comme cette base commune, associant des capacités de développement et de déploiement de type cloud à une infrastructure privée, selon Krish Prasad, vice-président senior et directeur général de la division VMware Cloud Foundation chez Broadcom.
« Nous avons pris les avantages que les gens voient dans le cloud public, à savoir l'expérience des développeurs, l'agilité, et nous avons combiné cela avec les choses que les gens aiment dans l'infrastructure privée, à savoir la sécurité, le contrôle des coûts et la résilience », a déclaré Prasad au CUBE. « Cette combinaison est la raison d'être de VCF, et c'est pourquoi les clients sont très intéressés par son déploiement. »
Toutefois, une plate-forme commune doit également préserver sa flexibilité à mesure que les exigences du modèle, les accélérateurs et les choix de déploiement évoluent. Les entreprises doivent placer l'architecture logicielle au cœur de leur planification afin de pouvoir utiliser des modèles locaux ou cloud et éviter de lier les options futures à des achats prématurés d'infrastructures, selon Chris Wolf, responsable mondial de l'IA et des services avancés, division VMware Cloud Foundation, chez Broadcom.
« 'Achetez d'abord votre matériel, découvrez le logiciel plus tard' — non, c'est une horrible idée, car vous devez vous assurer que vos choix de logiciels sont compatibles avec le matériel que vous avez acheté », a-t-il déclaré. « Le logiciel est ce qui vous donne la possibilité d'avoir une autonomie en termes d'accélérateurs que vous utilisez, d'avoir la flexibilité nécessaire pour garantir que je peux utiliser des modèles cloud quand j'en ai besoin (ou) utiliser des modèles locaux quand j'en ai besoin. »
Voici l'interview vidéo complète de theCUBE avec Chris Wolf :
Insight n°2 : Les charges de travail de production exigent des contrôles plus stricts et une flexibilité de placement.
À mesure que la modernisation du cloud privé passe à la production, une infrastructure flexible nécessite des contrôles conçus pour les logiciels autonomes. Les applications agentiques peuvent écrire du code, traiter des réclamations et exécuter des flux de travail métier, ce qui rend la gouvernance au niveau de la plateforme essentielle, selon Purnima Padmanabhan (photo), directeur général de la division Tanzu chez Broadcom. Son travail sur Tanzu Platform Agent Foundations vise à donner aux agents un accès soigneusement limité aux ressources de l'entreprise.
« La bonne façon de sécuriser un agent est de le mettre dans une boîte noire et de ne rien lui donner, mais vous n'obtiendrez alors aucun renseignement », a-t-elle déclaré au CUBE. « Je veux le fournir selon mes conditions, de manière organisée, avec identité, avec (contrôle d'accès basé sur les rôles) et gestion des informations d'identification. Pouvoir le connecter à des ensembles de données organisés sur une seule plateforme signifie que je peux avancer plus rapidement. »
Ces contrôles doivent s'étendre au-delà du temps d'exécution, car les acteurs autonomes effectuent des appels rapides entre les systèmes de l'entreprise. L'approche de sécurité des infrastructures de Broadcom combine la visibilité du réseau avec les identités des machines signées, l'application des politiques et l'inspection du trafic des interfaces de programmation d'applications. Il identifie également les composants d'IA agentiques, y compris les modèles et les serveurs Model Context Protocol, et signale les activités non autorisées, selon Umesh Mahajan, vice-président et directeur général de la division Application Networking and Security chez Broadcom, et Clayton Donley, vice-président et directeur général de la division Identity Management Security chez Broadcom.
« Nous avons passé 50 ans à trouver comment gérer vos employés, vos clients ou d'autres personnes accédant à vos systèmes informatiques », a déclaré Donley. « Nous avons eu environ 15 minutes pour comprendre comment procéder pour les agents IA. Le problème est que nous donnons à ces agents de plus en plus d'autonomie, plus de capacité à faire les choses par eux-mêmes sans ces contrôles. »
La flexibilité opérationnelle s'étend également là où les applications existantes s'exécutent. Amazon Elastic VMware Service donne aux clients un contrôle direct de VMware Cloud Foundation sur l'infrastructure d'Amazon Web Services Inc. tout en répondant aux sorties de centres de données, aux besoins de reprise après sinistre et aux contraintes matérielles, selon Andy Reedy, directeur principal de la gestion des produits EC2 chez AWS.
« Il s'agit en réalité d'un menu d'options, et il s'agit presque d'une application par application pour déterminer ce qui fonctionne le mieux pour cette charge de travail », a-t-il déclaré au CUBE. « Pour les charges de travail VMware en particulier, nous constatons qu'il n'est pas nécessaire de refactoriser ces applications ou de modifier ces charges de travail. Il est possible de bénéficier des avantages de l'infrastructure cloud sans avoir à modifier les applications elles-mêmes. »
Voici l'interview vidéo complète de Purnima Padmanabhan :
Insight n°3 : les partenaires transforment la stratégie VMware en choix d'infrastructure déployables.
La modernisation du cloud privé dépend de plus en plus de partenaires capables de transformer une plateforme intégrée en un système validé et déployable. Broadcom Inc. et Advanced Micro Devices Inc. combinent l'automatisation de la plate-forme avec des configurations matérielles validées afin que les entreprises puissent ajouter l'IA aux applications traditionnelles existantes et aux charges de travail conteneurisées, selon Raghu Nambiar, vice-président des logiciels et des solutions chez AMD, et Prashanth Shenoy, directeur du marketing et vice-président de la division VMware Cloud Foundation chez Broadcom.
« Beaucoup de nos clients envisagent le cloud privé dans un environnement sur site pour déployer leurs charges de travail d'IA de production à grande échelle », a déclaré Shenoy. « Mais pendant qu'ils essayaient de le faire, la modélisation de ce que nous appelons le métal a été un processus très complexe. Configuration des GPU, des serveurs, du réseau, de Kubernetes, des conteneurs, de la pile logicielle d'IA, des tests, de la validation des modèles à utiliser. C'est un processus extrêmement manuel et complexe. »
Ce rôle de partenaire devient également économique à mesure que la modernisation du cloud privé s’étend aux charges de travail d’IA gourmandes en mémoire dans un contexte d’augmentation des coûts de mémoire vive dynamique. Broadcom et Lenovo Group Ltd. ont validé la hiérarchisation de la mémoire dans VMware Cloud Foundation 9.1 sur les systèmes Lenovo ThinkAgile VX V4. Les configurations peuvent doubler la densité des machines virtuelles tout en conservant plus de 90 % des performances, selon Stuart McRae, directeur exécutif du groupe d'offre de stockage, de logiciels et de solutions d'entreprise de Lenovo, et Mark Chuang, responsable du marketing produit, VMware Cloud Foundation, chez Broadcom.
« Je parlais à un client ici chez Explore, et ils ont fait leurs calculs, et ils ont dit qu'ils pouvaient économiser jusqu'à 70 000 $ par serveur s'ils le configuraient de cette façon plutôt qu'en optant pour la DRAM pure », a déclaré Chuang à theCUBE. « C'est tout simplement fou de nos jours ; une clé USB, c'est comme le prix d'une voiture. »
Broadcom et Cisco Systems Inc. étendent ce modèle en dimensionnant l'infrastructure de l'usine d'IA en fonction de la charge de travail plutôt que de proposer une configuration fixe. Leur conception validée combine VMware Cloud Foundation avec l'infrastructure Cisco Unified Computing System, y compris les configurations Cisco AI POD, pour des environnements allant de l'inférence de périphérie aux charges de travail exigeantes des centres de données. L'approche adapte le calcul aux exigences telles que la latence et les utilisateurs simultanés, selon Sabina Anja, technologue en chef de la division VMware Cloud Foundation de Broadcom, et Jeff Nichols, responsable technique chez Cisco.
« En réalité, la philosophie derrière l'IA Factory est que l'utilisateur final n'a pas besoin d'être là, et que le service informatique n'a pas besoin d'être un architecte ou un constructeur perpétuel d'infrastructure d'IA », a déclaré Nichols. « Ils deviennent des consommateurs d'IA. Les usines d'IA sont expédiées sur site, entièrement construites, entièrement configurées et, avec VCF en plus, elles sont prêtes à fonctionner dès le premier et le deuxième jour. »
Voici l'interview vidéo complète de Raghu Nambiar et Prashanth Shenoy :
Pour en savoir plus sur la couverture de VMware Explore par theCUBE, voici notre playlist vidéo complète :
https://www.youtube.com/watch?v=videoseries
(* Divulgation : TheCUBE est un partenaire média payant pour VMware Explore. Les sponsors de la couverture de l'événement theCUBE n'ont pas de contrôle éditorial sur le contenu de theCUBE ou SiliconANGLE.)