La montée en puissance du fournisseur de cloud natif d'IA CoreWeave Inc. fait partie de la plus grande histoire émergent autour de l’opérationnalisation de l’IA.
Alors que les entreprises passent de la formation à l’inférence, les néoclouds tels que CoreWeave fournissent une infrastructure cloud sur mesure pour l’IA. L'entreprise a fait des vagues en terminer la première mise à niveau et validation de l'industrie de Nvidia Vera Rubin NVL72 sur CoreWeave Cloud.
Les recherches sur le développement d'applications de TheCUBE Research montrent que 86 % des entreprises donnent la priorité à l'unification des données plutôt qu'au calcul, ce qui renforce le fait que les performances de l'IA ne dépendent pas uniquement des accélérateurs. C'est pourquoi le support de CoreWeave pour Nvidia Vera Rubinune plateforme unifiée et complète conçue pour prendre en charge l’IA agentique, est si importante.
« L'évolution de CoreWeave met en évidence un changement fondamental dans la façon dont les entreprises devraient penser l'infrastructure de l'IA », a déclaré Paul Nashawatyanalyste principal pour theCUBE Research. « Le défi ne consiste plus simplement à acquérir la capacité du GPU ; il consiste à construire la base intégrée nécessaire pour prendre en charge les applications d'IA tout au long de leur cycle de vie. »
Le studio de diffusion en direct de SiliconANGLE Media, theCUBE, sera sur place chez CoreWeave Entièrement connecté événement à San Francisco du 30 septembre–1er octobre, présentant les informations de CoreWeave et de ses partenaires de l'écosystème. Avant l'événement, nous examinons le rôle de CoreWeave sur le marché en évolution de l'IA. (* Divulgation ci-dessous.)
L’infrastructure d’IA consiste désormais à disposer de la pile complète
L'inférence est devenue le nouveau domaine pour les entreprises qui cherchent à obtenir un retour sur leurs investissements en IA et leurs dépenses en capital. Alors que les néoclouds et les hyperscalers élargissent leurs offres pour les charges de travail d'IA, CoreWeave cherche à se différencier grâce à son expertise sur l'ensemble de la pile d'infrastructure.
« À mesure que les charges de travail d'IA agentique et d'inférence se développent, les entreprises auront besoin d'une infrastructure prenant en charge le déploiement, l'observabilité, la sécurité, la gouvernance et la gestion des coûts évolutifs tout au long du cycle de vie des applications », a déclaré Nashawaty. « Les Neoclouds sont en mesure de jouer un rôle croissant dans cette transition, mais leur différenciation à long terme dépendra de l'efficacité avec laquelle ils relient les performances de l'infrastructure aux résultats mesurables des applications.
CoreWeave positionne son pile spécialement conçue pour offrir une utilisation plus élevée, un accès plus rapide à la capacité et une meilleure économie de jetons, des avantages que les clients pourraient autrement avoir du mal à obtenir seuls. TheCUBE Research compare cette proposition de valeur aux débuts du cloud, qui réduisaient les coûts informatiques pour les clients et amélioraient les délais de rentabilisation.
Faire passer les projets d’IA de l’expérimentation à la production reste un défi sur le marché des entreprises. Environ 30 % des organisations sont confrontées à un écart de préparation opérationnelle entre l’expérimentation de l’IA et la production, tandis que près de 88 % des pilotes d’IA ne parviennent pas à atteindre la production, selon CUBE Research. En s'associant à la plateforme full-stack de Nvidia Corp., CoreWeave vise à réduire cet écart.
« Les Neoclouds tels que CoreWeave peuvent combler cet écart en réunissant le calcul haute performance, le mouvement des données, l'orchestration de l'infrastructure et les capacités opérationnelles dont les développeurs ont besoin pour déployer et gérer les charges de travail d'IA de manière fiable », a déclaré Nashawaty. « La validation par CoreWeave du Nvidia Vera Rubin NVL72 montre l'évolution de l'industrie vers des systèmes d'IA intégrés et orientés vers la production plutôt que vers des composants d'infrastructure autonomes. »
CoreWeave et Nvidia se préparent à l'ère agentique
La validation de Vera Rubin est une étape majeure pour CoreWeave. Les analystes de TheCUBE soulignent la compression des coûts comme l'implication commerciale la plus importante de la plateforme, avec la nouvelle offre système un dixième du coût par million de jetons par rapport aux versions précédentes de Nvidia. Cependant, une meilleure économie symbolique pourrait élargir le marché plutôt que simplement réduire les dépenses.
« L'IA n'est plus une question modèles isolés, » dit John Furrieranalyste exécutif pour theCUBE Research. « Il s'agit de systèmes – des systèmes qui rassemblent le calcul, la mise en réseau, le stockage, les logiciels, les données, la sécurité et les opérations dans une plate-forme unifiée capable de fournir des résultats concrets. Les gagnants de cette prochaine phase n'auront pas simplement accès à l'IA ; ce seront les organisations qui pourront la mettre en œuvre, la faire évoluer, la gouverner et innover continuellement autour d'elle. »
En tant qu'infrastructure d'IA absorbe les fonctions informatiques traditionnelles à usage généralCoreWeave se positionne comme une alternative aux infrastructures cloud à usage général. Les plates-formes full-stack telles que Vera Rubin jouent un rôle essentiel dans la réduction des coûts, car des connexions plus étroites entre les modèles et les systèmes de données permettent de réduire la latence et retour d'inférence plus rapide.
« Il y a actuellement une forte demande sur le marché pour le Infrastructure d'IA que nous fournissons, » dit Jean Anglaisdirecteur marketing chez CoreWeave. « Nous voyons cela à travers des clients qui viennent nous voir qui ont essayé autre chose et n'ont pas obtenu la fiabilité dont ils avaient besoin. Il s'agit de soulever des choses, de les présenter et de les valider d'abord sur le marché, comme nous l'avons fait avec Vera Rubin. Tout cela est un écosystème que nous servons et la capacité pour nous de le faire avec le partenariat requis est ce que nous considérons vraiment comme un grand différenciateur. «
La collaboration de CoreWeave avec Nvidia n'est que le début de la prochaine étape de l'infrastructure de l'IA, selon le directeur de la technologie Peter Salanki. Il envisage un avenir dans lequel l'inférence est désagrégé en étapes de pipeline spécialisées. Un modèle plus petit traiterait d'abord la requête, puis des modèles plus grands prendraient le relais pour des tâches plus complexes, offrant ainsi aux utilisateurs un équilibre entre performances et coûts.
L’essor de l’IA agentique fait également partie de l’équation, nécessitant une boucle d'application avec des GPU et des CPU pour un déploiement de code sécurisé.
« Rubin va débloquez l'ère agentique, » dit Dion Harrisdirecteur principal du marketing des produits informatiques accélérés chez Nvidia. « Agentic est essentiellement l'endroit où vous prenez non seulement un modèle et effectuez une inférence ponctuelle, mais le modèle lui-même effectue la planification. Il possède des compétences et des sous-agents qui… décomposent un problème et le résolvent pour effectuer un travail réel. C'est pourquoi lorsque nous disons (que) Vera Rubin a été conçue pour les agents, elle a été conçue pour permettre à ce nouveau flux de travail – les CPU, les GPU, le stockage, tout cela réunis – de débloquer ces flux de travail agents. «
Les Neoclouds défient les hyperscalers pour les charges de travail d'IA
Le carnet de revenus de CoreWeave s'élevait à environ 104 milliards de dollars au 30 juin, ce qui représente des revenus contractuels qui n'avaient pas encore été comptabilisés. La société a également introduit de nouveaux services d'IA cette année, notamment une offre qui permet aux entreprises de déployer des agents d'IA capables de s'améliorer de manière autonome en utilisant données du monde réel et son nouveau service d'ingénierie de terrain d'IA physique.
Le carnet de commandes et l'expansion du portefeuille reflètent la croissance rapide de CoreWeave, alors que la société continue d'investir dans l'infrastructure, la capacité et les services pour répondre à la demande croissante de charges de travail d'IA.
« Certaines tendances intéressantes se sont développées et je pense qu'elles rendront cet événement (entièrement connecté) très intéressant », a déclaré John Furrier de theCUBE Research, lors d'un entretien préalable à la conférence. « L'un d'entre eux est un nouveau terme qui a été utilisé dans les cercles industriels appelé « asset light », ce qui signifie que vous n'avez pas besoin de dépenser des milliards et des milliards de dollars pour obtenir des renseignements sur l'IA. Cela pousse beaucoup de gens à dire : « Hé, je vais simplement utiliser CoreWeave ».
CoreWeave parie que la demande croissante d’inférence renforcera les arguments en faveur d’une infrastructure cloud spécialisée en IA. Salanki estime qu'une infrastructure d'IA spécialement conçue peut offrir des avantages par rapport aux architectures cloud traditionnelles à usage général, conférant potentiellement aux néoclouds un rôle distinct à mesure que les charges de travail d'IA se développent.
La proposition de valeur de CoreWeave englobe bien plus que le calcul accéléré ; l'entreprise a repensé les installations, les racks et son plan de contrôle logiciel. Les racks Vera Rubin atteignent jusqu'à 250 kilowatts par rackce qui rend les installations et technologies spécialement conçues, telles que le refroidissement liquide, de plus en plus importantes pour prendre en charge l'infrastructure d'IA haute densité. Cette exigence est un élément clé de la stratégie d'infrastructure de CoreWeave.
« L’ère agentique exige un approche fondamentalement différente de l’infrastructureune solution qui suit le rythme des charges de travail qui raisonnent en continu, évoluent de manière imprévisible et fonctionnent en production 24 heures sur 24 », a déclaré Chen Goldbergvice-président exécutif des produits et de l'ingénierie chez CoreWeave. « Ce qui différencie une infrastructure performante en laboratoire d’une infrastructure performante en production, c’est la profondeur de l’ingénierie qui la sous-tend. »
Restez à l'écoute pour la couverture de SiliconANGLE et theCUBE sur le Événement entièrement connecté.
(* Divulgation : TheCUBE est un partenaire média payant pour l'événement Fully Connected. Ni CoreWeave, le sponsor de la couverture de l'événement theCUBE, ni les autres sponsors n'ont de contrôle éditorial sur le contenu de theCUBE ou SiliconANGLE.)