Le marché du cloud IA full-stack ne se limite pas à l’accès aux unités de traitement graphique : il englobe également les outils nécessaires pour améliorer les modèles et les agents en production. Les fournisseurs cherchent à se distinguer par les outils, les partenaires et l'expertise qu'ils combinent avec le matériel.
CoreWeave Inc. connecte la formation, l'inférence et l'évaluation via sa nouvelle plateforme de développement CoreWeave Forge. L'objectif est d'utiliser ce que les équipes apprennent en production pour améliorer les modèles et les agents, selon Jean English (photo), directeur marketing de CoreWeave.
« Nous pensons que la boucle doit être connectée. Elle doit être ouverte à différents modèles, différents frameworks, différents cloud », a-t-elle déclaré. « Il ne s'agit pas simplement d'être fermé. Nous pensons que la boucle doit être connectée. Elle doit être ouverte à différents modèles, différents frameworks, différents cloud. »
English s'est entretenu avec Dave Vellante et John Furrier de theCUBE Research lors de l'événement Fully Connected, lors d'une diffusion exclusive sur theCUBE, le studio de diffusion en direct de SiliconANGLE Media. Ils ont expliqué comment l'entreprise associe la capacité GPU à une boucle de développement ouverte, des outils partenaires et un apprentissage pratique auprès des clients. (* Divulgation ci-dessous.)
Construire un cloud d'IA full-stack à partir des premiers principes
CoreWeave a construit sa plate-forme spécifiquement pour les charges de travail d'IA au lieu d'adapter une infrastructure conçue pour une génération antérieure d'applications Web. Les clients arrivant d'autres cloud citent souvent des lacunes en termes de vitesse, de performances, de capacité ou d'outils, a expliqué English.
« Sur ce marché, je pense que l’ère de l’IA nécessite de s’appuyer sur les premiers principes », a-t-elle déclaré. « C'est la raison pour laquelle nous sommes spécialement conçus. Il a été vraiment construit à partir de zéro… et je pense que c'est pourquoi, lorsque les clients utilisent d'autres cloud, ils ne sont pas en mesure d'évoluer aussi rapidement et d'obtenir les performances dont ils ont besoin. »
Le matériel compte toujours dans cette équation. CoreWeave a été le premier à proposer et à valider la plate-forme Vera Rubin de Nvidia Corp., et la société a récemment obtenu la note Platinum ClusterMAX de SemiAnalysis pour la troisième fois consécutive. La plus grande opportunité se situe au-dessus de la puce, où les partenaires fournissent des connexions d'outils, d'infrastructures et d'interfaces de programmation d'applications pour une large gamme de modèles, selon English.
« Cela va bien au-delà du GPU », a-t-elle déclaré. « Il s'agit d'un cloud d'IA complet. Cela signifie que pour les outils dont nous avons besoin, nous devons travailler avec d'autres partenaires. »
La stratégie full-stack de CoreWeave s'étend au-delà de la formation jusqu'à l'inférence. La plate-forme plus large rassemble le calcul, la mise en réseau, le stockage, les logiciels et les opérations pour prendre en charge les charges de travail d'IA en production. Les clients peuvent commencer avec un cas d'utilisation, selon l'anglais.
« De nombreux clients se tournent actuellement vers l'inférence », a-t-elle déclaré. « Les modélistes forment définitivement de grands modèles pionniers. Les entreprises travaillent sur le meilleur cas d'utilisation pour montrer les résultats et l'impact, et il ne s'agit pas simplement de « l'IA est le moteur d'une transformation ». La question est : « Quel est le cas d'utilisation ? » c’est pertinent pour mon équipe.
Voici l'interview vidéo complète, qui fait partie de la couverture de Fully Connected par SiliconANGLE et theCUBE :
(* Divulgation : TheCUBE est un partenaire média payant pour l'événement Fully Connected 2026. Ni CoreWeave, le sponsor de la couverture de l'événement theCUBE, ni les autres sponsors n'ont de contrôle éditorial sur le contenu de theCUBE ou SiliconANGLE.)