Le stockage d'entreprise devient la mémoire de l'IA alors que les modèles privés se rapprochent de la frontière

À mesure que les modèles ouverts se rapprochent des performances des systèmes propriétaires, les entreprises disposent d’un moyen crédible d’exécuter l’IA générative sur le matériel qu’elles possèdent. Ce changement place les données déjà stockées dans le stockage de l’entreprise au centre de la conversation privée sur l’IA.

De nombreuses organisations sortent désormais l’IA des projets pilotes vers la production en s’appuyant sur une infrastructure de données intelligente. Les deux dernières années ont été en grande partie consacrées à la préparation de vastes réserves de données pour l'IA, c'est pourquoi les gains de productivité se font désormais sentir dans tous les secteurs, selon Ashish Dhawan (photo, à gauche), vice-président senior, directeur général et directeur des revenus de l'unité commerciale Cloud chez NetApp Inc.

« Il y a eu plus de maturité dans l'utilisation des modèles dans l'IA privée. Vous constatez que qu'il s'agisse de modèles fermés ou de modèles ouverts, ils se rapprochent de la frontière », a déclaré Dhawan. « C'est là que notre AIPod Mini avec Iterate peut vraiment bien fonctionner. »

Dhawan, Brian Sathianathan (au centre), co-fondateur et directeur de la technologie d'Iterate Studio Inc., faisant affaire sous le nom d'Iterate.ai, et Jon Nordmark (à droite), co-fondateur et directeur général d'Iterate.ai, se sont entretenus avec Christophe Bertrand de theCUBE chez NetApp INSIGHT, lors d'une interview exclusive sur theCUBE, le studio de diffusion en direct de SiliconANGLE Media. Ils ont discuté de la manière dont le partenariat entre les entreprises propose l'IA privée aux entreprises et des domaines dans lesquels l'IA agentique produit des résultats mesurables. (* Divulgation ci-dessous.)

Les modèles ouverts rapprochent l’IA privée des données d’entreprise

Le partenariat se concentre sur l'AIPod Mini, une appliance clé en main qui associe l'infrastructure NetApp à la plateforme Generate d'Iterate.ai. L'objectif est de garder le modèle, le matériel et les données sous le contrôle du client plutôt que d'envoyer des informations à un service tiers, selon Sathianathan.

« L'AIPod Mini a connecté des connexions au stockage NetApp et communique avec NetApp en utilisant le protocole ONTAP qui a fait ses preuves », a déclaré Sathianathan. « En outre, en plus de l'AIPod Mini, nous exécutons notre logiciel Generate. Ce logiciel intègre un LLM, vous pouvez donc exécuter toutes vos requêtes d'IA localement et en toute confidentialité entre vos quatre murs. « 

Prêt à l'emploi, le système est livré avec plus de 200 modèles d'agents, plus de 200 compétences et un accès à plus de 800 outils, selon Nordmark. Lors d'un déploiement d'assurance, l'analyse d'un rapport d'accident qui prendrait normalement environ huit heures à un analyste a été réalisée en huit minutes. Iterate.ai définit son approche comme une IA basée sur les résultats, jugée sur les résultats commerciaux plutôt que sur les spécifications techniques.

« Ce que nous entendons par là, c'est qu'il doit produire les KPI et les résultats commerciaux appropriés », a déclaré Nordmark. « Maintenant, les aspects techniques sont en quelque sorte des enjeux de table, mais tout le reste est ce qui compte vraiment pour l'entreprise. »

Les soins de santé offrent un exemple plus frappant. Les hôpitaux collectent généralement 80 à 85 % de ce qu'ils facturent aux assureurs, et l'agent du cycle de revenus médico-légal d'Iterate.ai a identifié 17,4 millions de dollars de réclamations refusées pour un hôpital avec une facturation annuelle de 150 millions de dollars, selon Sathianathan. Le flux de travail enchaîne trois agents qui lisent les contrats du payeur, examinent les refus entrants et rédigent les resoumissions, a ajouté Nordmark. À mesure que les agents assument ce type de travail back-end, le contrôle de ce à quoi ils peuvent accéder devient essentiel.

« Si ces agents autonomes commencent à fonctionner, cela signifie également que vous voulez avoir une gouvernance », a déclaré Sathianathan. « Vous voulez avoir l'autorisation. C'est là que la plate-forme NetApp est vraiment puissante. »

NetApp a également profité de l'événement pour lancer Novus, une architecture de stockage conçue pour une capacité de l'ordre du zettaoctet dans les usines d'IA. Pour les partenaires, le point le plus important est que les modèles ouverts performants ne sont rentables que lorsqu'ils peuvent atteindre les connaissances institutionnelles contenues dans le stockage de l'entreprise.

« La mémoire et le contexte égalent la connaissance. Nous en parlons beaucoup. La mémoire est ce qui fait fonctionner l'IA », a déclaré Nordmark. « Aujourd'hui, une grande partie de la mémoire d'une entreprise est stockée, et c'est ce que NetApp est là pour libérer. »

Voici l'interview vidéo complète, qui fait partie de la couverture de NetApp INSIGHT par SiliconANGLE et theCUBE :

(* Divulgation : TheCUBE est un partenaire média payant pour l'événement NetApp INSIGHT 2026. Ni NetApp Inc., le sponsor de la couverture de l'événement theCUBE, ni les autres sponsors n'ont de contrôle éditorial sur le contenu de theCUBE ou SiliconANGLE.)

Photo : SiliconANGLE

Newsletter

Rejoignez notre newsletter pour des astuces chaque semaine