La société néocloud GMI Cloud Inc., basée à Taiwan, souhaite capitaliser sur ce qu'elle considère comme une demande « sans précédent » en matière de puissance de calcul de l'intelligence artificielle après avoir levé un financement massif de 663 millions de dollars auprès de deux sources.
La startup a annoncé aujourd'hui qu'elle venait de clôturer une ronde de financement de série B de 223 millions de dollars dirigée par la société d'investissement axée sur la robotique et l'IA ARCHIV, avec la participation de Nvidia Corp., Redwood, DSC Investment, KT Corp., Kyobo Life, KB Investment et Trend Micro Inc. Dans le même temps, elle a obtenu une facilité de crédit de 440 millions de dollars auprès de ChinaTrust Commercial Bank, l'une des plus grandes institutions financières de Taiwan.
GMI Cloud fait partie d'une multitude de fournisseurs d'infrastructures cloud spécialisés qui ont émergé ces dernières années pour répondre à la demande croissante d'accès aux unités de traitement graphique et à d'autres ressources nécessaires pour alimenter les charges de travail d'IA. Le plus connu de ces néoclouds est CoreWeave Inc., entré en bourse l’année dernière et devenu rapidement l’un des chouchous de Wall Street dans un contexte de boom de l’IA. En Europe, il y a Nebius Group NV, qui a rebaptisé Yandex NV après avoir vendu sa société russe de moteurs de recherche Yandex.
Comme ses concurrents, GMI Cloud propose une plate-forme d'infrastructure d'IA en tant que service spécialement conçue pour les charges de travail de formation et d'inférence d'IA gourmandes en ressources. Il offre un accès à la demande à certains des GPU les plus puissants disponibles, notamment les puces H100 et H200 de Nvidia et ses GPU Vera Rubin encore plus récents.
Sa plate-forme est alimentée par un système de gestion d'infrastructure propriétaire basé sur Kubernetes qu'elle appelle Cluster Engine, qui automatise l'allocation des ressources et le provisionnement des instances afin que les développeurs puissent se concentrer uniquement sur leurs applications. Il s'agit d'un avantage considérable, car cela signifie que les développeurs peuvent lancer des clusters GPU basés sur des environnements préconfigurés en quelques secondes. Sur les plates-formes d'infrastructure cloud traditionnelles, les développeurs devraient configurer manuellement ces environnements eux-mêmes.
La forte présence de GMI Cloud dans la région Asie-Pacifique constitue un autre avantage clé, notamment par rapport à CoreWeave et Nebius, dont les centres de données sont principalement centrés sur les États-Unis et l'Europe. La startup possède des dizaines de centres de données répartis à Taiwan, en Thaïlande et en Malaisie, ce qui la place dans une position de force pour répondre aux besoins des entreprises qui souhaitent exécuter des charges de travail d'IA localement dans la région. Cependant, elle renforce également sa présence aux États-Unis, ainsi qu'une initiative souveraine en matière d'IA au Japon, lancée plus tôt cette année.
Le fondateur et directeur général Alex Yeh a déclaré que la demande en infrastructure de calcul d'IA était devenue mondiale. Les hyperscalers et les startups d’IA basés aux États-Unis cherchent désespérément à trouver davantage de capacité GPU en Asie, où ils disposent d’une clientèle importante. En outre, des milliers d’entreprises basées en Asie-Pacifique mènent également des projets d’IA, et toutes ont besoin d’une source de calcul locale.
« Nos clients évoluent plus rapidement que jamais et ils ont besoin d'une infrastructure qui suit le rythme », a déclaré Yeh. « L'IA est à l'origine d'une nouvelle renaissance et le calcul fiable en est la base. Notre objectif est de construire cette base sur tous les continents, avec un écosystème de produits par-dessus. »
Le fait d'être basé à Taiwan donne à GMI Cloud un autre avantage majeur, car le pays se trouve également être la plus grande usine au monde de systèmes de serveurs d'IA qui peuplent les centres de données du monde entier. Sa proximité avec de nombreux fournisseurs signifie que la startup dispose d'une chaîne d'approvisionnement extrêmement sécurisée et de la capacité de se procurer rapidement tous les systèmes dont elle a besoin pour que ses nouveaux centres de données soient opérationnels, peu importe où ils se trouvent dans le monde.
« Dans l'infrastructure de l'IA, une date de livraison est une promesse », a expliqué Yeh. « Les clients planifient les lancements, les embauches et les revenus autour de ces dates. Notre place dans la chaîne d'approvisionnement de Taiwan dépend de la façon dont nous tenons cette promesse, cluster après cluster à l'échelle mondiale. »
Cette fiabilité a déjà porté ses fruits pour GMI Cloud. La startup a déclaré que le montant de ses revenus annuels récurrents sous contrat devrait être multiplié par 10 à la fin de l'année par rapport à ce qu'il était en décembre 2025. Quant à l'ARR qui est déjà réalisé, il a quintuplé l'année dernière, avec sa plate-forme d'inférence traitant en moyenne plus de 4 000 milliards de jetons par semaine. Elle compte un certain nombre d'entreprises clientes majeures, notamment Higgsfield Inc., OpenRouter, Nous Research Inc., Fireworks AI Inc. et Trend Micro.