Advanced Micro Devices Inc. a annoncé aujourd'hui avoir accepté d'acheter Taalas Inc., une startup torontoise qui connecte des modèles d'intelligence artificielle directement dans le silicium, dans le cadre d'un accord qui pousse le fabricant de puces plus profondément sur le marché de l'inférence de l'IA.
Les termes n’ont pas été divulgués. Les actions AMD ont augmenté d'environ 1,5% suite à l'annonce.
Fondée en 2023, Taalas construit ce qu'elle appelle des circuits intégrés spécifiques à un modèle, des puces qui transfèrent les poids et le flux de données d'un modèle dans des transistors au lieu de les faire entrer et sortir d'une mémoire à large bande passante. Sa première puce de test, HC1, a été construite sur le processus 6 nanomètres de Taiwan Semiconductor Manufacturing Co. Ltd. et a servi le Llama 3.1 8B de Meta Platforms Inc. à près de 17 000 jetons par seconde, un taux que Taalas a déclaré en février était 73 fois supérieur à celui du H200 de Nvidia Corp. à un dixième de la puissance. Une deuxième puce, HC2, cible des modèles d'environ 20 milliards de paramètres.
Le compromis est la flexibilité. Une pièce Taalas finie exécute le modèle pour lequel elle a été construite et rien d'autre, donc un nouveau modèle signifie un nouveau silicium. Taalas dit que c'est moins cher qu'il n'y paraît. Seules deux des plus de 100 couches de la puce changent d'une conception à l'autre, et la société estime son délai d'enregistrement à environ deux mois à l'aide d'outils internes.
La technologie se dirige vers la feuille de route des accélérateurs d’AMD. Le plan le plus vaste concerne les systèmes, pas seulement les pièces. AMD souhaite que les puces Taalas fonctionnent à côté de ses GPU Instinct, connectées aux racks Helios et aux processeurs Epyc qu'elle vend et programmées via son logiciel ROCm.
Vamsi Boppana, vice-président senior du groupe d'intelligence artificielle d'AMD, a déclaré que l'objectif est de choisir, en offrant aux clients « les bonnes solutions de calcul pour chaque charge de travail d'IA ». Taalas apporte ce qu'il appelle la performance et l'efficacité de l'inférence différenciée.
Ljubisa Bajic, cofondateur et directeur général de Taalas, en est à sa deuxième entreprise de puces IA. Il a dirigé Tenstorrent Inc. avant de partir créer Taalas. La startup a été fondée « pour repenser l’inférence de l’IA de fond en comble en construisant le matériel autour du modèle », a-t-il déclaré. Son équipe torontoise rejoint le groupe de Boppana une fois la transaction conclue.
L’achat atterrit dans un marché qui s’est réorganisé autour de l’inférence au cours de la dernière année. Nvidia a accepté en décembre d'acquérir sous licence la technologie d'inférence de Groq Inc. dans le cadre d'un accord de 20 milliards de dollars, puis de l'utiliser dans l'unité de traitement linguistique Groq 3 dévoilée lors de sa conférence GTC en mars. Taalas est la troisième acquisition d'AMD en matière d'IA en neuf mois, après MK1 en novembre et la startup d'optimisation de mémoire Mext en juin. L'équipe FastFlowLM a rejoint l'entreprise en juillet.
Taalas a levé 169 millions de dollars en février auprès de Quiet Capital, Fidelity et de l'investisseur en semi-conducteurs Pierre Lamond, portant le total à environ 219 millions de dollars.
L'acquisition est soumise aux conditions de clôture habituelles et aux approbations réglementaires.