Meta Platforms Inc. prévoit de publier des versions open source de ses modèles d'intelligence artificielle de nouvelle génération, Axios signalé aujourd'hui.
La société a fait ses débuts son réseau neuronal le plus performant en avril dernier. Llama 4 Maverick, comme on appelle l'algorithme, est un grand modèle de langage open source avec 400 milliards de paramètres. En décembre, des sources ont déclaré Bloomberg que Meta prévoyait de passer à une approche de distribution à source fermée avec les futurs LLM.
La société est aurait développer deux modèles frontières exclusifs. Il existe un LLM nommé Avocado et un générateur de fichiers multimédia connu en interne sous le nom de Mango. Les deux algorithmes devraient être lancés cette année. Les modèles open source détaillés dans le rapport Axios d'aujourd'hui sont vraisemblablement dérivés d'Avocado et de Mango.
On ne sait pas si les versions open source seront lancées en même temps que les éditions propriétaires. Axios a signalé que les anciens algorithmes seraient lancés « à terme ». Ils font partie d'un effort de Meta visant à distribuer ses modèles « largement et aussi largement que possible dans le monde entier ».
Les versions open source n'inclueraient apparemment pas toutes les fonctionnalités disponibles dans les versions fermées. On ne sait pas quelles fonctionnalités Meta laissera de côté.
Llama 4 Maverick, le meilleur LLM open source de la société, est basé sur une architecture mixte d'experts. Il ne s'agit pas d'un algorithme monolithique mais plutôt de 128 réseaux de neurones différents, chacun optimisé pour un ensemble de tâches différent. Les prochains modèles open source de Meta pourraient manquer de certains des réseaux neuronaux qui alimentent les éditions propriétaires.
Une autre possibilité est que l'entreprise réduise le nombre de paramètres des versions open source ou saute certaines étapes de formation. Les Frontier LLM suivent plusieurs cycles de formation, y compris ce que l'on appelle la post-formation qui a lieu une fois que leurs capacités de base sont déjà en place. C'est pas rare pour les développeurs de modèles open source de publier des versions d'algorithmes réduites qui n'ont pas subi de post-formation.
La sécurité de l'IA serait l'une des raisons pour lesquelles les modèles open source de Meta n'incluent pas toutes les fonctionnalités des éditions propriétaires. Cela laisse entendre qu'Avocado sera habile à générer du code lié à la cybersécurité. Claude 4.6 Opus, le LLM le plus compétent d'Anthropic PBC, a jusqu'à présent découvert des centaines de vulnérabilités critiques dans des projets open source.
Anthropic et OpenAI Group PBC sont tous deux préparation pour publier de nouveaux LLM phares. Selon Axios, Meta ne s'attend pas à ce que ses prochains modèles surpassent la concurrence « dans tous les domaines ». Cependant, les algorithmes de la société mère de Facebook auraient plusieurs « points forts » susceptibles d'attirer les consommateurs.
Meta pourrait chercher à convaincre les consommateurs en rendant ses modèles plus efficaces en termes de matériel que ceux de la concurrence. De nombreux LLM frontières ne peuvent pas fonctionner sur des ordinateurs personnels en raison de contraintes de processeur. Il est également possible que Meta optimise les algorithmes pour des cas d'utilisation tels que la santé personnelle et l'aide aux devoirs qui ne sont pas prioritaires par les modèles axés sur l'entreprise.