Anthropic et Nvidia s'opposent à l'interdiction générale des modèles d'IA à poids ouvert

Alors que le gouvernement américain débat de nouvelles règles et réglementations en matière d'intelligence artificielle, Anthropic PBC et Nvidia Corp. prennent position contre l'interdiction générale des modèles à poids ouvert, exhortant les régulateurs à se concentrer plutôt sur les risques spécifiques et les abus.

Un modèle à poids ouvert est un modèle dans lequel le développeur publie ses paramètres entraînés, les « poids », qui sont les valeurs numériques et les vecteurs appris au cours de la formation qui déterminent le comportement d'un modèle. Ces poids agissent comme des cadrans qui peuvent être ajustés pour façonner les résultats et les performances d'un modèle. Parce qu'ils sont accessibles, les pondérations peuvent être affinées avec des données propriétaires, permettant ainsi aux développeurs de personnaliser le modèle à des fins et des cas d'utilisation spécialisés.

Des modèles ouverts sont publiés afin que les utilisateurs et les entreprises puissent les exécuter localement ou dans leur propre cloud, évitant ainsi d'avoir besoin d'accéder à des modèles frontières fermés construits et déployés par de grands développeurs de modèles d'IA tels que OpenAI PBC ou Anthropic.

Des exemples bien connus de modèles à poids ouvert incluent les modèles Llama de Meta Platforms Inc., Mistral AI SAS, Qwen d'Alibaba Group Holding Ltd. et les modèles DeepSeek. Tous ces modèles permettent aux développeurs de télécharger, d'exécuter et de régler les poids directement.

Selon Axios, l’année dernière, le ministère américain du Commerce a envisagé d’ajouter plusieurs laboratoires chinois d’IA à la « liste des entités ». Une action qui aurait effectivement interdit aux entreprises américaines d’accéder à leurs modèles sans licence. Plus récemment, le secrétaire américain au Trésor, Scott Bessent, a déclaré que la Maison Blanche pourrait sanctionner les laboratoires frontaliers chinois ouverts.

Dans un long traité, le directeur général d'Anthropic, Dario Amodei, a souligné que l'entreprise n'avait jamais plaidé en faveur d'une interdiction des modèles à poids ouvert.

« Les modèles à pondération ouverte qui n'ont pas de capacités dangereuses sont un bien public : ils ne coûtent rien en dehors du calcul nécessaire pour les exécuter, et ils apportent de la valeur aux entreprises, aux développeurs et aux chercheurs », a déclaré Amodei.

Il a centré sa discussion sur le contrôle de l’infrastructure et du comportement autour des modèles, et non sur les modèles eux-mêmes. Il a déclaré que l'accent devrait être mis sur le contrôle de l'exportation de silicium puissant de formation et d'inférence en IA, en empêchant la distillation à l'échelle industrielle – lorsqu'un modèle plus grand est utilisé pour améliorer un modèle plus petit – et en exigeant des tests de sécurité sur des modèles suffisamment puissants, qu'ils soient ouverts ou fermés.

Les inquiétudes d'Anthropic concernant la distillation font suite aux craintes que ses modèles frontières les plus grands et les plus puissants, Mythos et Fable, aient été subrepticement utilisés pour former des modèles d'IA étrangers. La semaine dernière, le directeur du Bureau de la politique scientifique et technologique, Michael Kratsios, a accusé Moonshot AI, basé à Pékin, d'utiliser la distillation pour entraîner Kimi K3, le plus récent grand modèle de langage de l'entreprise et le plus grand modèle à poids ouverts au monde. Bien que la distillation est fortement suspectée à l'échelle industrielle, il n'y a aucune preuve que K3 ait reçu une formation. du Mythe.

Le PDG de Nvidia, Jensen Huang, s'est prononcé sur X, anciennement Twitter, partageant une lettre ouverte signée par le supergéant des puces d'IA et déclarant : « L'IA transformera chaque industrie, alimentera chaque entreprise et sera construite par chaque pays. Les modèles ouverts renforcent la sécurité et la cybersécurité, accélèrent l'innovation et la diffusion et permettent la souveraineté. Le monde a besoin à la fois de modèles à frontières fermées et de modèles à frontières ouvertes. « 

La lettre ouverte, signée par Nvidia, IBM Corp., Mozilla Corp., Microsoft Corp., Meta et de nombreux autres leaders de l'industrie technologique, affirme que les modèles ouverts soutiennent l'innovation, la concurrence, le contrôle des clients et la souveraineté. Les signataires ont déclaré que ce type de modèle ne devrait pas être soumis à des restrictions supplémentaires qui réduiraient leur utilité au sein de l’industrie plus large des logiciels et de l’IA.

Newsletter

Rejoignez notre newsletter pour des astuces chaque semaine