OpenWALDO se lance pour créer une communauté collaborative pour l'IA open source

OpenWALDO, un nouveau projet d'intelligence artificielle open source parrainé par Ctrl IQ Inc., lancé aujourd'hui, dirigé par Gregory Kutzer, fondateur de Rocky Linux, CentOS et Apptainer.

Le projet vise à créer un corpus communautaire de données de formation en IA, géré par une source ouverte. Il fournira un espace similaire à Hugging Face Inc., qui distribue principalement des modèles à poids ouvert, où chaque constructeur pourra innover à partir d'une base d'informations partagée au lieu de dupliquer la sienne.

Les modèles ouverts sont puissants car ils permettent aux utilisateurs de télécharger et d’exécuter des modèles d’IA n’importe où. Il s’agit d’une étape extrêmement précieuse, ouvrant la voie à des modèles pouvant fonctionner sur du matériel grand public ou dans le cloud sans avoir besoin de matériel propriétaire spécialisé ni cachés dans les profondeurs propriétaires des entreprises centralisées.

Cependant, il manque quelque chose d'important aux modèles à poids ouvert : ils sont livrés sans le code, les méthodes, les recettes et les données de formation nécessaires pour les régénérer. C'est là qu'interviennent les modèles open source.

« J'ai passé ma carrière à observer l'open source transformer les utilisateurs en constructeurs, les concurrents en collaborateurs et partager les problèmes en une infrastructure commune qui fonctionne à grande échelle », a déclaré Kurtzer. « Aucune organisation ne pourrait construire ou maintenir tout cela seule. OpenWALDO apporte ce modèle éprouvé à l'IA.

OpenWALDO propose une nomenclature IA qui ajoute non seulement des poids ouverts, mais également open source, qui inclut des données de formation complètes. Cela inclut les références d'objets, les documents, les jetons, l'inventaire et les licences comme preuve du contenu nécessaire pour reconstruire le modèle canonique à partir de zéro.

Selon le projet, cela signifie que chaque assertion est attribuée, réinscriptible et corrigible en public. Cela signifie que tout est ouvert et que tout modèle ouvert peut être examiné pour voir s'il existe du contenu protégé par le droit d'auteur ou « copyleft » qui pourrait entacher la source ou rendre toute personne l'utilisant légalement responsable de ses résultats une fois qu'elle est entièrement formée.

C’est l’essentiel : « Savoir avant de s’entraîner ». C'est un cran au-dessus des poids ouverts.

Kurtzer et OpenWALDO ont constaté que l'industrie actuelle a conduit à une culture dans laquelle de nombreuses équipes d'IA assemblent leur matériel de formation de base à partir de zéro, rassemblant des recettes par morceaux et dupliquant le travail à travers le monde. Il n'est pas nécessaire que cela fonctionne de cette façon. L'objectif du projet est de fournir une ressource créée par la communauté qui aidera à archiver les meilleures pratiques et à s'appuyer sur des bases vérifiées de ce qui fonctionne, à permettre l'expérimentation en public et à construire, expédier et révéler des lignes vérifiables qui peuvent être évaluées collectivement.

Le projet sera accessible à tous : particuliers, amateurs, chercheurs, institutions et entreprises. L’objectif est de permettre à chacun d’apprendre ensemble, de s’appuyer sur ce fondement public pour le bien public et de créer un commun durable de l’IA.

« L'Open Source a déjà gagné cet argument », a ajouté Kurtzer. « Les fournisseurs propriétaires ont fait des déclarations identiques à propos du code ouvert : peu sûr, irresponsable, impossible à faire confiance. Ils ont perdu, parce que la source, les licences et la provenance ont rendu la confiance évidente. »

Tout comme les communs open source plus larges, l’idée est de fournir un espace permettant à l’IA open source de s’améliorer, d’apprendre et de construire. « Travaillons ensemble, construisons ses fondations à l'air libre et faisons passer l'IA au niveau supérieur en collaboration », a déclaré Kurtzer.

Newsletter

Rejoignez notre newsletter pour des astuces chaque semaine