OpenAI commence à déployer son modèle GPT-6 Astra de nouvelle génération

OpenAI Group PBC a commencé aujourd'hui à ouvrir l'accès à GPT-6 Astra, son modèle de langage étendu le plus récent et le plus performant.

La société a déclaré que le LLM démontre des performances « de pointe » dans plusieurs domaines. La liste comprend le codage, la navigation et l'utilisation de l'ordinateur, terme désignant les tâches qui nécessitent qu'un modèle interagisse avec les interfaces graphiques des applications. De plus, Astra a obtenu des scores parfaits sur trois des tests d'intelligence artificielle les plus exigeants au monde.

Le premier test réussi par le modèle s’appelle FrontierMath Tier 4. Il comprend 50 défis mathématiques qu’il faut plusieurs semaines à la plupart des mathématiciens humains pour résoudre. Selon OpenAI, Astra a terminé l'évaluation avec un score de 98 %.

Les bons résultats de référence du modèle ne sont pas une grande surprise. Avant sa sortie publique, Astra résolu plusieurs problèmes d'Erdos, des problèmes mathématiques vieux de plusieurs décennies qui intéressent particulièrement les chercheurs. Il a également réalisé plusieurs avancées dans une branche de l’informatique appelée théorie de la complexité computationnelle.

Astra a obtenu un score de 99,9 % à un test appelé ARC-AGI-3 qui mesure la capacité des LLM à apprendre de nouvelles tâches. Cette capacité est une condition préalable importante à l’intelligence artificielle générale, ou AGI. Le modèle a également obtenu un score parfait sur ExploitBench, qui mesure la capacité des LLM à trouver et exploiter les vulnérabilités logicielles.

Mardi, OpenAI a révélé qu'Astra est considéré comme un risque « critique » dans son cadre interne d'évaluation de la sécurité de l'IA. Un LLM reçoit cette désignation s’il démontre sa capacité à pirater « de nombreux systèmes bien protégés » sans intervention humaine. Les capacités de cybersécurité d'Astra ont obligé OpenAI à retarder sa sortie de plusieurs semaines. Selon l’entreprise, ses ingénieurs ont passé ce temps à développer des garde-fous contre le piratage.

OpenAI affirme que la capacité d'Astra à s'attaquer à des tâches complexes découle en partie d'une nouvelle approche de gestion des données.

Les LLM génèrent une quantité importante de données tout en générant des réponses rapides. Lorsque ces données ne peuvent pas tenir dans la fenêtre contextuelle d'un modèle, un mécanisme de compactage les compresse. Les informations de faible priorité sont supprimées pour faire place à de nouvelles demandes.

Astra compresse également les invites pour faire de la place aux nouvelles données, mais ne supprime pas les informations d'origine. Le modèle l'archive plutôt sous une forme consultable, accessible ultérieurement si nécessaire. Cette approche conserve les points de données que le modèle peut utiliser pour améliorer la qualité de sa sortie.

Au lancement, Astra n'est disponible que pour un nombre limité de clients via un programme appelé Daybreak. Le programme permet aux organisations d'utiliser les modèles d'OpenAI pour la recherche sur la cybersécurité. La société étendra la disponibilité d'Astra au cours des prochains jours en l'intégrant à ChatGPT, Codex et son interface de programmation d'applications.

OpenAI a déclaré aujourd'hui qu'il fournirait aux participants de Daybreak 1 milliard de dollars de crédits. L’objectif est d’aider les agences gouvernementales, les services publics et autres opérateurs de services essentiels à améliorer leur posture de cybersécurité. Les crédits couvriront non seulement l’utilisation du modèle mais également la formation et le support client. OpenAI fournira une partie de la formation en partenariat avec MS-ISAC, une organisation à but non lucratif qui aide les organisations du secteur public à bloquer les cyberattaques.

Photo : Focal Foto/Flickr

Newsletter

Rejoignez notre newsletter pour des astuces chaque semaine