L'AI Range Enterprise Edition de Hack The Box teste si les agents IA peuvent faire leur travail

La société de formation en cybersécurité Hack The Box Ltd. a présenté aujourd'hui AI Range Enterprise Edition pour permettre aux équipes de sécurité de tester si leurs propres agents d'intelligence artificielle peuvent effectuer les tâches qui leur ont été confiées.

Cette version cherche à résoudre le problème de la manière dont les équipes de sécurité contrôlent leurs agents. Hack The Box indique qu'un agent peut être mis en production après un résultat de référence solide ou un test du fournisseur sans jamais être comparé au travail qu'il effectuera au quotidien. Le personnel humain occupant le même rôle le fait généralement. Les performances d'un agent peuvent également dériver après le déploiement, à mesure que le modèle sous-jacent est mis à jour.

Hack The Box a lancé la gamme AI originale en décembre dernier. Depuis lors, les laboratoires d’IA, les clients gouvernementaux et les hyperscalers testent des agents, selon l’entreprise. Les équipes de sécurité d'entreprise subissent les mêmes tests avec l'édition entreprise, et chaque agent est évalué en fonction du rôle qui lui a été attribué.

La méthode d’évaluation porte le nom de Agentic Worker Competence. Chaque agent obtient une note pour le rôle qui lui est attribué et une note de réussite ou d'échec dans chaque environnement dans lequel il travaille, avec des résultats suivis au fil du temps. De nouveaux environnements sont ajoutés régulièrement à mesure que de nouvelles vulnérabilités et modèles d’attaque apparaissent dans la nature. Les clients peuvent réexécuter l'évaluation chaque fois qu'un agent, son modèle ou ses données changent.

Gerasimos Marketos, directeur des produits, a résumé le processus ainsi : « connectez l'agent, attribuez-lui un rôle et laissez-le travailler ». La plate-forme enregistre ensuite la façon dont l'agent accomplit chaque tâche de manière autonome, a-t-il déclaré, et les responsables de la sécurité peuvent utiliser ces résultats pour décider pour quel travail un agent est prêt.

Le lancement couvre également le personnel humain qui travaille aux côtés des agents. Les dirigeants ont besoin de « confiance des deux côtés du personnel » à mesure que l’IA assume davantage de tâches de cybersécurité, selon le fondateur et directeur général Haris Pylarinos.

Le testeur d’intrusion et l’analyste du centre d’opérations de sécurité sont les deux seuls rôles dotés de versions augmentées par l’IA au lancement. Dans la version analyste, les praticiens s'appuient sur l'IA pour examiner les alertes dans des scénarios réalistes. Ce que l’IA recommande de faire ensuite, c’est à eux de l’évaluer.

La notation de ces rôles passe par ce que Hack The Box appelle Agentic Operator Competence Scoring. Les scénarios testent si un praticien détecte les erreurs dans le raisonnement d'un agent et sait quand intervenir. La retenue est également notée, selon que quelqu'un laisse le travail piloté par l'IA s'exécuter alors qu'il n'a pas besoin d'être corrigé.

AI Range Enterprise Edition et les deux rôles augmentés par l'IA sont disponibles dès maintenant, avec davantage de rôles de cybersécurité prévus pour les mois à venir.

Newsletter

Rejoignez notre newsletter pour des astuces chaque semaine