
Tests d'attaque des agents IA avant leur déploiement
Description
Les garde-fous tiennent lorsque quelque chose ne va pas — mais ils ne vous disent pas si quelque chose va mal avant que vos utilisateurs ne le découvrent. C'est à cela que sert le red teaming. Voici un schéma que l'équipe d'Ejento voit souvent : un agent réussit tous les évaluations, répond avec précision, reste ancré — et se laisse toujours convaincre de briser ses propres règles par un utilisateur qui sait comment le pousser. L'évaluation demande "cet agent donne-t-il de bonnes réponses ?" Le red teaming demande "puis-je le faire mal se comporter ?" Ce que vous apprendrez :
Faites savoir à votre réseau que vous y allez
Partagez cet événement pour engager des conversations, inviter des collègues et vous connecter avant qu`il commence.
Plateforme d’intelligence artificielle
Gratuit
