
Rode teaming AI-agenten voordat ze worden verzonden
Beschrijving
Beveiligingsmaatregelen houden stand wanneer er iets misgaat — maar ze vertellen je niet of er iets mis zal gaan voordat je gebruikers het ontdekken. Daar is rode teaming voor. Hier is een patroon dat het Ejento-team vaak ziet: een agent passeert elke evaluatie, geeft nauwkeurige antwoorden, blijft gefocust — en wordt toch overgehaald om zijn eigen regels te overtreden door een gebruiker die weet hoe hij het kan beïnvloeden. Evaluatie vraagt "geeft deze agent goede antwoorden?" Rode teaming vraagt "kan ik het laten wangedragen?" Wat je zult leren:
Laat je netwerk weten dat je komt
Deel dit evenement om gesprekken te starten, collega`s uit te nodigen en van tevoren contact te leggen.
Platform voor kunstmatige intelligentie
Gratis
