
Pruebas de tipo rojo en agentes de IA antes de ser lanzados
Descripción
Las barreras mantienen el control cuando algo sale mal, pero no te dicen si algo saldrá mal antes de que tus usuarios lo descubran. Para eso está el red teaming. Aquí hay un patrón que el equipo de Ejento ve a menudo: un agente pasa cada evaluación, responde con precisión, se mantiene en su base — y aún así es convencido de romper sus propias reglas por un usuario que sabe cómo presionarlo. La evaluación pregunta "¿este agente da buenas respuestas?" El red teaming pregunta "¿puedo hacerlo comportarse mal?" Lo que aprenderás:
Dile a tu red que vas a ir
Comparte este evento para iniciar conversaciones, invitar colegas y conectar antes de que comience.
Plataforma de inteligencia artificial
Gratis
