Soumettre un événement
PROBE Jam de Conception d'Évaluation

PROBE Jam de Conception d'Évaluation

08 oct. 202618:00 - 21:30 Europe/BerlinBerlin, Germany7 ParticipantsOpen

Description

L'écart entre la capacité et la sécurité vérifiée se creuse. Les systèmes d'IA agentiques sont lancés plus rapidement que nous ne pouvons les évaluer. Pendant ce temps, les régulateurs de l'UE, des États-Unis, de Singapour et de la Chine exigent des tests adversariaux documentés. La plupart des équipes n'ont toujours pas les outils ou la méthodologie nécessaires pour atteindre ce niveau d'exigence. PROBE est un jam de conception d'évaluation pratique où les créateurs et les chercheurs soucieux de la sécurité et de la sûreté de l'IA se réunissent pour partager et co-concevoir des méthodes d'évaluation. PROBE est conçu comme une session de discussion et de travail pour partager des ensembles de données de référence, des harnais de tests de résistance et des outils open source auxquels la communauté peut se référer lors de l'évaluation des agents. L'objectif est de se connecter avec d'autres créateurs et chercheurs intéressés par la sécurité et la garantie de l'IA - et de créer un groupe de travail pour l'assurance de l'IA. Curaté par AI Safety Node/Ecomonitor (www.aisafetynode.com) et hébergé avec Ojin(https://ojin.ai/). **** Programme et Groupe de Travail **** Conférences : Humain dans la Boucle x Évaluation de l'IA, Exploration de Benchmark sur les Cas Limites dans l'Ajustement IA Humains dans la Boucle x Évaluation de l'IA Trevor Lohrbeer est co-fondateur d'AI Safety Berlin, un espace de coworking et un hub communautaire pour ceux qui travaillent à réduire les risques sociétaux liés à l'IA à Berlin, et chercheur indépendant en sécurité de l'IA axé sur le maintien des humains dans la boucle lors de l'amélioration récursive. Avant de devenir indépendant, il a passé 16 mois à travailler avec Redwood Research sur le développement d'évaluations de contrôle de l'IA et sur la recherche de vulnérabilités sur le mode auto de Claude Code, et a fondé et dirigé des startups Internet et logiciels pendant 25 ans. En savoir plus sur son travail en matière de sécurité de l'IA ici. Un Benchmark explorant les Cas Limites dans l'Ajustement de l'IA Florian Dietz est chercheur en ajustement de l'IA et consultant. Il partagera son travail sur la création d'un benchmark de scénarios qui sont hors distribution (OOD) pour les systèmes d'IA actuels. Linkedin de Florian : https://www.linkedin.com/in/floriandietz/Elective Sessions de Design Sprint Conception de Tests de Stress de Sauvegarde Partager et travailler sur la conception d'évaluation qui sonde les garde-fous, teste les mécanismes de refus et les résultats (si des évaluations précédentes sont disponibles) Outils d'Évaluation + Infra Discuter des outils d'évaluation et de l'infrastructure. Partager et travailler sur des harnais réutilisables, des pipelines de métriques et des outils de reporting qui rendent les tests adversariaux répétables, et non ponctuels. Programme 18-19:00 : Lancement et conférencier invité sur la méthode d'évaluation Intervenants de l'AI Safety Hub à Berlin et de sociétés de recherche indépendantes pour discuter des méthodes d'évaluation et des thérapies rouges x harnais agentiques. 19:00 - 20:00 : Sprint de conception d'évaluation : conception d'évaluation -> sprint d'implémentation 20:00-20:30 : Partager le travail de conception d'évaluation à travers un stand-up et un échange de chercheurs. Cet événement est ouvert à tous. Les chercheurs en sécurité travaillant sur des benchmarks adversariaux et les créateurs d'agents / ingénieurs ML explorant les outils d'évaluation trouveront la soirée particulièrement pertinente. ******* À Propos d'Ojin ******* Ojin AixHaus est le nouveau terrain de jeu de l'IA à Berlin. Un espace communautaire collaboratif où scientifiques, ingénieurs en apprentissage automatique, fondateurs, créateurs et passionnés d'IA se réunissent pour construire l'avenir de l'IA. Ojin AixHaus est gratuit pour rejoindre, ouvert aux candidatures de startups en résidence et est actuellement en train de curer son calendrier d'événements 2026. Si vous avez une idée brûlante pour un événement, une rencontre ou un hackathon - apportez votre enthousiasme, ils apportent l'espace ! En savoir plus ici : Communauté Ojin AixHaus Suivez Ojin AixHaus sur les réseaux sociaux : Instagram : https://www.instagram.com/ojin.ai/ Linkedin : https://www.linkedin.com/showcase/ojin-aixhaus/?viewAsMember=true X : https://x.com/Ojin_AI Ecomonitor/AI Safety Node : AI Safety Node, une initiative d'Ecomonitor, rassemble des chercheurs et des développeurs de produits pour le développement de la sécurité / sécurité de l'IA et des initiatives communautaires. Ecomonitor est un studio de recherche axé sur les risques complexes. En savoir plus sur notre travail ici : LinkedIn : www.aisafetynode.com https://www.linkedin.com/company/ecomonitor/AI Initiative Safety Node : www.aisafetynode.com

Lieu de l`événement

Faites savoir à votre réseau que vous y allez

Partagez cet événement pour engager des conversations, inviter des collègues et vous connecter avant qu`il commence.

Événements similaires

Plateforme d’intelligence artificielle

Gratuit
S`inscrire gratuitement