PROBE Evaluationsdesign-Jam
Beschreibung
Die Kluft zwischen Fähigkeit und verifizierter Sicherheit wird größer. Agentic AI-Systeme werden schneller ausgeliefert, als wir sie bewerten können. Inzwischen fordern Regulierungsbehörden in der EU, den USA, Singapur und China dokumentierte adversariale Tests. Die meisten Teams haben immer noch nicht die Werkzeuge oder die Methodik, um diesen Standard zu erfüllen. PROBE ist ein praktischer Evaluationsdesign-Jam, bei dem Entwickler und Forscher, die sich für AI-Sicherheit und -Sicherheit interessieren, zusammenkommen, um Bewertungsmethoden zu teilen und gemeinsam zu entwerfen. PROBE ist als Diskussions- und Arbeitssitzung konzipiert, um Benchmark-Datensätze, Stresstest-Harness und Open-Source-Werkzeuge auszutauschen, auf die die Gemeinschaft zurückgreifen kann, während sie Agenten bewertet. Das Ziel ist es, Kontakt mit anderen Entwicklern und Forschern herzustellen, die an AI-Sicherheit und -Sichereheit interessiert sind, und eine Arbeitsgruppe für AI-Sicherheit zu schaffen. Kuratiert von AI Safety Node/Ecomonitor (www.aisafetynode.com) und veranstaltet mit Ojin(https://ojin.ai/). **** Programm und Arbeitsgruppe **** Vorträge: Mensch im Prozess x AI-Bewertung, Benchmark zur Erkundung von Grenzfällen in der AI-Ausrichtung. Menschen im Prozess x AI-Bewertung Trevor Lohrbeer ist Mitbegründer von AI Safety Berlin, einem Coworking- und Gemeinschaftszentrum für diejenigen, die gesellschaftliche Risiken durch AI in Berlin verringern möchten, und ein unabhängiger AI-Sicherheitsforscher, der sich darauf konzentriert, Menschen während der rekursive Selbstverbesserung im Prozess zu halten. Vor seiner Unabhängigkeit arbeitete er 16 Monate mit Redwood Research, um AI-Kontrolle Bewertungen zu entwickeln und führte Schwachstellenforschung zum Claude-Code-Automodus durch und gründete und leitete 25 Jahre Internet- und Software-Startups. Erfahren Sie mehr über seine Arbeiten zur AI-Sicherheit hier. Ein Benchmark zur Erkundung von Grenzfällen in der AI-Ausrichtung Florian Dietz ist AI-Ausrichtungsforscher und Berater. Er wird seine Arbeit zur Erstellung eines Benchmarks von Szenarien vorstellen, die Out-Of-Distribution (OOD) für aktuelle AI-Systeme sind. Florians Linkedin: https://www.linkedin.com/in/floriandietz/Elective Design Sprint-Sitzungen. Sicherheits-Testdesign Teilen und Arbeiten an Evaluationsdesign, das Leitplanken prüft, Testverweigerungsmechanismen und Ergebnisse (sofern frühere Bewertungen verfügbar sind). Evaluierungswerkzeuge + Infrastruktur Diskutieren Sie Evaluierungswerkzeuge und Infrastruktur. Teilen und arbeiten Sie an wiederverwendbaren Harnesses, Metrik-Pipelines und Berichterstattungstools, die adversariale Tests wiederholbar und nicht einmalig machen. Zeitplan 18-19:00: Kick-off und Gastredner über Evaluationsmethoden. Referenten von AI Safety Hub in Berlin und unabhängigen Forschungsfirmen diskutieren Evaluationsmethoden und Red-Teaming x agentic Harnesses. 19:00 - 20:00: Evaluationsdesign-Sprint: Evaluationsdesign-> Implementierungssprint 20:00-20:30: Teile die Evaluationsdesignarbeit durch Standup und Forscher-Austausch. Diese Veranstaltung ist für alle offen. Sicherheitsforscher, die adversariale Benchmarks erstellen, und Agentenentwickler/ML-Ingenieure, die Evaluierungswerkzeuge erkunden, werden den Abend besonders relevant finden. ******* Über Ojin ******* Ojin AixHaus ist der neue AI-Spielplatz in Berlin. Ein kollaborativer Gemeinschaftsraum, in dem Wissenschaftler, Machine-Learning-Ingenieure, Gründer, Kreative und AI-Enthusiasten zusammenkommen, um die Zukunft der AI zu gestalten. Ojin AixHaus ist kostenlos beizutreten, offen für Anträge von Startups in Residenz und kuratiert derzeit seinen Veranstaltungskalender für 2026. Wenn Sie eine brennende Idee für eine Veranstaltung, ein Meetup oder einen Hackathon haben - bringen Sie Ihr Feuer mit, wir bringen den Raum! Hier erfahren Sie mehr: Ojin AixHaus-Community Folgen Sie Ojin AixHaus in sozialen Medien: Instagram: https://www.instagram.com/ojin.ai/ Linkedin: https://www.linkedin.com/showcase/ojin-aixhaus/?viewAsMember=true X: https://x.com/Ojin_AI Ecomonitor/AI Safety Node: AI Safety Node, eine Initiative von Ecomonitor, bringt Forscher und Produktentwickler zusammen für AI-Sicherheits/-Sicherheitsentwicklung und Gemeinschaftsinitiativen. Ecomonitor ist ein Forschungsstudio, das sich auf komplexe Risiken konzentriert. Erfahren Sie mehr über unsere Arbeit hier: LinkedIn: www.aisafetynode.com https://www.linkedin.com/company/ecomonitor/AI Sicherheitsnode-Initiative: www.aisafetynode.com
Veranstaltungsort
Lassen Sie Ihr Netzwerk wissen, dass Sie dabei sind
Teilen Sie diese Veranstaltung, um Gespräche zu beginnen, Kollegen einzuladen und sich vorab zu vernetzen.










