PROBE Ocena Projektu Jam
Opis
Różnica między Zdolnością a Zweryfikowaną Bezpieczeństwem się powiększa Systémy AI stają się dostępne szybciej, niż możemy je oceniać. W międzyczasie organy regulacyjne w UE, USA, Singapurze i Chinach domagają się udokumentowanego testowania adversarialnego. Większość zespołów wciąż nie ma narzędzi ani metodologii, aby spełnić te wymagania. PROBE to praktyczna sesja projektowania oceny, w której spotykają się twórcy i badacze interesujący się bezpieczeństwem i zabezpieczeniem AI, aby dzielić się i współprojektować metody oceny. PROBE został zaprojektowany jako sesja dyskusyjna x robocza dla dzielenia się zestawami danych referencyjnych, sprzętem do testowania stresowego oraz narzędziami open-source, które społeczność może wykorzystywać podczas oceny agentów. Celem jest nawiązanie kontaktu z innymi twórcami i badaczami zainteresowanymi bezpieczeństwem AI oraz stworzenie grupy roboczej ds. zapewnienia AI. Kuratorzy: AI Safety Node/Ecomonitor (www.aisafetynode.com) i gospodarze z Ojin(https://ojin.ai/). **** Program i Grupa Robocza **** Prezentacje: Ludzie w Pętli x Ocena AI, Benchmark Badający Krawędzie w Dopasowaniu AI Ludzie w Pętli x Ocena AI Trevor Lohrbeer jest współzałożycielem AI Safety Berlin, przestrzeni coworkingowej i społeczności dla tych, którzy pracują nad zmniejszeniem ryzyka społecznego związane z AI w Berlinie, oraz niezależnym badaczem bezpieczeństwa AI, koncentrującym się na utrzymaniu ludzi w pętli podczas rekurencyjnego samodoskonalenia. Zanim stał się niezależny, spędził 16 miesięcy pracując z Redwood Research nad opracowaniem ocen kontroli AI oraz przeprowadzaniu badań nad podatnościami w trybie auto Claude Code, a także spędził 25 lat na zakładaniu i prowadzeniu startupów internetowych i programowych. Dowiedz się więcej o jego pracy nad bezpieczeństwem AI tutaj. Benchmark Badający Krawędzie w Dopasowaniu AI Florian Dietz jest badaczem dopasowania AI i konsultantem. Podzieli się swoją pracą nad stworzeniem benchmarku scenariuszy, które są Poza Zakresem (OOD) dla obecnych systemów AI LinkedIn Florianna: https://www.linkedin.com/in/floriandietz/Elective Sesje Sprintu Projektowego Projektowanie Testów Stresowych Ochrony Dziel się i pracuj nad projektowaniem oceny, które bada bariery ochronne, testuje mechanizmy odmowy oraz wyniki (jeśli dostępne są wcześniejsze oceny) Narzędzia Oceny + Infrastruktura Dyskutuj o narzędziach do oceny i infrastrukturze. Dziel się i pracuj nad wielokrotnie używalnymi narzędziami, kanałami metrycznymi oraz narzędziami raportowymi, które czynią testowanie adversarialne powtarzalnym, a nie jednorazowym. Harmonogram 18-19:00: Rozpoczęcie i gościnny wykład na temat metod oceny Prelegenci z AI Safety Hub w Berlinie oraz niezależnych firm badawczych omówią metody oceny i red teaming x agenty. 19:00 - 20:00: Sprint projektowy oceny: projekt oceny -> sprint wdrożenia 20:00-20:30: Podzielenie się pracą nad projektem oceny poprzez wystąpienie i wymianę badaczy. To wydarzenie jest otwarte dla wszystkich. Badacze bezpieczeństwa budujący adversarialne benchmarki oraz budowniczy agentów/ inżynierowie ML poszukujący narzędzi oceny będą szczególnie zainteresowani tym wieczorem. ******* O Ojin ******* Ojin AixHaus to nowy plac zabaw AI w Berlinie. Wspólna przestrzeń społecznościowa, w której spotykają się naukowcy, inżynierowie uczenia maszynowego, założyciele, twórcy i entuzjaści AI, aby wspólnie budować przyszłość AI. Ojin AixHaus jest bezpłatny do dołączenia, otwarty na aplikacje dla startupów w rezydencji i aktualnie tworzy kalendarz wydarzeń na 2026 rok. Jeśli masz palącą ideę na wydarzenie, spotkanie lub hackathon - przynieś swój ogień, a oni zapewnią przestrzeń! Dowiedz się więcej tutaj: Community Ojin AixHaus Śledź Ojin AixHaus w mediach społecznościowych: Instagram: https://www.instagram.com/ojin.ai/ LinkedIn: https://www.linkedin.com/showcase/ojin-aixhaus/?viewAsMember=true X: https://x.com/Ojin_AI Ecomonitor/AI Safety Node: AI Safety Node, inicjatywa Ecomonitor, łączy badaczy i twórców produktów w celu rozwoju bezpieczeństwa/zabezpieczeń AI oraz inicjatyw społecznościowych. Ecomonitor to studio badawcze koncentrujące się na złożonych ryzykach. Dowiedz się więcej o naszej pracy tutaj: LinkedIn: www.aisafetynode.com https://www.linkedin.com/company/ecomonitor/AI Inicjatywa Safety Node: www.aisafetynode.com
Lokalizacja wydarzenia
Daj swojej sieci znać, że idziesz
Udostępnij to wydarzenie, aby rozpocząć rozmowy, zaprosić kolegów i nawiązać kontakty przed jego rozpoczęciem.










