
Grupa Czytelnicza Bezpieczeństwa AI: CODA
Opis
W tym tygodniu będziemy omawiać artykuł: "Mierzenie Dążeń Nagród poprzez Wprowadzanie Kontrastowych Przekonań".Zapewniamy pizzę! Jeśli nie masz dostępu do CODA, przyjdź najpóźniej do 16:55. Inicjatywa Bezpieczeństwa AI na Georgia Tech to społeczność badaczy technicznych i politycznych w Georgia Tech, mająca na celu redukcję ryzyka związanego z zaawansowaną sztuczną inteligencją. Skupiamy się więc na takich tematach jak: Nasza niedawna praca obejmuje AuditBench: Ocena Technik Audytu Zgodności w Modelach z Ukrytymi Zachowaniami oraz Niezależną Ewaluację Bezpieczeństwa Kimi K2.5. Szczegółowy przegląd naszych badań można znaleźć tutaj. Celem tej grupy czytelniczej jest wprowadzenie utalentowanych badaczy technicznych z GT w powyższe problemy, aktualne podejścia/rozwiązania oraz narodziny i realizacja wpływowych badań. Szczegóły przeszłych spotkań tutaj.
Lokalizacja wydarzenia
Daj swojej sieci znać, że idziesz
Udostępnij to wydarzenie, aby rozpocząć rozmowy, zaprosić kolegów i nawiązać kontakty przed jego rozpoczęciem.
