Enviar evento
Discusión sobre el artículo de investigación

Discusión sobre el artículo de investigación

24 sep. 202617:15 - 18:45 Europe/StockholmUppsala, Sweden23 AsistentesOpen

Descripción

Discusión del artículo sobre Interpretabilidad Mecanística - Identificación de conceptos y algoritmos interpretable por humanos en LLMs Lee algunos de los titulares de IA de las últimas semanas. Si aún piensas que la interpretabilidad y mejorar nuestra comprensión de los LLMs no son importantes, léelos de nuevo. En general, la interpretabilidad mecanística tiene como objetivo descubrir, entender y verificar los algoritmos que implementan los pesos del modelo mediante ingeniería inversa de la computación del modelo en componentes comprensibles para los humanos. Específicamente, queremos ver el artículo 'Interpretabilidad en el Mundo' en esta sesión (https://openreview.net/pdf?id=NpsVSN6o4ul). Identifica un circuito para la identificación de objetos indirectos en el modelo pequeño GPT-2, y ha sido una prueba de concepto influyente en el mundo real en el campo. Antes de la sesión, por favor lee el artículo (https://openreview.net/pdf?id=NpsVSN6o4ul). Cuantas más preguntas tengas después de leer, más productiva será la sesión. También puedes echar un vistazo a este capítulo del curso de interpretabilidad más práctico sobre el mismo artículo: https://learn.arena.education/chapter1_transformer_interp/21_ioi/intro.

Ubicación del evento

Dile a tu red que vas a ir

Comparte este evento para iniciar conversaciones, invitar colegas y conectar antes de que comience.

Eventos relacionados

Plataforma de inteligencia artificial

Gratis
Registrarse gratis