
Cuando una IA Alineada Sigue Cometiendo Errores
Descripción
¿Qué pasaría si una IA es perfectamente obediente... y ese es exactamente el problema? Una IA puede seguir fielmente cada instrucción de su operador y aún así producir resultados que a la sociedad no le gustan. Si eso es posible, entonces quizás la alineación de la IA no solo se trata de construir mejores sistemas de IA. Quizás también se trata de las organizaciones, incentivos e instituciones detrás de ellos. Esta es la idea central detrás de la alineación de pila completa: alinear no solo los sistemas de IA, sino el ecosistema más amplio en el que operan. Leamos y discutamos "Alineación de Pila Completa: De la Alineación de IA a la Alineación Societal", que argumenta que alinear la IA requiere mirar más allá del modelo en sí. Los autores proponen que los enfoques actuales para representar los valores humanos son demasiado simplistas, e introducen "modelos gruesos de valor" como una forma más rica para que la IA razone sobre valores, normas e intereses colectivos. Luego llevaremos la discusión más allá del artículo. Si la sociedad misma rara vez está de acuerdo sobre lo que es correcto, ¿debería esperarse que la IA lo esté? ¿Quién decide qué debe optimizar una IA? Y cuando las organizaciones y la sociedad no están de acuerdo, ¿a quién debería servir la IA en última instancia? ❗Por Favor, Lea Antes de Registrarse❗ Esto no es un seminario o una conferencia. Es una discusión, y todos en la sala son parte de ella. Más Sobre el Anfitrión Jared Cheang es un investigador en Seguridad de IA con experiencia en ciencia de datos, ingeniería de software y construcción de soluciones de IA para el sector público. Sus intereses de investigación actuales abarcan el control de IA, alineación y seguridad por diseño, con un interés particular en cómo los sistemas de IA cada vez más capaces pueden seguir siendo confiables y alineados con los valores humanos. Jared también enseña y mentorea a la comunidad tecnológica local, y posee una Maestría en Analítica de Negocios de la NUS. Más Sobre la Serie Paper Club es la iniciativa impulsada por la comunidad de Lorong AI donde los miembros se reúnen para discutir y analizar artículos académicos, artículos de investigación o desarrollos clave en IA. Involúcrate: Aprende más sobre Lorong AI | Registro de Ponentes | Comunidad de WhatsApp | LinkedIn | X
Ubicación del evento
Dile a tu red que vas a ir
Comparte este evento para iniciar conversaciones, invitar colegas y conectar antes de que comience.