
Cena social del grupo de lectura AISHK: Aprendizaje automático y valores humanos
Descripción
El mes pasado, examinamos la alineación entre IA y humanos desde un ángulo: por qué es tan difícil hacer que las IA hagan lo que los humanos quieren. Este mes, nos dirigimos al otro lado de la ecuación: ¿qué pasa con el humano en el problema de alineación? El problema de alineación de Brian Christian: Aprendizaje automático y valores humanos (extracto) https://www.penguinrandomhouse.ca/books/201876/the-most-human-human-by-brian-christian/9780307476708/excerpt Así como ahora hay miles de modelos de IA sutilmente diferentes con diversos niveles de apertura y controles de seguridad, la "humanidad" comprende al menos 8 mil millones de personas vivas, cada una poseyendo diferentes niveles de cualquier atributo que podrías nombrar, incluso aquellos que consideramos rasgos humanos "clave" (sintonización emocional, ambición, precisión, flexibilidad cognitiva, identidad, etc.). Así como algunas personas tratan a otras con amabilidad y empatía (justificada o no), otras las tratan con frialdad, indiferencia o crueldad abierta (justificada o no). En una época de modelos que simulan convincentemente la empatía, la simpatía y otros rasgos "humanos" suaves, nos preguntamos: ¿qué hace que los humanos sean lo suficientemente humanos? La lectura de este mes es el primer capítulo del libro de Brian Christian, El humano más humano: Lo que hablar con computadoras nos enseña sobre lo que significa estar vivo. Escrito en 2011, antes de que la IA moderna alcanzara la sofisticación de hoy, el libro plantea y fundamenta una pregunta sorprendente: ¿qué significa enfrentarse a la competencia en un terreno que nunca esperábamos defender: ser humano? Lugar: Café del museo 8 Se solicita a los invitados hacer al menos 1 compra en el café. Preguntas de discusión: 1. Ningún humano es amable, comprensivo, creativo o alentador todo el tiempo. ¿Alguna vez has encontrado a alguien actuando frustrantemente como una "máquina" tradicional, mostrando poca empatía en una situación difícil, tal vez siguiendo rígidamente "las reglas establecidas"? ¿Qué podría haber dicho o hecho una IA en su lugar? ¿Habría hecho alguna diferencia reemplazar a esa persona con una IA, para mejor o para peor? 2. Al ser preguntado por qué es tan difícil diseñar un contenedor de basura a prueba de osos, un guardabosques respondió una vez: "Hay un solapamiento considerable entre la inteligencia de los osos más inteligentes y los turistas más tontos." En el mismo espíritu, ¿qué umbral mínimo podríamos establecer sobre algún atributo humano moral, emocional u otro, de modo que el menos humano de los humanos lo supere, pero la IA más humana no lo haga? ¿Y qué significaría para nosotros si no se pudiera trazar una línea clara sobre ningún principio razonable? 3. Nunca antes se había desafiado de manera creíble a los humanos a ser "suficientemente humanos". Una respuesta de miedo puede tomar la forma de luchar, huir, congelarse o complacer. ¿Cuál de estas reacciones a la IA has observado en otros? ¿Cuál has notado en ti mismo? 4. El miedo puede ser un motivador productivo. ¿Qué podría llevar a la IA a empujarnos a nosotros, los humanos, a esforzarnos por mejorar? 5. Ser humano es ser imperfecto. Tradicionalmente, las computadoras se consideraban "impecables" en sus tareas y, por lo tanto, inhumanas (piensa en una calculadora y la aritmética compleja). ¿Qué significa ahora que tenemos IA que también son imperfectas de muchas maneras? Preguntas adicionales: 1. No a todos les gusta la gente. Algunos prefieren una interacción mínima, especialmente cuando se encuentran rodeados de compañía desagradable, y muchos encuentran alivio al hablar con un extraño que ofrece solo respuestas mínimas, o con una computadora, precisamente porque ninguno de los dos emitirá juicio moral. (Para retratos simpáticos de esta mentalidad, consulta a Shoji Morimoto y su Persona de Alquiler que No Hace Nada; para retratos poco simpáticos, consulta r/misanthropy). ¿Qué podría implicar este hecho sobre la humanidad para el problema de alineación? 2. ¿Desagradar a otros humanos hace que uno sea "menos" humano? 3. ¿Podría una persona desagradar a la humanidad tanto que se convirtiera en menos humana que una IA? Nota: Para tener una idea de la calidad de los chatbots en 2011, el tipo de "IA" que se competía en el Premio Loebner, visita A.L.I.C.Ebot (https://www.pandorabots.com/pandora/talk?botid=b8d616e35e36e881). Aquellos nuevos en el campo pueden notar cuán diferente era entonces "la IA", y por qué "la seguridad de la IA" no despertaba mucho interés por parte del público en general. ¿Quién debería asistir? No se requiere experiencia técnica. El Problema de Alineación está escrito para una audiencia general, combinando historia, reportes y explicaciones accesibles de ideas clave en aprendizaje automático y ética de la IA. Ya sea que trabajes en políticas, gobernanza, investigación, leyes, negocios o simplemente intentes entender cómo los sistemas de IA ya están moldeando las decisiones humanas, eres bienvenido. Ven preparado para analizar sistemas reales, no solo experimentos de pensamiento abstracto, y para preguntar cómo las lecciones de los estudios de caso de Christian deberían informar el trabajo de alineación y seguridad aquí en Hong Kong y más allá.
Ubicación del evento
Dile a tu red que vas a ir
Comparte este evento para iniciar conversaciones, invitar colegas y conectar antes de que comience.
