
Jantar Social do Grupo de Leitura AISHK: Aprendizado de Máquina e Valores Humanos
Descrição
No mês passado, examinamos o alinhamento entre IA e humanos sob um ângulo: por que é tão difícil fazer com que as IAs façam o que os humanos querem. Neste mês, voltamos para o outro lado da equação—o que dizer do humano no problema do alinhamento? O Problema do Alinhamento de Brian Christian: Aprendizado de Máquina e Valores Humanos (excerto) Assim como agora existem milhares de modelos de IA sutilmente diferentes, com níveis variados de abertura e controles de segurança, "humanidade" compreende pelo menos 8 bilhões de pessoas vivas, cada uma possuindo diferentes níveis de qualquer atributo que você possa nomear—até mesmo aqueles que consideramos "características" humanas “centrais” (sintonia emocional, ambição, precisão, flexibilidade cognitiva, identidade, e assim por diante). Assim como algumas pessoas tratam as outras com bondade e empatia (justificada ou não), outras as tratam com frieza, indiferença ou pura crueldade (justificada ou não). Em uma era de modelos que simulam convincentemente empatia, simpatia e outros traços "humanos" suaves, perguntamos: o que torna os humanos humanos o suficiente? A leitura deste mês é o primeiro capítulo de O Mais Humano Humano de Brian Christian: O Que Conversar com Computadores Nos Ensina Sobre o Que Significa Estar Vivo. Escrito em 2011, antes que a IA moderna alcançasse a sofisticação de hoje, o livro, no entanto, propõe e fundamenta uma pergunta marcante—o que significa enfrentar competição em uma arena que nunca esperávamos defender: ser humano? Local: Museu Café 8 Os convidados são solicitados a fazer pelo menos 1 compra no café. Questões para discussão: 1. Nenhum humano é gentil, compreensivo, criativo ou encorajador o tempo todo. Você já encontrou alguém agindo de forma frustrante como uma "máquina" tradicional—mostrando pouca empatia em uma situação difícil, talvez seguindo rigidamente "as regras estabelecidas"? O que uma IA poderia ter dito ou feito em vez disso? Substituir essa pessoa por uma IA teria feito alguma diferença, para melhor ou pior? 2. Questionado sobre por que é tão difícil projetar uma lixeira à prova de ursos, um guarda florestal respondeu uma vez: "Há uma considerável sobreposição entre a inteligência dos ursos mais inteligentes e dos turistas mais bobos." No mesmo espírito, qual seria o mínimo que poderíamos estabelecer em algum atributo moral, emocional ou outro humano para que o menos humano humano ainda o passage, enquanto a IA mais humana não? E o que isso significaria para nós se nenhuma linha clara pudesse ser traçada em qualquer princípio razoável? 3. Os humanos nunca foram desafiados de forma credível a serem "humanos o suficiente." Uma resposta de medo pode assumir a forma de luta, fuga, congelamento ou subserviência. Quais dessas reações à IA você já observou em outros? Quais você notou em si mesmo? 4. O medo pode ser um motivador produtivo. O que a IA pode nos incentivar a melhorar como humanos? 5. Ser humano é ser imperfeito. Os computadores eram tradicionalmente considerados "infalíveis" em suas tarefas—e, portanto, desumanos (pense em uma calculadora e aritmética complexa). O que isso significa agora que temos IAs que também são falhas de muitas maneiras? Questões bônus: 1. Nem todo mundo gosta de outras pessoas. Alguns preferem interações mínimas, especialmente quando cercados por companhia desagradável, e muitos encontram alívio em conversar com um estranho que oferece apenas respostas mínimas—ou com um computador—precisamente porque nenhum deles fará julgamento moral. (Para retratos simpáticos dessa mentalidade, veja a pessoa de aluguel de Shoji Morimoto que não faz nada; para retratos não simpáticos, veja r/misanthropy.) O que esse fato sobre a humanidade pode implicar para o problema do alinhamento? 2. Deslikar de outros humanos faz alguém "menos" humano? 3. Uma pessoa poderia não gostar tanto da humanidade que se tornaria menos humana do que uma IA? Nota: Para ter uma noção da qualidade do chatbot em 2011—o tipo de "IA" que estava competindo no Prêmio Loebner—visite A.L.I.C.Ebot (https://www.pandorabots.com/pandora/talk?botid=b8d616e35e36e881). Aqueles novos no campo podem notar como a "IA" era diferente naquela época e por que "segurança de IA" despertava pouco interesse no público geral. Quem deve participar? Nenhum conhecimento técnico é necessário. O Problema do Alinhamento é escrito para um público geral, misturando história, reportagens e explicações acessíveis de ideias-chave em aprendizado de máquina e ética da IA. Quer você trabalhe em políticas, governança, pesquisa, direito, negócios, ou simplesmente esteja tentando entender como os sistemas de IA já estão moldando decisões humanas, você é bem-vindo. Venha preparado para examinar sistemas reais, não apenas experimentos de pensamento abstratos, e para perguntar como as lições dos estudos de caso de Christian devem informar o trabalho de alinhamento e segurança aqui em Hong Kong e além.
Localização do evento
Diga à sua rede que vai participar
Partilhe este evento para iniciar conversas, convidar colegas e conectar-se antes que comece.


![[Almoço e Aprendizado] Navegando na Próxima Fase de Crescimento Transfronteiriço e Finanças em IA](https://aiprojects.nyc3.cdn.digitaloceanspaces.com/allai/banners/ai_data/49.jpg)

![[Série de Palestras Preface] Agentes de IA em Fluxos de Trabalho Organizacionais](https://images.lumacdn.com/uploads/mx/2912c929-8ae2-4af2-8c27-7f047617e280.png)


