
Quando uma IA Alinhada Ainda Dá Errado
Descrição
E se uma IA for perfeitamente obediente... e esse for exatamente o problema? Uma IA pode seguir fielmente todas as instruções de seu operador e ainda assim produzir resultados que a sociedade desaprova. Se isso é possível, então talvez o alinhamento da IA não se trate apenas de construir melhores sistemas de IA. Talvez também se trate das organizações, incentivos e instituições que estão por trás deles. Esta é a ideia central por trás do alinhamento de pilha completa: alinhar não apenas os sistemas de IA, mas o ecossistema mais amplo em que operam. Vamos ler e discutir "Alinhamento de Pilha Completa: Do Alinhamento de IA ao Alinhamento Societal", que argumenta que alinhar a IA requer olhar além do modelo em si. Os autores propõem que as abordagens de hoje para representar valores humanos são simplistas demais e introduzem "modelos grossos de valor" como uma forma mais rica para a IA raciocinar sobre valores, normas e interesses coletivos. Em seguida, levaremos a discussão além do artigo. Se a própria sociedade raramente concorda sobre o que é certo, a IA deve ser esperada a fazê-lo? Quem decide pelo que uma IA deve otimizar? E quando organizações e sociedade discordam, a quem a IA deve servir, em última instância? ❗Por Favor Leia Antes de se Registrar❗ Este não é um seminário ou palestra. É uma discussão, e todos na sala fazem parte dela. Mais Sobre o Anfitrião Jared Cheang é um pesquisador de Segurança em IA com experiência em ciência de dados, engenharia de software e construção de soluções de IA para o setor público. Seus interesses de pesquisa atuais abrangem controle de IA, alinhamento e segurança por design, com um interesse particular em como sistemas de IA cada vez mais capazes podem permanecer confiáveis e alinhados com os valores humanos. Jared também ensina e orienta na comunidade tecnológica local, e possui um Mestrado em Análise de Negócios pela NUS. Mais Sobre a Série O Paper Club é a iniciativa voltada pela comunidade da Lorong AI, onde os membros se reúnem para discutir e analisar artigos acadêmicos, artigos de pesquisa ou desenvolvimentos-chave em IA. Participe: Saiba mais sobre a Lorong AI | Inscreva-se como Palestrante | Comunidade do WhatsApp | LinkedIn | X
Localização do evento
Diga à sua rede que vai participar
Partilhe este evento para iniciar conversas, convidar colegas e conectar-se antes que comece.