Soumettre un événement
Dîner social du groupe de lecture AISHK : Apprentissage automatique et valeurs humaines

Dîner social du groupe de lecture AISHK : Apprentissage automatique et valeurs humaines

20 juil. 202618:30 - 21:30 Asia/Hong_KongHong Kong Island, Hong Kong, Hong Kong0 ParticipantsOpen

Description

Le mois dernier, nous avons examiné l'alignement AI-humain sous un angle : pourquoi il est si difficile de faire faire aux IA ce que les humains veulent. Ce mois-ci, nous nous tournons vers l'autre côté de l'équation : qu'en est-il de l'humain dans le problème d'alignement ?Extrait de The Alignment Problem: Machine Learning and Human Values de Brian Christian https://www.penguinrandomhouse.ca/books/201876/the-most-human-human-by-brian-christian/9780307476708/excerptTout comme il existe désormais des milliers de modèles d'IA subtilement différents avec des niveaux d'ouverture et de contrôles de sécurité variés, "l'humanité" se compose d'au moins 8 milliards de personnes vivantes, chacune possédant des niveaux différents de n'importe quelle caractéristique que vous pourriez nommer, même celles que nous considérons comme des traits humains "essentiels" (synchronisation émotionnelle, ambition, précision, flexibilité cognitive, identité, etc.). Donc, tout comme certaines personnes traitent les autres avec gentillesse et empathie (justifiées ou non), d'autres les traitent avec froideur, indifférence, ou une cruauté pure et simple (justifiée ou non).À une époque où des modèles simulent de manière convaincante l'empathie, la sympathie et d'autres traits "humains" doux, nous demandons : qu'est-ce qui rend les humains suffisamment humains ? La lecture de ce mois-ci est le premier chapitre du livre de Brian Christian, The Most Human Human : What Talking to Computers Teaches Us About What It Means to Be Alive. Écrit en 2011, avant que l'IA moderne n'atteigne la sophistication d'aujourd'hui, le livre pose néanmoins et ancre une question frappante : que signifie faire face à une concurrence dans une arène que nous n'avons jamais imaginé devoir défendre : être humain ?Lieu : Café du musée 8Les invités sont priés de faire au moins 1 achat au café.Questions de discussion :1. Aucun humain n'est amical, compréhensif, créatif ou encourageant tout le temps. Avez-vous déjà rencontré quelqu'un agissant de manière frustrante comme une "machine" traditionnelle, montrant peu d'empathie dans une situation difficile, peut-être en suivant rigidement "les règles énoncées" ? Que pourrait dire ou faire une IA à la place ? Le remplacement de cette personne par une IA aurait-il fait une différence, pour le meilleur ou pour le pire ?2. Lorsqu'on lui a demandé pourquoi il est si difficile de concevoir une poubelle à l'épreuve des ours, un ranger a répondu : "Il existe un chevauchement considérable entre l'intelligence des ours les plus intelligents et des touristes les plus stupides." Dans le même esprit, quel seuil minimal pourrions-nous fixer sur certaines caractéristiques morales, émotionnelles ou autres humaines de sorte que le moins humain des humains le dépasse toujours, tandis que l'IA la plus humaine ne le dépasse pas ? Et que signifierait-il pour nous si aucune ligne claire ne pouvait être tracée sur un principe raisonnable ?3. Les humains n'ont jamais été confrontés de manière crédible à la question de savoir s'ils sont "suffisamment humains". Une réponse de peur peut prendre la forme de lutte, de fuite, de gel ou de flatterie. Laquelle de ces réactions à l'IA avez-vous observée chez les autres ? Quelles avez-vous remarquées chez vous ?4. La peur peut être un motivateur productif. Qu'est-ce que l'IA pourrait nous pousser, nous humains, à améliorer ?5. Être humain, c'est être imparfait. Les ordinateurs étaient traditionnellement considérés comme "sans défaut" dans leurs tâches - et donc inhumains (pensez à une calculatrice et à l'arithmétique complexe). Que signifie maintenant que nous avons des IA qui sont également défaillantes de plusieurs manières ?Questions bonus :1. Tout le monde n'aime pas les autres personnes. Certains préfèrent une interaction minimale, surtout lorsqu'ils sont entourés d'une compagnie désagréable, et beaucoup trouvent du soulagement à parler à un inconnu qui n'offre que des réponses minimales - ou à un ordinateur - précisément parce que ni l'un ni l'autre ne portera un jugement moral. (Pour des portraits sympathiques de cet état d'esprit, consultez Rental Person Who Does Nothing de Shoji Morimoto ; pour des portraits peu sympathiques, consultez r/misanthropy.) Que pourrait impliquer ce fait sur l'humanité pour le problème d'alignement ?2. Le fait de ne pas aimer d'autres humains rend-il quelqu'un "moins" humain ?3. Une personne pourrait-elle détester l'humanité au point de devenir moins humaine qu'une IA ?Remarque : Pour saisir la qualité des chatbots en 2011 - le type d'"IA" contre lequel on concourt dans le prix Loebner - visitez A.L.I.C.Ebot (https://www.pandorabots.com/pandora/talk?botid=b8d616e35e36e881). Ceux qui découvrent le domaine peuvent remarquer à quel point "l'IA" était différente à l'époque, et pourquoi "la sécurité de l'IA" suscitait peu d'intérêt pour le grand public.Qui devrait venir ?Aucun bagage technique requis. Le Problème d'Alignement est écrit pour un public général, mêlant histoire, reportages et explications accessibles des idées clés en apprentissage automatique et éthique de l'IA. Que vous travailliez dans la politique, la gouvernance, la recherche, le droit, les affaires, ou que vous essayiez simplement de comprendre comment les systèmes d'IA façonnent déjà les décisions humaines, vous êtes le bienvenu.Venez prêts à examiner de réels systèmes, pas seulement des expériences de pensée abstraites, et à demander comment les leçons tirées des études de cas de Christian devraient informer le travail d'alignement et de sécurité ici à Hong Kong et au-delà.

Lieu de l`événement

Faites savoir à votre réseau que vous y allez

Partagez cet événement pour engager des conversations, inviter des collègues et vous connecter avant qu`il commence.

Événements similaires

Plateforme d’intelligence artificielle

Gratuit