
Quand une IA Alignée se Trompe Encore
Description
Que se passerait-il si une IA était parfaitement obéissante... et que c'était exactement le problème ?Une IA peut suivre fidèlement chaque instruction de son opérateur et produire néanmoins des résultats que la société n’apprécie pas. Si cela est possible, alors peut-être que l'alignement de l'IA ne consiste pas seulement à construire de meilleurs systèmes d'IA. Peut-être s'agit-il aussi des organisations, des incitations et des institutions qui les soutiennent. C'est l'idée centrale derrière l'alignement complet : aligner non seulement les systèmes d'IA, mais également l'écosystème plus large dans lequel ils opèrent.Lisons et discutons de "Alignement Complet : De l'Alignement de l'IA à l'Alignement Sociétal", qui soutient que l'alignement de l'IA nécessite de regarder au-delà du modèle lui-même. Les auteurs proposent que les approches d'aujourd'hui pour représenter les valeurs humaines sont trop simplistes et introduisent les "modèles épais de valeurs" comme une manière plus riche pour l'IA de raisonner sur les valeurs, les normes et les intérêts collectifs.Ensuite, nous allons emmener la discussion au-delà du document. Si la société elle-même ne s'accorde que rarement sur ce qui est juste, faut-il s'attendre à ce que l'IA le fasse ? Qui décide ce qu'une IA devrait optimiser ? Et lorsque les organisations et la société ne s'accordent pas, qui l'IA doit-elle finalement servir ?❗Veuillez lire avant de vous inscrire❗Ceci n'est pas un séminaire ou une conférence. C'est une discussion, et chacun dans la salle en fait partie.Plus sur l'HôteJared Cheang est un chercheur en sécurité de l'IA avec un parcours en science des données, ingénierie logicielle et développement de solutions d'IA pour le secteur public. Ses intérêts de recherche actuels englober l'IA contrôle, alignement et sécurité par conception, avec un intérêt particulier pour comment des systèmes d'IA de plus en plus capables peuvent rester fiables et alignés avec les valeurs humaines. Jared enseigne également et fait du mentorat au sein de la communauté technologique locale, et détient une maîtrise en analytique commerciale de NUS.Plus sur la SériePaper Club est l'initiative communautaire de Lorong AI où les membres se rassemblent pour discuter et analyser des articles académiques, des recherches, ou des développements clés en IA.
Lieu de l`événement
Faites savoir à votre réseau que vous y allez
Partagez cet événement pour engager des conversations, inviter des collègues et vous connecter avant qu`il commence.