
AISHK Lesegruppe Soziale Abendessen: Maschinelles Lernen und menschliche Werte
Beschreibung
Im letzten Monat haben wir das Thema der KI-Menschen-Ausrichtung aus einer Perspektive betrachtet: Warum es so schwierig ist, KIs dazu zu bringen, das zu tun, was Menschen wollen. In diesem Monat wenden wir uns der anderen Seite der Gleichung zu – was ist mit dem Menschen im Ausrichtungsproblem? Brian Christians Das Ausrichtungsproblem: Maschinelles Lernen und menschliche Werte (Auszug) https://www.penguinrandomhouse.ca/books/201876/the-most-human-human-by-brian-christian/9780307476708/excerpt So wie es inzwischen tausende subtil unterschiedlicher KI-Modelle mit unterschiedlichen Offenheits- und Sicherheitskontrollen gibt, umfasst die "Menschheit" mindestens 8 Milliarden lebende Menschen, jeder mit unterschiedlichen Ausprägungen von Attributen, die man benennen könnte – selbst solchen, die wir als "grundlegend" menschliche Eigenschaften betrachten (emotionale Abstimmung, Ehrgeiz, Präzision, kognitive Flexibilität, Identität usw.). So behandeln einige Menschen andere mit Freundlichkeit und Empathie (gerechtfertigt oder nicht), während andere sie mit Kälte, Gleichgültigkeit oder offenbarer Grausamkeit behandeln (gerechtfertigt oder nicht). In einem Zeitalter von Modellen, die Empathie, Mitgefühl und andere sanfte "menschliche" Eigenschaften überzeugend simulieren, fragen wir: Was macht Menschen menschlich genug? Die Lektüre in diesem Monat ist das erste Kapitel von Brian Christians Das menschlichste menschliche Wesen: Was uns das Reden mit Computern über das Leben lehrt. Geschrieben im Jahr 2011, bevor moderne KI die heutige Komplexität erreichte, stellt das Buch dennoch eine bemerkenswerte Frage – was bedeutet es, in einem Bereich mit Wettbewerb konfrontiert zu werden, den wir nie zu verteidigen erwarteten: Mensch zu sein? Veranstaltungsort: Museum Café 8 Die Gäste werden gebeten, mindestens einen Kauf im Café zu tätigen. Diskussionsfragen: 1. Kein Mensch ist immer freundlich, verständnisvoll, kreativ oder ermutigend. Haben Sie jemals jemanden getroffen, der frustrierend wie eine traditionelle "Maschine" handelte – dabei wenig Empathie in einer schwierigen Situation zeigte, vielleicht indem er "die festgelegten Regeln" starr befolgte? Was hätte eine KI stattdessen gesagt oder getan? Hätte es einen Unterschied gemacht, diese Person durch eine KI zu ersetzen, zum Besseren oder Schlechteren? 2. Ein Park Ranger antwortete einmal auf die Frage, warum es so schwierig sei, einen bärenfesten Müllcontainer zu entwerfen: "Es gibt erhebliche Überschneidungen zwischen der Intelligenz der klügsten Bären und der dümmsten Touristen." In demselben Geist, welche Mindestanforderungen könnten wir für ein moralisches, emotionales oder anderes menschliches Attribut festlegen, sodass der am wenigsten menschliche Mensch es trotzdem schafft, während die menschlichste KI es nicht tut? Und was würde es für uns bedeuten, wenn keine solche klare Linie auf einem vernünftigen Prinzip gezogen werden könnte? 3. Menschen wurden nie zuvor glaubwürdig herausgefordert, "menschlich genug" zu sein. Eine Angstreaktion kann die Form von Kampf, Flucht, Erstarren oder Schmeicheln annehmen. Welche dieser Reaktionen auf KI haben Sie bei anderen beobachtet? Welche haben Sie bei sich selbst bemerkt? 4. Angst kann ein produktiver Motivator sein. Was könnte uns die KI anregen, um uns zu verbessern? 5. Menschlich zu sein bedeutet, fehlerhaft zu sein. Computer wurden traditionell als "fehlerfrei" bei ihren Aufgaben betrachtet – und damit unmenschlich (denken Sie an einen Taschenrechner und komplexe Arithmetik). Was bedeutet es jetzt, dass wir KIs haben, die auch in vielerlei Hinsicht fehlerhaft sind? Bonusfragen: 1. Nicht jeder mag andere Menschen. Einige ziehen minimale Interaktion vor, insbesondere wenn sie von unangenehmer Gesellschaft umgeben sind, und viele finden Erleichterung dabei, mit einem Fremden zu sprechen, der nur minimale Antworten gibt – oder mit einem Computer – gerade weil keiner moralische Urteile fällt. (Für sympathische Portraits dieser Denkweise siehe Shoji Morimotos Mietperson, die nichts tut; für unsympathische siehe r/misanthropy.) Was könnte dieser Fakt über die Menschheit für das Ausrichtungsproblem implizieren? 2. Macht es einen Menschen "weniger" menschlich, andere Menschen nicht zu mögen? 3. Könnte eine Person die Menschheit so sehr ablehnen, dass sie weniger menschlich wird als eine KI? Hinweis: Für einen Eindruck von der Qualität von Chatbots im Jahr 2011 – der Art von "KI", gegen die im Loebner-Preis konkurriert wurde – besuchen Sie A.L.I.C.Ebot (https://www.pandorabots.com/pandora/talk?botid=b8d616e35e36e881). Neueinsteiger auf dem Gebiet könnten feststellen, wie unterschiedlich "KI" damals war und warum "KI-Sicherheit" für die breite Öffentlichkeit wenig Interesse weckte. Wer sollte kommen? Es sind keine technischen Vorkenntnisse erforderlich. Das Ausrichtungsproblem ist für ein allgemeines Publikum geschrieben und vereint Geschichte, Berichterstattung und leicht verständliche Erklärungen der wichtigsten Ideen im maschinellen Lernen und in der KI-Ethischen. Egal, ob Sie in Politik, Governance, Forschung, Recht, Wirtschaft arbeiten oder einfach nur versuchen zu verstehen, wie KI-Systeme bereits menschliche Entscheidungen beeinflussen, sind Sie willkommen. Kommt bereit, reale Systeme zu hinterfragen, nicht nur abstrakte Gedankenexperimente, und zu fragen, wie die Lektionen aus Christians Fallstudien die Ausrichtungs- und Sicherheitsarbeit hier in Hongkong und darüber hinaus informieren sollten.
Veranstaltungsort
Lassen Sie Ihr Netzwerk wissen, dass Sie dabei sind
Teilen Sie diese Veranstaltung, um Gespräche zu beginnen, Kollegen einzuladen und sich vorab zu vernetzen.
