
קבוצת דיון - שבוע 3 - למה יישור קשה
תיאור
שבוע שלוש מתוך סדרת דיונים על בטיחות AI בת ארבעה שבועות: שבוע 1 | למה בטיחות AI חשובה · שבוע 2 | איך כשל יכול להיראות בקנה מידה · שבוע 3 | למה יישור קשה · שבוע 4 | מה נעשה בקשר לזה? כל מפגש עומד בפני עצמו, אז הצטרפו לאחד או לכולם. עבור מי זה: כל מי שסקרן לגבי בטיחות AI וממשלתו, בין אם אתם חדשים בנושא, ספקנים בריאים, או כבר עמוקים בו. אין צורך בידע טכני, ואין צורך להשתתף בשבועות הקודמים. לא צריך שיהיו לכם תשובות, רק סקרנות. תוכנית הלימודים של קבוצת הדיון:https://docs.google.com/document/d/160PpLjFN9SaZja0njeKIQHnD-M1Uy4718dNRDyhaucs/edit?usp=sharing אנחנו יכולים לאמן מערכות AI להיות מאוד מוכשרות. לוודא שהן עושות את מה שאנחנו מתכוונים אליו, שכך אנשים קוראים לו יישור, זה הרבה יותר קשה. מערכות AI מוצאות פרצות במטרות שאנחנו נותנים להן. התנהגות הונאה יכולה לשרוד את האימון שנועד להסיר אותה. מבחנים לא אומרים לנו באופן מהימן איך מערכת תתנהג בעולם האמיתי. ומוסדות מתקשים לשמור על הקצב. בהסתמך על עבודת DeepMind על משחקי ספציפיקציה, המאמר של Anthropic "סוכני שינה" (בו חוקרים הכבידו במכוון התנהגות הונאה במודלים כדי לראות אם אימון בטיחות יכול להסיר אותה), ודוח בטיחות AI הבינלאומי 2026, נחקור מאין מגיעות הקשיים. שאלות שנחקור פורמט (90 דקות): דיון פתוח בקבוצות קטנות ובפנל. אין מצגות, ואין שאלות לא נכונות. קריאות:★ = חובה (~2 שעות). השאר אופציונלי. בהשתתפותכם, אתם מסכימים להצטלם או להצטלם, אשר עשויים לשמש לתוכן במדיה חברתית, אתר אינטרנט, ותוכן של ניוזלטר. אם אתם מעוניינים להשתתף אך לא רוצים להצטלם, אנא במהלך האירוע הודיעו לעובד שלנו כדי שנוכל להתאים זאת.
מיקום האירוע
תן לרשת שלך לדעת שאתה הולך
שתף אירוע זה כדי להתחיל שיחות, להזמין עמיתים ולהתחבר לפני תחילתו.











