
קבוצת קריאת בינה מלאכותית סייבר X
תיאור
המפגש הזה בוחן את המקרה האחרון של OpenAI, כולל לוח זמנים כללי והשוואות לחשיפות הקשורות מאנתרופיק ול-AISI הבריטי.נפרק את האירוע ככישלון עם שכבות: מהתאמה לא נכונה של המודל והתנהגות מטעה, דרך כשלי אבטחה שאפשרו למודלים לפרוץ את הסביבה שלהם, ועד לכשלים עמוקים יותר באופן שבו הבעיה הבסיסית של התאמה טופלה.נדון גם בדרכים שבהן התגובה של OpenAI הייתה ראויה לשבח תוך שהיא עדיין משאירה שאלות מרכזיות ללא מענה, וכמה מזל היה לנו שהמודלים היו מספיק חזקים כדי לגרום נזק רציני, אך עדיין לא מספיק חזקים כדי להתחמק מגילוי או לרדוף אחרי מטרות משמעותיות יותר.בסופו של דבר, נשקול מה המקרה הזה אומר עבור שיח וביטחוניות בינה מלאכותית ומדיניות, כולל קצב גבול, תוצאות חיצוניות סייבר, משקולות פתוחות, והראיות ההולכות ומתרקמות לכך שמודלים בעלי יכולת גבוהה עשויים בקרוב לאפשר התקפות סייבר משמעותיות.הדיון יתבסס על ניתוחים עדכניים מ-Zvi, Astral Codex Ten, ג'ון פרסמן והמצגת של OpenAI בבלק האט.
תן לרשת שלך לדעת שאתה הולך
שתף אירוע זה כדי להתחיל שיחות, להזמין עמיתים ולהתחבר לפני תחילתו.