
שבירת אבטחת מודלים בינה מלאכותית
תיאור
שני talks השבוע. אחד סוגר מעגל, אחד פותח שאלת חור ארנב.חלק 1 — הגנות כנגד הזרקת פקודות: מה עובד, מה זה תיאטרון (ארשי צ'אדה, מהנדס אבטחת סייבר בכיר, זסקיילר, 20 דקות) מפגש אחרון: 11 קטגוריות התקפה, CVEs. מפגש זה: צד ההגנה. אילו הקטנות באמת מחזיקות, אילו פשוט מרגישות בטוחות, ולמה “להוסיף פקודה מערכת טובה יותר” אינה אסטרטגיה.חלק 2 — לפני שהתמודדות המודל (סאגניק נאת, מרצה בכיר, מדעי המחשב, אוניברסיטת סנטה קרוז) הפקודות שלך כבר קבועות. מגניב. בינתיים, ההופעה מאחורי הקלעים עושה שימוש במצבים ששמרו, תואם בעמימות תשובות ישנות, וסומך על האש hashes שנועדו למהירות, אך לא לאבטחה. הרצאה זו חוקרת כיצד מטא-נתונים, סמנטיים ומטמון מולטימודלי יכולים להיות מזוהמים כדי לשנות תגובות, להסתיר קלטים זדוניים, ולעקוף בדיקות מבוססות LLM במערכות שיתוף משותף. אנחנו נבחן התקפות שהוצגו נגד מסגרות כמו vLLM ו-GPTCache, ואז נדון בהגנות מעשיות לאבטחת שכבת המטמון.📍 Hacker Dojo, Mountain View 🕕 2:30pmאותו פורמט קבוצתי קטן כמו בפעם הקודמת. הביאו מסמך שלכם שעבדתם עליו, גילוי שאתם יושבים עליו, שרשרת ניצול שאתם עובדים עליה, או הגנה שאתם רוצים לבדוק מול אנשים שיאתגרו אתכם. הסדר יהיה העוגן שלנו. עוד יותר יקר זה מה שהחדר רוצה לחקור. כדי להשתתף, או להציג מסמך/פרויקט/משהו שקשור לאבטחת בינה מלאכותית, פנו בדוא"ל ל- [email protected].
מיקום האירוע
תן לרשת שלך לדעת שאתה הולך
שתף אירוע זה כדי להתחיל שיחות, להזמין עמיתים ולהתחבר לפני תחילתו.
