
Breaking Models AI Security
Опис
Два виступи цього тижня. Один закриває коло, інший відкриває кролячий дірку.Частина 1 — Захист від введення запитів: що працює, що є театром (Арші Чадха, старший інженер з кібербезпеки, Zscaler, 20 хв) Остання сесія: 11 класів атак, CVE. Ця сесія: захисна сторона. Які заходи дійсно витримують, які просто здаються безпечними і чому “додати кращий системний запит” не є стратегією.Частина 2 — Перед відповіддю моделі (Сагнік Нат, асистент професора, комп'ютерні науки, UC Santa Cruz) Ваші запити тепер фіксовані. Круто. Тим часом бекенд виведення повторно використовує кешовані стани, нечітко порівнює старі відповіді та довіряє хешам, які були розроблені для швидкості, а не для безпеки. Цей виступ досліджує, як префіксні, семантичні та мультимодальні кеші можуть бути отруєні, щоб змінити відповіді, приховати шкідливі введення та обійти аудит на основі LLM у спільних сервісних системах. Ми розглянемо атаки, продемонстровані проти фреймворків, таких як vLLM і GPTCache, а також обговоримо практичні заходи для захисту шарів кешу.📍 Hacker Dojo, Mountain View 🕕 14:30Теж формат малих груп, як минулого разу. Принесіть папір, над яким ви працювали, знахідку, якою ви володієте, ланцюг експлуатації, над яким ви працюєте, або захист, який ви хочете перевірити на людям, які заперечуватимуть. Порядок денний буде нашим яорієнтиром. Ще більш цінним є те, що кімната хоче обговорити. Щоб відвідати чи представити папір/проект/усе, що стосується безпеки ШІ, зв'яжіться електронною поштою на адресі [email protected].
Місце проведення
Розкажіть своїй мережі, що ви йдете
Поділіться цією подією, щоб розпочати розмови, запросити колег та налагодити контакти до її початку.
