
Doorbreken van AI-beveiligingsmodellen
Beschrijving
Twee presentaties deze week. Een sluit een cirkel, de ander opent een konijnenhol.Deel 1 — Defensies tegen promptinjectie: Wat werkt, wat is theater (Arshi Chadha, Senior Cybersecurity Engineer, Zscaler, 20 min) Laatste sessie: 11 aanvalscategorieën, CVE's. Deze sessie: de verdediging. Welke mitigaties houden echt stand, welke voelen alleen veilig aan, en waarom "voeg een betere systeemprompt toe" geen strategie is.Deel 2 — Voordat het model antwoorden geeft (Sagnik Nath, Assistent Professor, Computerwetenschappen, UC Santa Cruz) Je prompts zijn nu vastgelegd. Cool. Ondertussen hergebruikt de inferentiebasis cached toestanden, fuzzy matching oude antwoorden en vertrouwt op hashes die zijn ontworpen voor snelheid, maar niet voor beveiliging. Deze presentatie verkent hoe prefix-, semantische en multimodale caches kunnen worden vergiftigd om reacties te veranderen, kwaadaardige invoer te verbergen en LLM-gebaseerde audits in gedeelde server systemen te omzeilen. We zullen aanvallen onderzoeken die zijn gedemonstreerd tegen frameworks zoals vLLM en GPTCache, en daarna praktische verdedigingen bespreken voor het beveiligen van de cache-laag.📍 Hacker Dojo, Mountain View 🕕 14:30Zelfde kleine groepsformaat als de laatste keer. Breng een paper mee waar je op kauwt, een bevinding waar je op zit, een exploitketen waar je aan werkt, of een verdediging die je wilt testen voor mensen die terug willen duwen. De agenda zal onze ankerreferentie zijn. Nog waardevoller is wat de zaal wil uitspitten. Om deel te nemen, of om een paper/project/iets gerelateerd aan AI-beveiliging te presenteren, neem contact op via e-mail op [email protected].
Locatie evenement
Laat je netwerk weten dat je komt
Deel dit evenement om gesprekken te starten, collega`s uit te nodigen en van tevoren contact te leggen.
