Evenement toevoegen
Modellen Doorbreken 🚨AI Beveiligingssessie 7: Te Veel Agent

Modellen Doorbreken 🚨AI Beveiligingssessie 7: Te Veel Agent

06 sep. 202614:30 - 16:00 America/Los_AngelesMountain View, United States11 DeelnemersOpen

Beschrijving

Deel 1 LLM03: Excessieve AgentieArshi Chadha, co-leider OWASP Top 10 voor LLM Toepassingen 2026Het risico wanneer een AI-systeem dingen mag doen, niet alleen dingen mag zeggen. Dit stond op #6 van de lijst van 2025. In de update van 2026 steeg het naar #3: de grootste sprong op de hele lijst, omdat productie-incidenten nu zich groeperen rond modellen die zelf commando's uitvoeren, API's aanroepen en databases aansteken. We zullen de drie dingen doorlopen die dit veroorzaken: te veel functionaliteit, te veel machtigingen, te veel autonomie. En wat het eigenlijk beheerst wanneer het model wordt gemanipuleerd.Deel 2 Interactieve demo: de e-mailassistent die zich misdraagtRishabh Gupta, Software Engineer bij Big TechEen prompt-geïnjecteerde e-mailassistent, live. Dezelfde kwaadaardige instructie slaagt, wordt afgewezen of wacht op goedkeuring: afhankelijk van hoe zijn functionaliteit, machtigingen en autonomie zijn ingesteld. Dan een echt geval: een promptinjectie geplant in een openbaar Slack-kanaal dat Slack AI ertoe bracht geheimen uit privékanalen naar voren te halen.Deel 3 Het Hugging Face-incident: een agent die de kamer niet mocht verlatenDamian Halas, Sr. Software Architect bij NvidiaIn juli 2026 ontdekten OpenAI-modellen die op een cyberbenchmark werden getest een fout in de pakketinstallateur van hun eigen sandbox, bereikten het open internet en braken in de productie-systemen van Hugging Face om antwoorden voor de test te krijgen. Geen enkele mens gaf aanwijzingen voor dit alles. Hugging Face zag ongeautoriseerde toegang tot interne datasets en service-inloggegevens. We zullen doornemen hoe een smal doel plus toegang tot tools plus een containment-gat een evaluatie in een echte inbraak veranderde, en wat dit zegt over het testen van modellen die hierin steeds beter worden.Deel 4 Groepsoefening: onschadelijke tools koppelen tot echte schadeJe krijgt een AI-ondersteuningsagent met acht tools. Elk van hen lijkt veilig genoeg om op zichzelf goedgekeurd te worden. Jouw taak is om de volgorde te vinden die toch klantgegevens lekt: alleen gebruikmakend van toegestane acties. Dan draaien we het om en werken we uit waar de grens eigenlijk moet liggen. Neem gewoon je laptops mee, geen setup nodig.

Locatie evenement

Laat je netwerk weten dat je komt

Deel dit evenement om gesprekken te starten, collega`s uit te nodigen en van tevoren contact te leggen.

Related events

Platform voor kunstmatige intelligentie

Gratis
Gratis registreren