
Discussie over onderzoeksartikel
Beschrijving
Discussie over het artikel over mechanistische interpreteerbaarheid - Identificeren van menselijk-interpreteerbare concepten en algoritmen in LLM's Lees enkele van de AI-kopstukken van de afgelopen weken. Als je nog steeds denkt dat interpreteerbaarheid en het verbeteren van ons begrip van LLM's niet belangrijk zijn, lees ze dan opnieuw. In het algemeen is mechanistische interpreteerbaarheid erop gericht de algoritmen te ontdekken, begrijpen en verifiëren die modelgewichten implementeren door het omgekeerd ontleden van modelberekeningen in menselijk begrijpelijke componenten. Om specifiek te zijn, willen we in deze sessie kijken naar het artikel 'Interpretability in the Wild' (https://openreview.net/pdf?id=NpsVSN6o4ul). Het identificeert een circuit voor indirecte objectidentificatie in het GPT-2 kleine model en is een invloedrijk bewijs van concept in de praktijk op dit gebied. Lees alstublieft het artikel voor de sessie (https://openreview.net/pdf?id=NpsVSN6o4ul). Hoe meer vragen je hebt na het lezen, hoe productiever de sessie zal zijn! Je kunt ook deze meer praktische hoofdstuk over interpreteerbaarheid in een cursus bekijken over hetzelfde artikel: https://learn.arena.education/chapter1_transformer_interp/21_ioi/intro.
Locatie evenement
Laat je netwerk weten dat je komt
Deel dit evenement om gesprekken te starten, collega`s uit te nodigen en van tevoren contact te leggen.










