
Kunnen agenten daadwerkelijk zichzelf verbeteren?
Beschrijving
Overzicht Een praktijkgerichte avond waarin we een agent bouwen die aantoonbaar verbetert: simuleer de randgevallen, scoor tegen evaluaties en beperk elke release zodat de volgende versie alleen wordt vrijgegeven als deze beter is dan de vorige. Je gaat naar huis met de loop, gebouwd met open-source tools, die op een laptop draait. Evenementdetails “Zelfverbeterende agenten” doet op dit moment veel werk in pitch decks. Een deel ervan is echt, een groot deel niet, en deze avond scheidt de twee door de echte versie live voor je te bouwen. We zullen samen de echte versie live bouwen om het verschil te laten zien. Voordat iets in productie gaat, simuleren we synthetische gebruikers en vijandige scenario's om te detecteren waar de agent faalt, scoren we die runs tegen evaluaties, en voeren we de mislukkingen terug in. De evaluatie wordt de poort: niets wordt vrijgegeven tenzij de cijfers de juiste kant op bewegen. Dan blijven we het draaien, leidend productie verkeer terug door dezelfde evaluaties zodat regressies zich tonen als dalende scores in plaats van ondersteuningsverzoeken. Volledige recursieve zelfverbetering is nog steeds een open onderzoeksprobleem en we zullen niet doen alsof dat niet zo is, maar de begrensde versie is vandaag de dag bouwbaar op OpenTelemetry en open-source frameworks die je kunt fork en zelf hosten. De workshop leiden Nikhil, oprichter en CEO van Future AGI, leidt de live build van begin tot eind. Hij besteedt zijn dagen aan het exacte probleem waar deze avond over gaat: het betrouwbaar genoeg maken van agenten om in productie te vertrouwen, en meetbaar genoeg om te weten dat ze daadwerkelijk verbeteren. Neem een laptop mee om: Agenda 17:30 — Snacks en Hallo’s 18:15 — Zelfverbeterend Geheugen voor Agenten: Van Kennisgraphen naar Betere Beslissingen door Dave van Cognee 18:45 — Workshop: de zelfverbeteringsloop die daadwerkelijk vrijgeeft 19:30 — Open debat en Q&A: hype versus wat werkt 20:00 — Netwerken 20:30 — Tot de volgende iteratie Voor ingenieurs en AI-productbouwers die agenten in productie draaien en de versie willen die aantoonbaar verbetert, gebouwd op open tools die ze kunnen behouden. Over Pebblebed Pebblebed is een technische VC in een vroeg stadium, opgericht door Pam Vagata (mede-oprichter van OpenAI, leidde AI voor Stripe, uitvinder van FBLearner Flow); Keith Adams (oprichter van Facebook AI Research, was chief architect bij Slack, 20e ingenieur bij VMWare) en Tammie Siew (voormalig investeerder bij Sequoia in Zuidoost-Azië, voormalig oprichter gesteund door Sequoia & Notable Capital) Over Future AGI Future AGI is een open-source AI-simulator, evaluatie- en observabiliteitsplatform. Teams gebruiken het om agenten te simuleren voordat ze worden vrijgegeven, scoren ze tegen echte faalmodi, en blijven ze in de gaten houden in productie zodat de kwaliteit in de loop der tijd niet stilletjes achteruitgaat. Het is zelf hostbaar en OpenTelemetry-native, met tracing dat in meer dan 35 frameworks past. De loop die je vanavond gaat bouwen draait op dezelfde open tooling, van jou om te forken en mee naar huis te nemen, zonder dat een account vereist is. Over Cognee AI Cognee bouwt een OSS-geheugenplatform voor agenten. Het verandert relationele gegevens, documenten en systeemcontext in agentgeheugen die je agenten over verschillende sessies kunnen oproepen.
Locatie evenement
Laat je netwerk weten dat je komt
Deel dit evenement om gesprekken te starten, collega`s uit te nodigen en van tevoren contact te leggen.
