
Evalueren van VLA's en Robotfundamentmodellen
Beschrijving
Nu fysieke AI-teams van simulatie naar implementatie gaan, is de vraag niet langer alleen of een systeem werkt, maar of het betrouwbaar en veilig presteert in de echte wereld. Sluit je aan bij Weights & Biases by CoreWeave voor een diepgaande verkenning van hoe robotica-teams checkpoints evalueren voordat ze deze in echte systemen implementeren. Gehost door Hans Ramsl, Senior Accounts Solutions Architect bij Weights & Biases by CoreWeave, zal de sessie een gastspreker van Polybot bevatten en verkennen: ● Sim-to-real kloof: Wat voorspelt een sterke simulatiebenchmark echt over een geïmplementeerd beleid? ● Voorbij succespercentages: Waarom volgen teams verloopsporen, interventiepercentages en near-miss taxonomieën? ● De beslissing om vrij te geven: Hoe bepalen teams of een checkpoint veilig is om in de cel van een klant te implementeren? Belangrijke lessen uit de sessie zijn onder andere: ● Gedeelde vocabulaire voor de signalen die er toe doen naast succespercentages ● Praktische manieren om evaluatieresultaten om te zetten in acties op nieuwe checkpoints ● Kansen om te netwerken met collega's uit het Cyber Valley-netwerk en het Weights and Biases by CoreWeave-team Mis het niet, registreer je vandaag nog!
Locatie evenement
Laat je netwerk weten dat je komt
Deel dit evenement om gesprekken te starten, collega`s uit te nodigen en van tevoren contact te leggen.