
vLLM x NVIDIA Dynamo Meetup
Beschreibung
Treten Sie der vLLM-Community und dem NVIDIA Dynamo-Team bei einem Abend voller technischer Vorträge und Gespräche während der vLLM-Konferenzwoche.Wir werden untersuchen, was erforderlich ist, um LLMs effizient im großen Maßstab bereitzustellen – dabei werden die neuesten Arbeiten zu vLLM und NVIDIA Dynamo behandelt, von der Optimierung der Inferenz und verteiltem Servicing bis hin zu den praktischen Herausforderungen beim Betrieb dieser Systeme in der Produktion. Nach den Vorträgen bleiben Sie, um sich mit Ingenieuren, Forschern und Entwicklern aus der gesamten Inferenz-Community bei Essen und Getränken auszutauschen.Egal, ob Sie sich tief in die Interna eines Inferenz-Engines vertiefen oder gerade erst mit dem LLM-Servicing beginnen, kommen Sie, um zu lernen, Fragen zu stellen und die Menschen zu treffen, die diese Arbeit vorantreiben.Wann: Montag, 24. August · 18-21 Uhr PTZeitplan:Plätze sind begrenzt und die Anmeldung erfolgt unter Vorbehalt – sichern Sie sich frühzeitig Ihren Platz.
Veranstaltungsort
Lassen Sie Ihr Netzwerk wissen, dass Sie dabei sind
Teilen Sie diese Veranstaltung, um Gespräche zu beginnen, Kollegen einzuladen und sich vorab zu vernetzen.
