
vLLM Meetup Toronto
Beschrijving
Sluit je bij ons aan voor de vLLM x Cohere meetup in Toronto, een avond voor AI-ingenieurs, onderzoekers en infrastructuurbouwers. Dit is een kans om contact te leggen met vLLM-beheerders en het Cohere-team dat modellen bouwt en levert voor productie-werkbelastingen. We zullen bespreken hoe het vLLM-ecosysteem en de open-gewichten van Cohere werken en hoe upstream-bijdragen samenkomen. De sessie gaat dieper in op inferentie: de vLLM-routekaart, serveren voor agentische werkbelastingen en geavanceerde KV-cache offloading. Roger Wang, medeoprichter van Inferact en een kernbeheerder van vLLM, zal technische updates geven, en we sluiten af met een live panel over waar inferentie naartoe gaat en wat er voor open-source AI op de planning staat. Aanvullende sprekers van vLLM en Cohere zullen binnenkort worden aangekondigd. We sluiten de avond af met netwerken, drankjes en hapjes. Schema:
Locatie evenement
Laat je netwerk weten dat je komt
Deel dit evenement om gesprekken te starten, collega`s uit te nodigen en van tevoren contact te leggen.











