
vLLM Meetup Toronto
Beschreibung
Schließen Sie sich uns für das vLLM x Cohere Meetup in Toronto an, einen Abend für KI-Ingenieure, Forscher und Infrastrukturentwickler. Dies ist eine Gelegenheit, sich mit den vLLM-Mitarbeitern und dem Cohere-Team zu verbinden, das Modelle für produktionsgroße Workloads erstellt und bereitstellt. Wir werden besprechen, wie das vLLM-Ökosystem und Cohere's offene Gewichte funktionieren und wie die Beiträge von oben passen. Die Sitzung geht tief auf Inferenz ein: die vLLM-Roadmap, die Bereitstellung für agentische Workloads und das fortgeschrittene KV-Cache-Offloading. Roger Wang, Mitbegründer von Inferact und ein zentraler vLLM-Mitarbeiter, wird technische Updates geben, und wir werden mit einem Live-Panel abschließen, das sich damit beschäftigt, wohin die Inferenz geht und was als Nächstes für Open Source KI kommt. Weitere Redner von vLLM und Cohere werden bald bekannt gegeben. Wir werden den Abend mit Networking, Getränken und Snacks ausklingen lassen. Zeitplan
Veranstaltungsort
Lassen Sie Ihr Netzwerk wissen, dass Sie dabei sind
Teilen Sie diese Veranstaltung, um Gespräche zu beginnen, Kollegen einzuladen und sich vorab zu vernetzen.







