
Rencontre vLLM Toronto
Description
Rejoignez-nous pour la rencontre vLLM x Cohere à Toronto, une soirée destinée aux ingénieurs en IA, chercheurs et bâtisseurs d'infrastructure. C'est l'occasion de se connecter avec les mainteneurs de vLLM et l'équipe de Cohere qui construit et sert des modèles pour des charges de travail à l'échelle de la production. Nous aborderons comment l'écosystème vLLM et les poids ouverts de Cohere fonctionnent et s'intègrent avec les contributions en amont. La session approfondira l'inférence : la feuille de route de vLLM, le service pour les charges de travail agentiques, et le déchargement avancé du cache KV. Roger Wang, cofondateur d'Inferact et mainteneur principal de vLLM, donnera des mises à jour techniques, et nous conclurons par un panel en direct sur la direction de l'inférence et ce qui attend l'IA open source. D'autres intervenants de vLLM et de Cohere seront annoncés bientôt. Nous terminerons la soirée par un moment de réseautage, des boissons et des collations. Programme
Lieu de l`événement
Faites savoir à votre réseau que vous y allez
Partagez cet événement pour engager des conversations, inviter des collègues et vous connecter avant qu`il commence.











