Soumettre un événement
Groupe d'étude : Inférence dans les systèmes d'IA

Groupe d'étude : Inférence dans les systèmes d'IA

15 sept. 20266:00 PM GMT-07:00En ligneOpen
LearnNetworkFind partners
TextCode

Description

Groupe d'étude : Inférence LLM Rejoignez le collectif d'IA appliquée pour un groupe d'étude pratique sur l'inférence LLM et vLLM — comment les modèles de langage modernes sont servis de manière efficace, ce qui se passe après qu'une invite atteigne un modèle, et comment les systèmes d'inférence équilibrent latence, débit, mémoire et coût. Alors que les applications LLM passent de prototypes à des produits réels, faire fonctionner le modèle efficacement devient une partie importante de la pile IA. Il ne suffit pas de choisir un modèle capable — les créateurs doivent également comprendre comment ce modèle est déployé, comment les demandes sont traitées, comment les ressources GPU sont utilisées et comment la performance de l'inférence change à mesure que le trafic croît. Cette session est conçue comme une discussion conviviale pour les ingénieurs, fondateurs, chercheurs, constructeurs de produits et passionnés d'IA qui souhaitent mieux comprendre l'infrastructure derrière le service des LLM en production. Ce que nous allons aborder : • Qu'est-ce que l'inférence LLM et que se passe-t-il lors du service de modèle • Pré-remplissage vs. décodage et pourquoi ils ont des caractéristiques de performance différentes • Latence, débit, jetons par seconde, et autres métriques d'inférence importantes • Comment le lotissement et le lotissement continu améliorent l'utilisation du GPU • Mise en cache KV et pourquoi cela importe pour la performance d'inférence • Une introduction à vLLM et comment cela permet un service LLM à haut débit • PagedAttention et le problème pour lequel il a été conçu • Quantification et autres techniques pour réduire les coûts d'inférence et l'utilisation de la mémoire • Service de modèles open-source et réflexion sur les GPU, la taille des modèles et la concurrence • Discussion ouverte sur les frameworks d'inférence, architectures, benchmarks et défis de déploiement dans le monde réel Qui devrait assister : Créateurs d'IA, ingénieurs logiciels, ingénieurs ML, fondateurs, chefs de produit, chercheurs, étudiants et toute personne intéressée à comprendre comment les LLM sont servis dans des systèmes d'application réels. Aucune expertise préalable en infrastructure d'inférence n'est requise. Apportez vos questions, vos expériences avec des outils comme vLLM, les modèles que vous avez déployés ou les systèmes d'IA que vous construisez actuellement. C'est un groupe d'étude, pas un cours formel. L'objectif est d'apprendre ensemble, de discuter d'approches pratiques et de construire une meilleure compréhension de ce qui se passe entre une application LLM et les GPU qui exécutent réellement le modèle. Construisons une communauté plus forte autour de systèmes IA pratiques, évolutifs et du monde réel.

Faites savoir à votre réseau que vous y allez

Partagez cet événement pour engager des conversations, inviter des collègues et vous connecter avant qu`il commence.

Événements similaires

Efficacité de mise à l'échelle et contrôle avec les plateformes open-source de Mistral Mer, 8 juil. · 14 h 00 HAE · En ligne par Artificial Intelligence ATLicon 3.9

Efficacité de mise à l'échelle et contrôle avec les plateformes open-source de Mistral Mer, 8 juil. · 14 h 00 HAE · En ligne par Artificial Intelligence ATLicon 3.9

Offline
Garde-fous pour l'IA d'entreprise : sécurisation des charges de travail de l'IA agentique et des LLM sur AWS Mardi 23 juin à 9h00 PDT · En ligne par Los Angeles City Business and Technology Meetup.

Garde-fous pour l'IA d'entreprise : sécurisation des charges de travail de l'IA agentique et des LLM sur AWS Mardi 23 juin à 9h00 PDT · En ligne par Los Angeles City Business and Technology Meetup.

OfflineTuesday, Jun 23 · 9:00 AM to 11:00 AM GMT-0700
La chaîne de traitement multi-agent Ven, 26 juin · 19h00 CDT · En ligne par Advanced AI Concepts-Chicago

La chaîne de traitement multi-agent Ven, 26 juin · 19h00 CDT · En ligne par Advanced AI Concepts-Chicago

Offline
Construire l'assurance qualité à l'ère de l'IA : Réunion nord-américaine Lundi, 22 juin · 8 h 00 ADT · En ligne par The Test Tribe Halifax 1 participant

Construire l'assurance qualité à l'ère de l'IA : Réunion nord-américaine Lundi, 22 juin · 8 h 00 ADT · En ligne par The Test Tribe Halifax 1 participant

OfflineMonday, Jun 22 · 8:00 AM to 10:00 AM GMT-0300
Webinaire sur la transformation des rôles de Scrum Master & PO AI Sam, 27 juin · 19h30 ADT · En ligne par Scrum Canada Meetup.

Webinaire sur la transformation des rôles de Scrum Master & PO AI Sam, 27 juin · 19h30 ADT · En ligne par Scrum Canada Meetup.

OfflineSaturday, Jun 27 · 7:30 PM to 9:00 PM GMT-0300
Comment l'IA transforme les rôles - Scrum Masters, Chefs de projet et Propriétaires de produit Samedi 27 juin · 11h00 ADT · En ligne par Scrum Canada Meetup.

Comment l'IA transforme les rôles - Scrum Masters, Chefs de projet et Propriétaires de produit Samedi 27 juin · 11h00 ADT · En ligne par Scrum Canada Meetup.

OfflineSaturday, Jun 27 · 11:00 AM to 12:30 PM GMT-0300
Seminaire en ligne (CS)²AI™; Comment sécuriser les opérations ICS/OT avec MITRE D3FEND Mer, 24 juin · 14:00 ADT · En ligne par Halifax Cyber Security pour les systèmes de contrôle

Seminaire en ligne (CS)²AI™; Comment sécuriser les opérations ICS/OT avec MITRE D3FEND Mer, 24 juin · 14:00 ADT · En ligne par Halifax Cyber Security pour les systèmes de contrôle

OfflineWednesday, Jun 24 · 2:00 PM to 3:30 PM GMT-0300
Séminaire en ligne (CS)²AI : Optimisation d'un ensemble d'outils communautaires gratuits OS ICS/OT Mer, 1er juillet · 14h00 ADT · En ligne par Halifax Cyber Security for Control Systems 1 participant

Séminaire en ligne (CS)²AI : Optimisation d'un ensemble d'outils communautaires gratuits OS ICS/OT Mer, 1er juillet · 14h00 ADT · En ligne par Halifax Cyber Security for Control Systems 1 participant

OfflineWednesday, Jul 1 · 2:00 PM to 3:30 PM GMT-0300
L'IA en action : du sol de l'usine à la salle de conseil d'administrationJeu, 16 juil. · 18:30 CESTpar Munich PMO, professionnels de la gestion de projets, programmes et portefeuilles.

L'IA en action : du sol de l'usine à la salle de conseil d'administrationJeu, 16 juil. · 18:30 CESTpar Munich PMO, professionnels de la gestion de projets, programmes et portefeuilles.

Offline
Stratégies alimentées par l'IA : Concevoir un projet en ligne structuré

Stratégies alimentées par l'IA : Concevoir un projet en ligne structuré

OfflineMonday, Jun 22 · 3:00 PM to 4:30 PM GMT-0400
🧠 Club de conversation en anglais gratuit avec animateur natif (+ retour d'information par IA) Tous les dimanches, lundis, mardis, mercredis, jeudis, vendredis, samedis · 20 juin · 16h00 EEST · En ligne par 🎙️Kyiv Free Online English Speaking Club.

🧠 Club de conversation en anglais gratuit avec animateur natif (+ retour d'information par IA) Tous les dimanches, lundis, mardis, mercredis, jeudis, vendredis, samedis · 20 juin · 16h00 EEST · En ligne par 🎙️Kyiv Free Online English Speaking Club.

Offline
Club de conversation 'Anglais pour la durabilité' 🌎

Club de conversation 'Anglais pour la durabilité' 🌎

OfflineThursday, Jun 25 · 12:00 PM to 1:00 PM GMT-0400

Plateforme d’intelligence artificielle

Prix sur le site web