Soumettre un événement
#39 - Optimisation de Modèles et Inférence Basée sur CPU

#39 - Optimisation de Modèles et Inférence Basée sur CPU

24 sept. 202617:00 - 21:00 Europe/StockholmStockholm, Sweden8 ParticipantsOpen

Description

Tout va bien !!!Le Meetup #39 aura lieu le 24 septembre à AI Sweden et se concentrera sur "L'Optimisation de Modèles et l'Inférence Basée sur CPU". Nous sommes super excités de nous associer aux sorciers espagnols de l'IA quantique, Multiverse Computing, et aux géants de la technologie Intel et HPE. Le programme est actuellement en cours d'élaboration, alors restez à l'écoute pour les mises à jour !Il se passe énormément de choses dans le domaine de l'optimisation des modèles et de l'inférence. De nouvelles approches semblent être annoncées quotidiennement, comme rendre possible l'exécution du modèle récemment publié de 2,78 trillions de paramètres, Kimi K3, sur un seul CPU avec 8 Go de mémoire... !!! ou l'annonce du 23 juillet de Multiverse Computing selon laquelle tous leurs modèles compressés fonctionnent désormais sur des processeurs Intel Xeon 6.Alors attachez vos ceintures et préparez-vous à l'impact !Programme de l'événement - Ouverture des portes à 17h00 CET - Début des conférences à 17h45 CET - Il y aura des pizzas et des boissons - Il pourrait y avoir une session de questions-réponses modérée....Liste des intervenants à confirmer...- Franco Serra, Architecte de Solutions chez Multiverse Computing, donnera une conférence intitulée "Modèles Ultra Efficaces pour Élargir votre Datacenter GenAI et Adaptés au Déploiement Edge". Résumé : Alors que les organisations s'empressent de déployer l'IA Générative, deux défis dominent : comment évoluer l'inférence de façon économique dans le datacenter, et comment apporter l'intelligence à la périphérie où la connectivité, l'énergie et l'espace sont limités. Multiverse Computing crée des modèles IA ultra-efficaces et compressés, y compris des LLMs, VLMs, de la reconnaissance vocale au texte, et des modèles de vision par ordinateur — conçus pour fournir la même précision avec une fraction des exigences en mémoire. En s'intégrant à l'infrastructure matérielle Intel®, les entreprises peuvent déployer de plus grands modèles IA sur une infrastructure existante plutôt que de l'agrandir. Dans le datacenter, des modèles plus légers se traduisent directement par un meilleur débit, une consommation d'énergie plus faible, et un retour sur investissement amélioré en permettant à plus d'utilisateurs et de charges de travail de s'exécuter sur la même infrastructure. À la périphérie, les mêmes percées en matière de compression permettent de déployer l'IA Générative dans des environnements contraints — apportant une IA sécurisée et à faible latence dans des environnements tactiques.- Thomas Melzer, Architecte de Solutions Senior chez Intel, donnera une conférence sur le retour en grâce des CPU pour l'inférence....- Johan Fondin, Architecte de Solutions chez HPE, donnera une conférence sur la dynamique du stockage, du streaming et de la mémoire...Au plaisir de vous y voir,/Patrick & l'équipe MLOps de Stockholm

Lieu de l`événement

Faites savoir à votre réseau que vous y allez

Partagez cet événement pour engager des conversations, inviter des collègues et vous connecter avant qu`il commence.

Related events

Plateforme d’intelligence artificielle

Gratuit
S`inscrire gratuitement