Enviar evento
Encuentro de Inferencia vLLM en Mumbai
Automationllm-apps

Encuentro de Inferencia vLLM en Mumbai

26 sep. 20268:00 AM - 11:30 AM GMT+00:00En líneaOpen

Descripción

Un encuentro técnico sobre vLLM y llm-d el 26 de septiembre de 2026, explorando la inferencia escalable de LLM a través de profundidades arquitectónicas, lecciones de producción y demostraciones en vivo. ## Dentro del motor de inferencia LLM Diseñado para ingenieros que desean ejecutar sistemas de IA generativa más rápido y de manera más eficiente, el Encuentro de Inferencia vLLM en Mumbai va más allá de discusiones de alto nivel para examinar la ingeniería detrás de la inferencia a gran escala. El programa se centra en la arquitectura y las técnicas de optimización que ayudan a los equipos a hacer un mejor uso de la infraestructura de GPU, aumentar el rendimiento de tokens y llevar los servicios LLM a producción. Los asistentes escucharán directamente de los mantenedores y contribuyentes clave que trabajan en los ecosistemas de vLLM y llm-d, junto con profesionales de la industria con experiencia en la implementación de sistemas de IA en producción. Las sesiones combinarán actualizaciones de proyectos y charlas técnicas con demostraciones prácticas de flujos de trabajo del mundo real. ## Destacados de la agenda El programa planificado incluye: - Una introducción a vLLM y una actualización sobre el último desarrollo del proyecto - Decodificación especulativa y su papel en la aceleración de la inferencia de IA - Un viaje de evaluación a producción, incluyendo cómo construir un servicio vLLM gestionado con llm-d - Lecciones de equipos que implementan y sirven LLM en producción - Un laboratorio práctico de Sardeenz cubriendo la virtualización de GPU y la implementación de múltiples modelos en una sola GPU - Demostraciones en vivo, comentarios de apertura y oportunidades para intercambiar ideas con los ponentes y otros ingenieros La agenda se describe como sujeta a cambios, dejando espacio para más contenido técnico y contribuciones de la comunidad. ## ¿Quién debería asistir? Este encuentro es particularmente relevante para usuarios o contribuyentes de vLLM y llm-d, ingenieros de aprendizaje automático e infraestructura responsables de la inferencia y el servicio de modelos, y equipos de plataforma que operan cargas de trabajo de GenAI en producción. También será adecuado para desarrolladores que investigan la inferencia eficiente en entornos locales, infraestructuras en la nube y Kubernetes.… Regístrate para este evento

Herramientas que se utilizarán en el evento

vLLM

llm-d

Dile a tu red que vas a ir

Comparte este evento para iniciar conversaciones, invitar colegas y conectar antes de que comience.

Etiquetas

# Automation# llm-apps

Related events

Plataforma de inteligencia artificial

Precios en el sitio web
Obtener entradas