Enviar evento
Grupo de Estudio: Inferencia en Sistemas de IA

Grupo de Estudio: Inferencia en Sistemas de IA

15 sep. 20266:00 PM GMT-07:00En líneaOpen
LearnNetworkFind partners
TextCode

Descripción

Grupo de Estudio: Inferencia de LLM Únete al Colectivo de IA Aplicada para un grupo de estudio práctico sobre la inferencia de LLM y vLLM — cómo se sirven de manera eficiente los modernos modelos de lenguaje, qué sucede después de que un aviso llega a un modelo, y cómo los sistemas de inferencia equilibran latencia, rendimiento, memoria y costo. A medida que las aplicaciones de LLM pasan de ser prototipos a productos del mundo real, ejecutar el modelo de manera eficiente se convierte en una parte importante de la pila de IA. No es suficiente elegir un modelo capaz: los constructores también necesitan entender cómo se despliega ese modelo, cómo se procesan las solicitudes, cómo se utilizan los recursos de GPU y cómo el rendimiento de la inferencia cambia a medida que el tráfico crece. Esta sesión está diseñada como una discusión amigable para constructores dirigida a ingenieros, fundadores, investigadores, creadores de productos y entusiastas de la IA que desean comprender mejor la infraestructura detrás de la prestación de LLM en producción. Lo que cubriremos: • Qué es la inferencia de LLM y qué sucede durante la prestación del modelo • Prefill vs. decodificación y por qué tienen diferentes características de rendimiento • Latencia, rendimiento, tokens por segundo y otras métricas importantes de inferencia • Cómo el agrupamiento y el agrupamiento continuo mejoran la utilización de GPU • Caching de KV y por qué es importante para el rendimiento de la inferencia • Una introducción a vLLM y cómo permite la prestación de LLM de alto rendimiento • PagedAttention y el problema que fue diseñado para resolver • Cuantización y otras técnicas para reducir el costo de inferencia y el uso de memoria • Prestación de modelos de código abierto y pensar en GPUs, tamaño del modelo y concurrencia • Discusión abierta sobre marcos de inferencia, arquitecturas, benchmarks y desafíos de despliegue en el mundo real ¿Quién debe asistir?: Constructores de IA, ingenieros de software, ingenieros de ML, fundadores, gerentes de producto, investigadores, estudiantes y cualquier persona interesada en entender cómo se sirven los LLM en sistemas del mundo real. No se requiere experiencia previa en infraestructura de inferencia. Trae tus preguntas, experiencias con herramientas como vLLM, modelos que has desplegado o sistemas de IA que estás construyendo actualmente. Este es un grupo de estudio, no una conferencia formal. El objetivo es aprender juntos, discutir enfoques prácticos y construir un mejor entendimiento de lo que sucede entre una aplicación de LLM y las GPUs que realmente ejecutan el modelo. Construyamos una comunidad más fuerte en torno a sistemas de IA prácticos, escalables y del mundo real.

Dile a tu red que vas a ir

Comparte este evento para iniciar conversaciones, invitar colegas y conectar antes de que comience.

Eventos relacionados

Eficiencia de Escalamiento y Control con las Plataformas de Código Abierto de Mistral Mié, 8 de julio · 2:00 PM EDT · En línea por Artificial Intelligence ATL icon 3.9

Eficiencia de Escalamiento y Control con las Plataformas de Código Abierto de Mistral Mié, 8 de julio · 2:00 PM EDT · En línea por Artificial Intelligence ATL icon 3.9

Offline
Guardias de seguridad de IA empresarial: protegiendo cargas de trabajo de IA agéntica y modelos de lenguaje en AWS. Martes, 23 de junio · 9:00 AM PDT · En línea por Los Angeles City Business and Technology Meetup.

Guardias de seguridad de IA empresarial: protegiendo cargas de trabajo de IA agéntica y modelos de lenguaje en AWS. Martes, 23 de junio · 9:00 AM PDT · En línea por Los Angeles City Business and Technology Meetup.

OfflineTuesday, Jun 23 · 9:00 AM to 11:00 AM GMT-0700
La Tubería Multiagente Vie, 26 de junio · 7:00 PM CDT · En línea organizado por Advanced AI Concepts-Chicago

La Tubería Multiagente Vie, 26 de junio · 7:00 PM CDT · En línea organizado por Advanced AI Concepts-Chicago

Offline
Construyendo QA en la Era de la IA: Reunión de Norteamérica. Lunes, 22 de junio · 8:00 a. m. ADT · En línea por The Test Tribe Halifax. 1 asistente.

Construyendo QA en la Era de la IA: Reunión de Norteamérica. Lunes, 22 de junio · 8:00 a. m. ADT · En línea por The Test Tribe Halifax. 1 asistente.

OfflineMonday, Jun 22 · 8:00 AM to 10:00 AM GMT-0300
Webinar sobre la transformación del rol de Scrum Master y Product Owner con IA Sábado, 27 de junio · 7:30 PM ADT · En línea por Scrum Canada Meetup.

Webinar sobre la transformación del rol de Scrum Master y Product Owner con IA Sábado, 27 de junio · 7:30 PM ADT · En línea por Scrum Canada Meetup.

OfflineSaturday, Jun 27 · 7:30 PM to 9:00 PM GMT-0300
Cómo la IA está transformando roles: Scrum Masters, Gerentes de Proyectos y Product Owners Sábado, 27 de junio · 11:00 AM ADT · Online por Scrum Canada Meetup.

Cómo la IA está transformando roles: Scrum Masters, Gerentes de Proyectos y Product Owners Sábado, 27 de junio · 11:00 AM ADT · Online por Scrum Canada Meetup.

OfflineSaturday, Jun 27 · 11:00 AM to 12:30 PM GMT-0300
Seminario en línea de (CS)²AI; Cómo proteger las operaciones ICS/OT con MITRE D3FEND Mié, 24 de junio · 2:00 PM ADT·En línea por Halifax Cyber Security for Control Systems

Seminario en línea de (CS)²AI; Cómo proteger las operaciones ICS/OT con MITRE D3FEND Mié, 24 de junio · 2:00 PM ADT·En línea por Halifax Cyber Security for Control Systems

OfflineWednesday, Jun 24 · 2:00 PM to 3:30 PM GMT-0300
Seminario en línea de (CS)²AI Online™: Optimización de un conjunto de herramientas comunitarias de OS gratuito para ICS/OT Mié, 1 de julio · 2:00 PM ADT · En línea por Halifax Cyber Security para Sistemas de Control 1 asistente

Seminario en línea de (CS)²AI Online™: Optimización de un conjunto de herramientas comunitarias de OS gratuito para ICS/OT Mié, 1 de julio · 2:00 PM ADT · En línea por Halifax Cyber Security para Sistemas de Control 1 asistente

OfflineWednesday, Jul 1 · 2:00 PM to 3:30 PM GMT-0300
IA en Acción: Desde la Planta de Fabricación hasta la Sala de Junta Directiva, Jue, 16 de julio · 6:30 PM CEST por Munich PMO, Profesionales de Proyectos, Programas y Portafolios.

IA en Acción: Desde la Planta de Fabricación hasta la Sala de Junta Directiva, Jue, 16 de julio · 6:30 PM CEST por Munich PMO, Profesionales de Proyectos, Programas y Portafolios.

Offline
Estrategias impulsadas por IA: Diseño de un proyecto en línea estructurado

Estrategias impulsadas por IA: Diseño de un proyecto en línea estructurado

OfflineMonday, Jun 22 · 3:00 PM to 4:30 PM GMT-0400
🧠 Club de Conversación en Inglés Gratis con Anfitrión Nativo (+Retroalimentación AI) Todos los Domingos, Lunes, Martes, Miércoles, Jueves, Viernes, Sábados · 20 de junio · 4:00 PM EEST · En línea por 🎙️Club de Conversación en Inglés en Línea Gratis de Kiev.

🧠 Club de Conversación en Inglés Gratis con Anfitrión Nativo (+Retroalimentación AI) Todos los Domingos, Lunes, Martes, Miércoles, Jueves, Viernes, Sábados · 20 de junio · 4:00 PM EEST · En línea por 🎙️Club de Conversación en Inglés en Línea Gratis de Kiev.

Offline
Club de Conversación 'Inglés para la Sostenibilidad' 🌎

Club de Conversación 'Inglés para la Sostenibilidad' 🌎

OfflineThursday, Jun 25 · 12:00 PM to 1:00 PM GMT-0400

Plataforma de inteligencia artificial

Precios en el sitio web