Enviar evento
Encontro de Inferência vLLM Mumbai
Automationllm-apps

Encontro de Inferência vLLM Mumbai

26 set 20268:00 AM - 11:30 AM GMT+00:00OnlineOpen

Descrição

Um encontro técnico de vLLM e llm-d em 26 de setembro de 2026, explorando a inferência escalável de LLM através de mergulhos profundos na arquitetura, lições de produção e demonstrações ao vivo. ## Dentro do motor de inferência LLM Projetado para engenheiros que desejam executar sistemas de IA generativa de forma mais rápida e eficiente, o Encontro de Inferência vLLM Mumbai vai além de discussões de alto nível para examinar a engenharia por trás da inferência em larga escala. O programa foca nas técnicas de arquitetura e otimização que ajudam as equipes a tirar melhor proveito da infraestrutura de GPU, aumentar o throughput de tokens e mover serviços LLM para produção. Os participantes ouvirão diretamente de mantenedores e contribuintes centrais que trabalham nos ecossistemas vLLM e llm-d, ao lado de profissionais da indústria com experiência em implantar sistemas de IA em produção. As sessões combinarão atualizações de projetos e palestras técnicas com demonstrações práticas de fluxos de trabalho do mundo real. ## Destaques da agenda O programa planejado inclui: - Uma introdução ao vLLM e uma atualização sobre o último desenvolvimento do projeto - Decodificação especulativa e seu papel na aceleração da inferência de IA - Uma jornada da avaliação à produção, incluindo como construir um serviço vLLM gerenciado com llm-d - Lições de equipes que implantam e servem LLMs em produção - Um laboratório prático da Sardeenz cobrindo virtualização de GPU e implantação de múltiplos modelos em uma única GPU - Demonstrações ao vivo, observações iniciais e oportunidades para trocar ideias com palestrantes e colegas engenheiros A agenda é descrita como sujeita a alterações, deixando espaço para mais conteúdo técnico e contribuições da comunidade. ## Quem deve participar? Este encontro é particularmente relevante para usuários ou contribuintes do vLLM e llm-d, engenheiros de aprendizado de máquina e infraestrutura responsáveis pela inferência e serviço de modelos, e equipes de plataforma que operam cargas de trabalho de GenAI em produção. Também será adequado para desenvolvedores que investigam inferência eficiente em ambientes locais, infraestrutura em nuvem e Kubernetes.… Registre-se para este evento

Ferramentas que serão usadas nos eventos

vLLM

llm-d

Diga à sua rede que vai participar

Partilhe este evento para iniciar conversas, convidar colegas e conectar-se antes que comece.

Tags

# Automation# llm-apps

Related events

Plataforma de inteligência artificial

Preços no site
Obter bilhetes