Добавить событие
Группа изучения: Вывод в AI системах

Группа изучения: Вывод в AI системах

29 сен 20266:00 PM GMT-07:00ОнлайнOpen
LearnNetworkFind partners
TextCode

Описание

Группа изучения: Вывод LLM Присоединяйтесь к Применяемому AI Коллективу для практической группы изучения вывода LLM и vLLM — как современные языковые модели эффективно обслуживаются, что происходит после того, как запрос достигает модели, и как системы вывода балансируют задержку, пропускную способность, память и стоимость. Поскольку приложения LLM переходят от прототипов к реальным продуктам, эффективное использование модели становится важной частью AI стека. Выбрать способную модель недостаточно — создателям также необходимо понять, как эта модель развернута, как обрабатываются запросы, как используются ресурсы GPU и как производительность вывода меняется по мере увеличения трафика. Эта сессия предназначена для обсуждения, удобного для строителей, для инженеров, основателей, исследователей, создателей продуктов и энтузиастов AI, которые хотят лучше понять инфраструктуру за обслуживанием LLM в производстве. Что мы обсудим: • Что такое вывод LLM и что происходит во время обслуживания модели • Предварительная выборка против декодирования и почему у них разные характеристики производительности • Задержка, пропускная способность, токены в секунду и другие важные метрики вывода • Как пакетная обработка и непрерывная пакетная обработка улучшают использование GPU • Кэширование KV и почему это важно для производительности вывода • Введение в vLLM и как он позволяет высокопроизводительное обслуживание LLM • Пагинированное внимание и проблема, которую он был разработан для решения • Квантизация и другие техники для снижения стоимости вывода и использования памяти • Обслуживание моделей с открытым исходным кодом и размышления о GPU, размере модели и конкурентности • Открытое обсуждение вокруг фреймворков вывода, архитектур, бенчмарков и реальных проблем развертывания. Кто должен присутствовать: создатели AI, инженеры-программисты, инженеры ML, основатели, менеджеры продуктов, исследователи, студенты и все, кто интересуется тем, как LLM обслуживаются в реальных системах. Предварительная экспертиза в инфраструктуре вывода не требуется. Приносите свои вопросы, опыты с инструментами вроде vLLM, модели, которые вы развернули, или AI системы, которые вы сейчас создаете. Это группа изучения, а не формальная лекция. Цель состоит в том, чтобы изучать вместе, обсуждать практические подходы и построить лучшее понимание того, что происходит между приложением LLM и GPU, фактически выполняющими модель. Давайте создадим сильное сообщество вокруг практических, масштабируемых AI систем реального мира.

Расскажите своей сети, что вы идёте

Поделитесь этим событием, чтобы начать разговоры, пригласить коллег и наладить контакты до его начала.

Похожие события

Как Кент отправляет функции, не читая код — MEGA.dev LIVE

Как Кент отправляет функции, не читая код — MEGA.dev LIVE

Online30 сен 2026
2
Вебинар #06 – Конец агента, теряющегося в коде - Что кроме модели определяет качество? | Ведущий: Марчин Мрочковский

Вебинар #06 – Конец агента, теряющегося в коде - Что кроме модели определяет качество? | Ведущий: Марчин Мрочковский

Online29 сен 2026
1
Часы общения в офисе: Как зарабатывать деньги

Часы общения в офисе: Как зарабатывать деньги

Online23 сен 2026
96
Следующий разговор Латинской Америки: WhatsApp и интеграции в одном звонке

Следующий разговор Латинской Америки: WhatsApp и интеграции в одном звонке

Online21 окт 2026
Claude Code (Онлайн)

Claude Code (Онлайн)

Online06 окт 2026
29
SIM NY Leadership Pod | Гостевой спикер: Сатиш Шеной | Чему Антарктида научила меня о эпохе ИИ

SIM NY Leadership Pod | Гостевой спикер: Сатиш Шеной | Чему Антарктида научила меня о эпохе ИИ

Online22 окт 2026
Ваша система дизайна еще не готова к ИИ

Ваша система дизайна еще не готова к ИИ

Online09 окт 2026
Искусственный интеллект для лидеров в обучении и развитии: прекратите использовать его неправильно

Искусственный интеллект для лидеров в обучении и развитии: прекратите использовать его неправильно

Online29 окт 2026
1
Как превратить трассировки агентов и оценки в доказательства по Закону ЕС о ИИ

Как превратить трассировки агентов и оценки в доказательства по Закону ЕС о ИИ

Online08 окт 2026
Может ли ИИ помочь преодолеть разрыв в GED в Тълсе? | Службы семьи и детей

Может ли ИИ помочь преодолеть разрыв в GED в Тълсе? | Службы семьи и детей

Online24 сен 2026
Может ли ИИ помочь закрыть разрыв в получении GED в Талсе? | Служба семьи и детей

Может ли ИИ помочь закрыть разрыв в получении GED в Талсе? | Служба семьи и детей

Online22 сен 2026
Демонстрация продукта Drivetrain: Посмотрите работу AI-Native FP&A!

Демонстрация продукта Drivetrain: Посмотрите работу AI-Native FP&A!

Online08 окт 2026

Платформа искусственного интеллекта

Цены на сайте
Купить билеты