
Як розгорнути багатомодельну архітектуру
Опис
Протягом останніх кількох років компанії зверталися до великих фронтальних моделей для створення своїх AI-додатків, оскільки вони могли вирішувати більшість випадків використання і були єдиними реальними варіантами для використання в масштабах. Але цей світ швидко змінюється, і сьогодні команди, що випускають найкращі AI-продукти, все частіше звертаються до менших, спеціалізованих моделей, оскільки вони перевершують загальнопрофільні за основними завданнями, часто працюють набагато швидше і можуть бути розгорнуті за мізерію вартості.Деякі загальні приклади, про які ми думаємо, це AI голосу, який може реагувати в реальному часі, швидке отримання даних у структурованих документах, або прогнози за таблицями, які використовують бізнеси.Приєднуйтесь до Baseten та лідерів з Gradium, Synthefy та Sid.ai на напої, закуски, веселощі та відверту розмову про те, чому індустрія переходить до багатомодельного світу та як Baseten може допомогти в його реалізації.Ми збираємо разом лідерів у трьох лабораторіях, які працюють над цим новим світом:Панель буде модерувати Бола Малек, керівник Baseten для Модельних Лабораторій. Вони розкажуть, що їх моделі можуть робити, чого не може загальнопрофільна модель, де проходить межа між спеціалістом та загальним фахівцем, і що потрібно для ефективного та масштабованого управління парком моделей у виробництві.Цю подію проводить Baseten — платформа для навчання та інференції, яка стоїть за деякими з найвимогливіших AI навантажень у виробництві, такими як Abridge, Cursor, Notion та OpenEvidence. Більшість приносить свої власні моделі. Ми робимо їх швидкими.
Місце проведення
Розкажіть своїй мережі, що ви йдете
Поділіться цією подією, щоб розпочати розмови, запросити колег та налагодити контакти до її початку.