
Могут ли агенты действительно самосовершенствоваться?
Описание
Практический вечер, посвященный созданию агента, который доказуемо становится лучше: симулировать крайние случаи, оценивать по результатам и контролировать каждую версию, чтобы следующая версия выходила только в том случае, если она обходит последнюю. Вы уйдете с циклом, построенным на открытых инструментах, работающим на ноутбуке. Детали мероприятия "Самосовершенствующиеся агенты" сейчас активно обсуждаются в питч-деклах. Часть из этого — реальность, большая ее часть — нет, и этот вечер отделяет одно от другого, создавая реальную версию на ваших глазах. Мы вместе построим реальную версию в режиме реального времени, чтобы показать разницу. Прежде чем что-либо дойдет до производства, мы симулируем синтетических пользователей и противодействующие сценарии, чтобы выявить, где агент ломается, оцениваем эти прогоны по результатам и возвращаем ошибки обратно. Оценка становится фильтром: ничего не выходит, если цифры не улучшаются. Затем мы продолжаем работу, направляя поток производственного трафика обратно через те же оценки, чтобы регрессии проявлялись в виде снижения баллов, а не заявок на поддержку. Полное рекурсивное самосовершенствование все еще остается открытой исследовательской задачей, и мы не будем это скрывать, но ограниченная версия уже может быть построена сегодня, на OpenTelemetry и открытых фреймворках, которые вы можете форкнуть и самостоятельно разместить. Ведущий мастер-класса Никил, основатель и генеральный директор Future AGI, проводит сборку вживую, от начала до конца. Он проводит дни, работая над именно той проблемой, о которой идет речь сегодня вечером: как сделать агентов достаточно надежными, чтобы им можно было доверять в производстве, и достаточно измеримыми, чтобы знать, что они действительно улучшаются. Принесите ноутбук, чтобы: Инструментировать базовый агент с OpenTelemetry и зафиксировать его стартовые оценки Симулировать синтетических пользователей и противодействующие сценарии, чтобы сломать его намеренно Оценивать прогоны по результатам, чтобы ошибки стали цифрами, а не анекдотами Читать трассировки, чтобы найти настоящую корневую причину, а не гадать по выходным данным Вводить исправления обратно, затем повторно симулировать, чтобы подтвердить, что оценки улучшились Фильтровать публикацию: продвигать новую версию только если она лучше последней Направлять производственный трафик обратно через те же оценки, чтобы продолжать улучшаться Повестка 17:30 - Угощения и приветствия 18:00 - Гостевой спикер (будет объявлено) 19:00 - Живостроительство: цикл самосовершенствования, который действительно отправляется (принесите ноутбук) 19:30 - Открытое обсуждение и Вопросы-Ответы: хайп против того, что работает 20:00 - Нетворкинг 20:30 - Увидимся на следующей итерации Для инженеров и создателей продуктов ИИ, которые запускают агентов в производстве и хотят версию, которая доказуемо улучшается, построенную на открытых инструментах, которые они могут сохранить.
Место проведения
Расскажите своей сети, что вы идёте
Поделитесь этим событием, чтобы начать разговоры, пригласить коллег и наладить контакты до его начала.







