
BRISA Reading Group 04 - LeWorldModel
Опис
Перед нашим официальным запуском этой осенью мы продолжаем нашу предзапусковую серию с очередной читающей группой: будем читать статью, правильно её понимать и задаваться вопросом, что понадобится для того, чтобы построить это самостоятельно. Наша четвёртая статья - LeWorldModel: стабильная энд-ту-энд совместная встраиваемая предсказательная архитектура из пикселей (Маес и др., 2026), которая задает вопрос: Насколько простой может стать модель мира, оставаясь при этом полезной для планирования? Модели мира учатся предсказывать, как окружающая среда может измениться при различных действиях, что позволяет сравнивать возможные будущие варианты перед тем, как действовать. LeWorldModel, или LeWM, использует относительно простой подход. Вместо того, чтобы предсказывать будущие изображения пиксель за пикселем, он учится компактному представлению сцены и предсказывает, как это представление изменяется при выполнении различных действий. Одним из основных вызовов этой модели является предотвращение коллапса изученных представлений во время тренировки. LeWM использует SIGReg для стабилизации этого процесса, позволяя всей модели обучаться непосредственно из пикселей и действий без использования предобученного визуального кодировщика. В результате модель имеет около 15 миллионов параметров, может обучаться на одном GPU всего за несколько часов и использует свою изученную динамику для планирования достижения цели. Авторы сообщают о планировании до 48 раз быстрее, чем DINO-WM, оставаясь при этом конкурентоспособными по нескольким оцененным задачам управления. Особенно интересно, что для этого подхода требуется так мало машин. Это поднимает возможность того, что относительно маленькие модели мира могут уже быть достаточными для изучения полезной динамики и поддержания эффективного планирования. На читающей группе мы рассмотрим, почему этот относительно простой подход работает, что именно модель на самом деле изучает о своей среде и где эта простота может начать становиться ограничением. Широкий вопрос заключается в следующем: Насколько далеко может зайти компактная латентная модель мира для реальной робототехники? Подготовка не требуется. Прочитайте аннотацию, если у вас есть десять минут. Все приветствуются — независимо от того, что вы изучаете, где вы учитесь и сколько робототехники вы сделали до сих пор. Приходите с вопросами, разногласиями или вашим собственным мнением о том, что модель мира для робототехники должна на самом деле учить. 🎟️ Количество мест ограничено, чтобы мы могли сделать сессию личной и интерактивной. Пожалуйста, зарегистрируйтесь заранее и приходите только если получили билет. 📍 Место проведения - Merantix AI Campus. Двери открываются в 18:30, мы начинаем в 18:45. 👋 Новички? Присоединяйтесь к группе сообщества — все остальное будет анонсировано там сначала.
Місце проведення
Розкажіть своїй мережі, що ви йдете
Поділіться цією подією, щоб розпочати розмови, запросити колег та налагодити контакти до її початку.