Submit Event
Fundacja Agentics: Modele SLM muszą być w formie

Fundacja Agentics: Modele SLM muszą być w formie

18 lip 202611:00 - 15:00 Asia/KolkataBengaluru, India3 AttendeesOpen

Description

Fundacja Agentics: Modele SLM w formie Training małych modeli z użyciem uczenia przez wzmocnienie Interaktywna sesja dla każdego, kto jest ciekawy, jak modele AI mogą się uczyć dzięki działaniu, informacjom zwrotnym i nagrodom — nie tylko za pomocą podpowiedzi. Zbadamy, jak modele małych języków o rozmiarze od 1B do 3B można połączyć z środowiskami w stylu RL Gym przy użyciu OpenEnv, trenować do grania w gry w stylu Atari, a także oceniać przez rzeczywiste sygnały nagród. To wydarzenie jest zaprojektowane zarówno dla uczestników technicznych, jak i nietechnicznych. Programiści mogą badać modele, pętle treningowe, środowiska i oceny; nietechniczni twórcy mogą przyczyniać się poprzez strategię gry, projektowanie nagród, testowanie, myślenie produktowe i projektowanie przypadków użycia biznesowego. Celem jest nie tylko zrozumienie uczenia przez wzmocnienie poprzez gry, ale także zobaczenie, jak te same koncepcje mogą poprawić rzeczywiste systemy agentowe. Podzielimy się także wewnętrznymi demonstracjami pokazującymi, jak pętle informacji zwrotnych w stylu RL mogą być stosowane w procesach biznesowych, decyzjach operacyjnych, doświadczeniach klientów, automatyzacji i wydajności agentów. 📅 Harmonogram Drzwi otwarte: 10:45 AMCzas rozpoczęcia: 11:00 AM 11:00 AM — Wprowadzenie: SLM, RL i zachowanie agentówProsta explicacja, jak modele uczą się dzięki środowiskom, działaniom, nagrodom i informacjom zwrotnym. 11:30 AM — Warsztat OpenEnv + RL GymPołącz mały model z środowiskiem gry, uruchom pętlę działań i zrozum obserwacje, działania, nagrody i epizody. 12:15 PM — Stwórz małego agenta do gierPracuj w zespołach, aby połączyć model o rozmiarze 1B–3B z środowiskiem w stylu Atari i testować jego zachowanie. 1:15 PM — Dostosowywanie i po-treningOdkryj lekkie podejścia do poprawy zachowania modelu przez trajektorie, nagrody i informacje zwrotne. 2:15 PM — Od gier do przepływów pracy w biznesieZobacz wewnętrzne demonstracje, jak zasady RL mogą być stosowane w rzeczywistych systemach biznesowych: podejmowanie decyzji, optymalizacja zadań, operacje związane z klientem, automatyzacja przepływów pracy i niezawodni agenci. 3:00 PM — Demonstracje, nauki i podsumowanieZespoły dzielą się tym, co zbudowały, co się sprawdziło, co się nie udało i gdzie widzą przydatność RL w przyszłości. 👥 Kto powinien uczestniczyć? Nie jest wymagane wcześniejsze doświadczenie w RL. Przynieś laptop, ciekawość i chęć eksperymentowania. Dlaczego warto uczestniczyć? To nie jest wydarzenie tylko wykładowe. To praktyczne laboratorium dla twórców, którzy chcą zrozumieć, dokąd zmierzają systemy agentowe następnie.

Event location

Let your network know you're going

Share this event to start conversations, invite colleagues, and connect before it begins.

about_us.editorial_intelligence_platform

Free