Submit Event
Fundación Agentics: Los SLMs deben ponerse en forma

Fundación Agentics: Los SLMs deben ponerse en forma

18 jul. 202611:00 - 15:00 Asia/KolkataBengaluru, India3 AttendeesOpen

Description

Fundación Agentics: Los SLMs se Ponen en Forma Entrena Modelos Pequeños con Aprendizaje por Refuerzo Una sesión interactiva de construcción para cualquier persona curiosa sobre cómo los modelos de IA pueden aprender a través de la acción, la retroalimentación y las recompensas, no solo a través de instrucciones. Exploraremos cómo los Modelos de Lenguaje Pequeños de 1B a 3B pueden conectarse a entornos al estilo de RL Gym usando OpenEnv, entrenados para jugar juegos al estilo de Atari de la vieja escuela, y evaluados a través de señales de recompensa reales. Esto está diseñado tanto para participantes técnicos como no técnicos. Los desarrolladores pueden explorar modelos, bucles de entrenamiento, entornos y evaluación; los constructores no técnicos pueden contribuir a través de estrategias de juego, diseño de recompensas, pruebas, pensamiento de producto y diseño de casos de uso empresarial. El objetivo no es solo entender el RL a través de juegos, sino ver cómo los mismos conceptos pueden mejorar los sistemas agenticos del mundo real. También compartiremos demostraciones internas que mostrarán cómo los bucles de retroalimentación al estilo de RL pueden aplicarse a flujos de trabajo empresariales, decisiones operativas, experiencias del cliente, automatización y rendimiento de agentes. 📅 Programa Apertura de Puertas: 10:45 AMHora de Inicio: 11:00 AM 11:00 AM — Introducción: SLMs, RL y Comportamiento del AgenteUna explicación simple de cómo los modelos aprenden a través de entornos, acciones, recompensas y retroalimentación. 11:30 AM — Taller de OpenEnv + RL GymConectar un modelo pequeño a un entorno de juego, ejecutar el bucle de acción y comprender observaciones, acciones, recompensas y episodios. 12:15 PM — Construir un Agente de Juego PequeñoTrabajar en equipos para conectar un modelo de 1B–3B a un entorno al estilo de Atari y probar su comportamiento. 1:15 PM — Ajuste Fino y Post-entrenamientoExplorar enfoques ligeros para mejorar el comportamiento del modelo a través de trayectorias, recompensas y retroalimentación. 2:15 PM — De Juegos a Flujos de Trabajo EmpresarialesVer demostraciones internas de cómo los principios de RL pueden aplicarse a sistemas empresariales reales: toma de decisiones, optimización de tareas, operaciones con clientes, automatización de flujos de trabajo y agentes fiables. 3:00 PM — Demostraciones, Aprendizajes y ConclusionesLos equipos comparten lo que construyeron, lo que funcionó, lo que falló y dónde ven que el RL será útil a continuación. 👥 ¿Quién Debería Asistir? No se requiere experiencia previa en RL. Traiga una computadora portátil, curiosidad y disposición para experimentar. ¿Por qué Participar? Este no es un evento solo de conferencias. Es un laboratorio práctico para constructores que quieren entender hacia dónde se dirigen los sistemas agenticos a continuación.

Event location

Let your network know you're going

Share this event to start conversations, invite colleagues, and connect before it begins.

about_us.editorial_intelligence_platform

Free