
El que trata sobre Embeddings y Speech AI
Descripción
¿Cómo representan los modelos de IA lo que queremos decir y entienden la forma en que hablamos? Únete a investigadores y profesionales mientras exploran modelos de embeddings y de voz, desde la investigación, evaluación y aplicaciones del mundo real hasta la adaptación de modelos para contextos multilingües. Escucha sobre los enfoques y compromisos detrás de la construcción de modelos que funcionan mejor para los idiomas, el habla y los contextos en los que se utilizan. ¡Pronto más información, mantén tu atención! 👀 Más sobre las presentaciones Raymond & Peerat (AI Singapore) compartirán sobre “Construcción y Evaluación de Modelos de Embedding para el Sudeste Asiático”. Dr. Ivan Kukanow & Zheng Xin (KLASS Engineering & Solutions) compartirán sobre "Singlish, ¿se puede o no? Ajuste fino y evaluación de TTS de cero disparos para el inglés de Singapur" (“Sistemas de voz de KLASS”) Más sobre los ponentes Raymond Ng es un ingeniero de IA en el equipo SEA-LION de AI Products, AI Singapore. Raymond contribuye principalmente al esfuerzo de preentrenamiento y preentrenamiento continuo para el proyecto SEA-LION (modelos de LLM y embedding), así como al trabajo de investigación sobre Modelos de Lenguaje Multilingües. Raymond tiene una Maestría en Tecnología (MTech), Sistemas Inteligentes, de la Universidad Nacional de Singapur (NUS). Peerat Limkonchotiwat es un Investigador Asociado en AI Product, AI Singapore, bajo el auspicio de NTU. Su responsabilidad es desarrollar e investigar sobre el procesamiento del lenguaje natural (NLP) del Sudeste Asiático (SEA), como SEA-LION, SEA-HELM, SEA-Guard y SEA-LION Embedding. Estos modelos son centrados en la industria y reflejan las necesidades en SEA, incluidos los avances en LLMs, seguridad y embeddings para RAG. Además, también trabaja como contribuidor principal de SEACrowd, un proyecto de organización sin fines de lucro que recopila datos en SEA y realiza investigaciones en SEA, como SEACrowd (EMNLP’24) y SEA-VL (ACL’25). Además, es investigador afiliado en la Universidad de Chulalongkorn, Tailandia, y miembro del consejo asesor de SIGSEA. Vincent Nguyen es Científico de Datos Principal en GoTo Group en Singapur, donde lidera iniciativas de GenAI y LLM multimodal. Anteriormente, fue Investigador Postdoctoral en IA en Data61 de CSIRO en Australia, aplicando NLP a la adaptación climática y la salud. Tiene un Ph.D. en Ciencias de la Computación de la Universidad Nacional de Australia (ANU) y un B.S. (Avanzado) (Hons) de la Universidad de Sídney. Su trabajo se centra en llevar la última investigación académica en modelos de base, aprendizaje de representación y IA de producción a casos de uso a gran escala y de calidad de producción con un impacto regional. Dr. Ivan Kukanov es Investigador Principal en KLASS Engineering y Solutions, Singapur. Tiene un PhD de la Universidad del Este de Finlandia en Ciencia, Tecnología y Computación, liderando actualmente investigaciones en detección de deepfake y suplantación audiovisual. Anteriormente en el Instituto de Investigación de Infocomm (I²R), A*STAR Singapur, su trabajo de investigación también incluye reconocimiento de emociones, verificación de hablantes y traducción de voz. Ha publicado en las principales conferencias como ICASSP, INTERSPEECH y IEEE TASLP, así como en evaluaciones internacionales como el Desafío de Detección de Deepfake 1M en 2025, ocupando el 3er lugar a nivel internacional. El Dr. Kukanov también ha contribuido a la comunidad de investigación como coorganizador de los Desafíos ASVspoof 5 y RADAR-2026, contribuyendo a la evaluación internacional de sistemas de detección de suplantación y deepfake. Zheng Xin Chai es Ingeniero de Aprendizaje Automático en KLASS Engineering y Solutions, Singapur, con una década de experiencia que abarca investigación aplicada e ingeniería en los dominios de ciencia de defensa y seguridad nacional. Su trabajo se centra principalmente en el procesamiento de voz y lenguaje natural, desarrollando y traduciendo tecnologías de aprendizaje automático en aplicaciones prácticas. Su trabajo reciente incluye reconocimiento automático de voz, reconocimiento de voz audiovisual (AVSR) y texto a voz (TTS), incluida la adaptación de tecnologías de voz al inglés de Singapur. Su trabajo anterior exploró la extracción de información adaptativa a la web, respuestas a preguntas visuales (VQA) y sistemas de IA multimodal. Ha contribuido al desarrollo y evaluación de pipelines de aprendizaje automático de extremo a extremo, incluida la evaluación de soluciones de código abierto en relación con los requisitos técnicos definidos e integrándolas en aplicaciones prácticas. Más sobre la serie AI Wednesdays es la reunión semanal de Lorong AI, que reúne a profesionales, investigadores e innovadores para discusiones técnicas sobre conocimientos de investigación, desarrollo de productos y prácticas de ingeniería. Involúcrate: Aprende más sobre Lorong AI | Inscripción de Ponentes | Comunidad de WhatsApp | LinkedIn | X
Ubicación del evento
Dile a tu red que vas a ir
Comparte este evento para iniciar conversaciones, invitar colegas y conectar antes de que comience.











