Dodaj wydarzenie
To, co dotyczy osadzeń i AI w mowie

To, co dotyczy osadzeń i AI w mowie

07 paź 202615:00 - 17:00 Asia/SingaporeSingapore, Singapore0 UczestnikówOpen

Opis

Jak modele AI reprezentują to, co mamy na myśli, i rozumieją sposób, w jaki mówimy? Dołącz do badaczy i praktyków, którzy badają modele osadzeń i mowy, od badań, przez ocenę, po rzeczywiste zastosowania, aż po dostosowywanie modeli do kontekstu wielojęzycznego. Dowiedz się o podejściach i kompromisach związanych z budowaniem modeli, które lepiej działają w zależności od języków, mowy i kontekstów, w jakich są używane. Wkrótce więcej informacji, bądź na bieżąco! 👀 Więcej o wystąpieniach Raymond & Peerat (AI Singapore) podzielą się swoimi doświadczeniami na temat „Budowanie i ocenianie modeli osadzeń dla Azji Południowo-Wschodniej”. Dr Ivan Kukanow & Zheng Xin (KLASS Engineering & Solutions) zaprezentują "Singlish, Can or Not? Dostosowanie i ocena TTS Zero-Shot dla Singlish" („Systemy mowy KLASS”) Więcej o prelegentach Raymond Ng jest inżynierem AI w zespole SEA-LION w AI Products, AI Singapore. Raymond głównie przyczynia się do pre-treningu i dalszego pre-treningu projektu SEA-LION (LLM i modele osadzeń), a także prac badawczych nad Wielojęzycznymi Modelami Języków Naturalnych. Raymond posiada tytuł magistra technologii (MTech) w dziedzinie systemów inteligentnych z Narodowego Uniwersytetu Singapuru (NUS). Peerat Limkonchotiwat jest członkiem zespołu badawczego w AI Products, AI Singapore, pod opieką NTU. Jego zadaniem jest rozwijanie i badanie rozwiązań związanych z NLP w Azji Południowo-Wschodniej (SEA), takich jak SEA-LION, SEA-HELM, SEA-Guard oraz embeddingi SEA-LION. Te modele są skoncentrowane na przemyśle i odzwierciedlają potrzeby w SEA, w tym postęp w LLM, bezpieczeństwo i embeddingi dla RAG. Ponadto pracuje jako główny współpracownik SEACrowd, projektu non-profit, który gromadzi dane w SEA oraz prowadzi badania SEA, takie jak SEACrowd (EMNLP’24) i SEA-VL (ACL’25). Dodatkowo jest także badaczem afiliowanym na Uniwersytecie Chulalongkorn w Tajlandii oraz członkiem rady doradczej SIGSEA. Vincent Nguyen jest głównym naukowcem danych w GoTo Group w Singapurze, gdzie prowadzi inicjatywy GenAI oraz multimodalne LLM. Wcześniej był postdoktoranckim badaczem AI w CSIRO’s Data61 w Australii, stosując NLP w adaptacji klimatycznej i opiece zdrowotnej. Posiada doktorat z informatyki z Australian National University (ANU) oraz tytuł licencjata (z wyróżnieniem) z Uniwersytetu w Sydney. Jego prace koncentrują się na wdrażaniu najnowszych badań akademickich w modelach bazowych, uczeniu reprezentacyjnym i AI produkcyjnym w szeroko zakrojonych przypadkach użycia o regionalnym wpływie. Dr Ivan Kukanov jest głównym badaczem w KLASS Engineering and Solutions w Singapurze. Posiada doktorat z Uniwersytetu Wschodniej Finlandii w zakresie nauki, technologii i informatyki, obecnie prowadzi badania nad wykrywaniem głębokich fałszywek audio-wizualnych i oszustw. Wcześniej był związany z Instytutem Badań Infokommunikacyjnych (I²R), A*STAR w Singapurze, a jego badania obejmują także rozpoznawanie emocji, weryfikację mówcy oraz tłumaczenie mowy. Publikował w czołowych czasopismach, takich jak ICASSP, INTERSPEECH oraz IEEE TASLP, a także w międzynarodowych ocenach, takich jak 1M-Deepfake Detection Challenge w 2025 roku, zajmując 3. miejsce w rankingu międzynarodowym. Dr Kukanov przyczynił się również do społeczności badawczej jako współorganizator wyzwań ASVspoof 5 i RADAR-2026, przyczyniając się do międzynarodowego benchmarking systemów wykrywania oszustw i głębokich fałszywek. Zheng Xin Chai jest inżynierem uczenia maszynowego w KLASS Engineering and Solutions w Singapurze, z dziesięcioletnim doświadczeniem w zakresie zastosowań badań i inżynierii w dziedzinie nauki obronnej i bezpieczeństwa wewnętrznego. Jego prace koncentrują się głównie na przetwarzaniu mowy i języku naturalnym, rozwijaniu i tłumaczeniu technologii uczenia maszynowego na zastosowania praktyczne. Jego ostatnie prace obejmują automatyczne rozpoznawanie mowy, audio-wizualne rozpoznawanie mowy (AVSR) oraz text-to-speech (TTS), w tym dostosowywanie technologii mowy do Singlish. Jego wcześniejsze prace obejmowały web-adaptive information extraction, wizualne odpowiadanie na pytania (VQA) oraz multimodalne systemy AI. Przyczynił się do rozwoju i oceny end-to-end pipeline'ów uczenia maszynowego, w tym oceny rozwiązań open-source według określonych wymagań technicznych oraz ich integracji w praktycznych zastosowaniach. Więcej o serii AI Wednesdays to cotygodniowe spotkania Lorong AI, gromadzące praktyków, badaczy i innowatorów do technicznych dyskusji na temat wniosków z badań, rozwoju produktów i praktyk inżynieryjnych. Weź udział: Dowiedz się więcej o Lorong AI | Zarejestruj się jako mówca | Społeczność WhatsApp | LinkedIn | X

Lokalizacja wydarzenia

Daj swojej sieci znać, że idziesz

Udostępnij to wydarzenie, aby rozpocząć rozmowy, zaprosić kolegów i nawiązać kontakty przed jego rozpoczęciem.

Powiązane wydarzenia

Platforma sztucznej inteligencji

Bezpłatnie
Zarejestruj się za darmo