
Die eine über Embeddings & Sprach-KI
Beschreibung
Wie repräsentieren KI-Modelle, was wir meinen, und verstehen die Art und Weise, wie wir sprechen? Begleiten Sie Forscher und Praktiker, während sie Embedding- und Sprachmodelle erkunden, von Forschung, Bewertung und realen Anwendungen bis hin zur Anpassung von Modellen an mehrsprachige Kontexte. Erfahren Sie mehr über die Ansätze und Kompromisse beim Aufbau von Modellen, die besser für die Sprachen, die Sprache und die Kontexte funktionieren, in denen sie verwendet werden. Weitere Informationen folgen bald, bleiben Sie dran! 👀 Mehr über die Präsentationen Raymond & Peerat (AI Singapore) werden über “Aufbau und Bewertung von Embedding-Modellen für Südostasiens” berichten. Dr. Ivan Kukanow & Zheng Xin (KLASS Engineering & Solutions) werden über „Singlish, Can or Not? Feinabstimmung und Bewertung von Zero-Shot TTS für Singapore English” (“Sprachsysteme von KLASS”) berichten. Mehr über die Sprecher Raymond Ng ist KI-Ingenieur im SEA-LION-Team bei AI Products, AI Singapore. Raymond trägt hauptsächlich zur Vorab- und fortlaufenden Vorabtraining für das SEA-LION-Projekt (LLM- und Embedding-Modelle) sowie zur Forschung zu mehrsprachigen großen Sprachmodellen bei. Raymond hat einen Master of Technology (MTech) im Bereich Intelligente Systeme von der National University of Singapore (NUS). Peerat Limkonchotiwat ist Research Fellow bei AI Product, AI Singapore, unter dem Host von NTU. Seine Verantwortung besteht darin, um die Entwicklung und Forschung zu südostasiatischer (SEA) NLP, wie SEA-LION, SEA-HELM, SEA-Guard und SEA-LION Embedding. Diese Modelle sind industriefokussiert und spiegeln die Bedürfnisse in SEA wider, einschließlich Fortschritte in LLMs, Sicherheit und Embeddings für RAG. Darüber hinaus arbeitet er auch als Hauptmitarbeiter von SEACrowd, einem gemeinnützigen Projekt, das Daten in SEA sammelt und SEA-Forschung betreibt, wie SEACrowd (EMNLP’24) und SEA-VL (ACL’25). Zusätzlich ist er auch assoziierter Forscher an der Chulalongkorn-Universität in Thailand und Mitglied des Beirats von SIGSEA. Vincent Nguyen ist Lead Data Scientist bei GoTo Group in Singapur, wo er GenAI- und multimodale LLM-Initiativen leitet. Zuvor war er Postdoc-Forscher für KI beim CSIRO Data61 in Australien und wandte NLP auf die Anpassung an den Klimawandel und das Gesundheitswesen an. Er hat einen Ph.D. in Informatik von der Australian National University (ANU) und einen B.S. (Adv) (Hons) von der University of Sydney. Seine Arbeit konzentriert sich darauf, die neuesten akademischen Forschungen zu Grundlagenmodellen, Repräsentationslernen und Produktions-KI auf großangelegte, produktionsgerechte Anwendungsfälle mit regionaler Auswirkung zu bringen. Dr. Ivan Kukanov ist Principal Researcher bei KLASS Engineering und Solutions, Singapur. Er hat einen Doktortitel von der University of Eastern Finland in Wissenschaft, Technologie und Informatik und leitet derzeit die Forschung zur Erkennung von audio-visuellen Deepfake- und Spoofing-Anwendungen. Ehemals am Institute for Infocomm Research (I²R), A*STAR Singapur, umfasst seine Forschungsarbeit auch die Emotionserkennung, die Identitätsüberprüfung von Sprechern und die Sprachübersetzung. Er hat in bedeutenden Fachzeitschriften wie ICASSP, INTERSPEECH und IEEE TASLP veröffentlicht sowie an internationalen Bewertungen wie der 1M-Deepfake Detection Challenge 2025 teilgenommen, bei der er international den 3. Platz belegte. Dr. Kukanov hat auch zur Forschungsgemeinschaft beigetragen, als Mitorganisator der ASVspoof 5 und RADAR-2026 Challenges und damit zur internationalen Benchmarking von Spoofing- und Deepfake-Erkennungssystemen beigetragen. Zheng Xin Chai ist Maschinenbauingenieur bei KLASS Engineering und Solutions, Singapur, mit einem Jahrzehnt Erfahrung in angewandter Forschung und Technik in den Bereichen Verteidigungswissenschaft und nationale Sicherheit. Seine Arbeit konzentriert sich hauptsächlich auf Sprach- und natürliche Sprachverarbeitung, die Entwicklung und Übersetzung von Technologien zur maschinellen Lernens in praktische Anwendungen. Zu seinen jüngsten Arbeiten gehören automatische Spracherkennung, audio-visuelle Spracherkennung (AVSR) und Text-to-Speech (TTS), einschließlich der Anpassung von Sprachtechnologien an das Singapurer Englisch. Seine frühere Arbeit befasste sich mit web-adaptiver Informationsextraktion, visueller Fragebeantwortung (VQA) und multimodalen KI-Systemen. Er hat zur Entwicklung und Bewertung end-to-end-Pipelines für maschinelles Lernen beigetragen, einschließlich der Bewertung von Open-Source-Lösungen gegen festgelegte technische Anforderungen und deren Integration in praktische Anwendungen. Mehr über die Serie AI Wednesdays ist das wöchentliche Treffen von Lorong AI, das Praktiker, Forscher und Innovatoren zusammenbringt, um technische Diskussionen über Forschungserkenntnisse, Produktentwicklung und Ingenieurpraktiken zu führen. Engagieren Sie sich: Erfahren Sie mehr über Lorong AI | Sprecheranmeldung | WhatsApp-Community | LinkedIn | X
Veranstaltungsort
Lassen Sie Ihr Netzwerk wissen, dass Sie dabei sind
Teilen Sie diese Veranstaltung, um Gespräche zu beginnen, Kollegen einzuladen und sich vorab zu vernetzen.











