Publication Streaming Multi-Talker ASR with Token-Level Serialized Output Training Naoyuki Kanda, Jian Wu, Yu Wu, Xiong Xiao, Zhong Meng, Xiaofei Wang, Yashesh Gaur, Zhuo Chen, Jinyu Li, Takuya Yoshioka Interspeech 2022 | September 2022
Publication Streaming Speaker-Attributed ASR with Token-Level Speaker Embeddings Naoyuki Kanda, Jian Wu, Yu Wu, Xiong Xiao, Zhong Meng, Xiaofei Wang, Yashesh Gaur, Zhuo Chen, Jinyu Li, Takuya Yoshioka Interspeech 2022 | September 2022
Publication Multi-Modal Multi-Correlation Learning for Audio-Visual Speech Separation Xiaoyu Wang, Xiangyu Kong, Xiulian Peng, Yan Lu INTERSPEECH 2022 | September 2022
Publication Internal Language Model Adaptation with Text-Only Data for End-to-End Speech Recognition Zhong Meng, Yashesh Gaur, Naoyuki Kanda, Jinyu Li, Xie Chen, Yu Wu, Yifan Gong Interspeech 2022 | September 2022
Publication VarArray Meets t-SOT: Advancing the State of the Art of Streaming Distant Conversational Speech Recognition Naoyuki Kanda, Jian Wu, Xiaofei Wang, Zhuo Chen, Jinyu Li, Takuya Yoshioka arXiv:2209.04974 | September 2022
Publication Leveraging Real Conversational Data for Multi-Channel Continuous Speech Separation Xiaofei Wang, Dongmei Wang, Naoyuki Kanda, Sefik Emre Eskimez, Takuya Yoshioka INTERSPEECH 2022 | September 2022
Publication Performance optimizations on deep noise suppression models Jerry Chee, Sebastian Braun, Vishak Gopal, Ross Cutler IEEE Workshop on Multimedia Signal Processing (MMSP) | September 2022 Project
Publication Predicting score distribution to improve non-intrusive speech quality estimation Abu Zaher Md Faridee, Hannes Gamper Interspeech | September 2022
Publication Fast Real-time Personalized Speech Enhancement: End-to-End Enhancement Network (E3Net) and Knowledge Distillation Manthan Thakker, Sefik Emre Eskimez, Takuya Yoshioka, Huaming Wang Interspeech 2022 | September 2022
Publication Task splitting for DNN-based acoustic echo and noise removal Sebastian Braun, Maria Luis Valero IWAENC | September 2022 Project