Not logged in
Share
SaveSpeechX: Neural Codec Language Model as a Versatile Speech Transformer
Wang, Xiaofei; Thakker, Manthan; Chen, Zhuo; Kanda, Naoyuki; Eskimez, Sefik Emre; Chen, Sanyuan; Tang, Min; Liu, Shujie; Li, Jinyu; Yoshioka, Takuya
Share
Save
Share
SaveWavLM: Large-Scale Self-Supervised Pre-Training for Full Stack Speech Processing
Chen, Sanyuan; Wang, Chengyi; Chen, Zhengyang; Wu, Yu; Liu, Shujie; Chen, Zhuo; Li, Jinyu; Kanda, Naoyuki; Yoshioka, Takuya; Xiao, Xiong; Wu, Jian; Zhou, Long; Ren, Shuo; Qian, Yanmin; Qian, Yao; Zeng, Michael; Yu, Xiangzhan; Wei, Furu
Share
Save
Share
Save
Share
Save
Share
SaveSpeech recognition in living rooms: Integrated speech enhancement and recognition system based on spatial, spectral and temporal modeling of sounds
Delcroix, Marc; Kinoshita, Keisuke; Nakatani, Tomohiro; Araki, Shoko; Ogawa, Atsunori; Hori, Takaaki; Watanabe, Shinji; Fujimoto, Masakiyo; Yoshioka, Takuya; Oba, Takanobu; Kubo, Yotaro; Souden, Mehrez; Hahm, Seong-Jun; Nakamura, Atsushi
Share
Save
Share
Save