arrow
Back
S

Shinji Watanabe

Carnegie Mellon University

74H-index
1.2KPaper Count
2.5WCitation Count
Published Papers 48
Publication Date
Recent trends in distant conversational speech recognition: A review of CHiME-7 and 8 DASR challenges
err2025-11-01
err0
PREAI
errSamuele Cornell; Christoph Boeddeker; Taejin Park; He Huang; Desh Raj; Matthew Wiesner; Yoshiki Masuyama; Xuankai Chang; Zhong-Qiu Wang; Stefano Squartini; Paola Garcia; Shinji Watanabe
errShare
errSave
An end-to-end integration of speech separation and recognition with self-supervised learning representation
err2025-05-21
err0
errOAAI
errYoshiki Masuyama; Xuankai Chang; Wangyou Zhang; Samuele Cornell; Zhong-Qiu Wang; Nobutaka Ono; Yanmin Qian; Shinji Watanabe
errShare
errSave
Guest Editorial: IEEE JSTSP Special Issue on Deep Multimodal Speech Enhancement and Separation (DEMSES)
err2025-05-01
err0
PREAI
errAmir Hussain; Yu Tsao; John H.L. Hansen; Naomi Harte; Shinji Watanabe; Isabel Trancoso; Shixiong Zhang
errShare
errSave
MC-Whisper: Extending Speech Foundation Models to Multichannel Distant Speech Recognition
err2024-01-01
err0
PREAI
errChang, Xuankai; Guo, Pengcheng; Fujita, Yuya; Maekaku, Takashi; Watanabe, Shinji
errShare
errSave
errShare
errSave
Smarter Aging: Developing a Foundational Elderly Activity Monitoring System With AI and GUI Interface
err2024-01-01
err3
errOAAI
errHtet, Ye; Zin, Thi Thi; Tin, Pyke; Tamura, Hiroki; Kazuhiro, Kondo; Watanabe, Shinji; Chosa, Etsuo
errShare
errSave
Text-Inductive Graphone-Based Language Adaptation for Low-Resource Speech Synthesis
err2024-01-01
err3
errOAAI
errSaeki, Takaaki; Maiti, Soumi; Li, Xinjian; Watanabe, Shinji; Takamichi, Shinnosuke; Saruwatari, Hiroshi
errShare
errSave
A Large-Scale Evaluation of Speech Foundation Models
err2024-01-01
err1
errOAAI
errYang, Shu-wen; Chang, Heng-Jui; Huang, Zili; Liu, Andy T.; Lai, Cheng-, I; Wu, Haibin; Shi, Jiatong; Chang, Xuankai; Tsai, Hsiang-Sheng; Huang, Wen-Chin; Feng, Tzu-hsun; Chi, Po-Han; Lin, Yist Y.; Chuang, Yung-Sung; Huang, Tzu-Hsien; Tseng, Wei-Cheng; Lakhotia, Kushal; Li, Shang-Wen; Mohamed, Abdelrahman; Watanabe, Shinji; Lee, Hung-yi
errShare
errSave
STFT-Domain Neural Speech Enhancement With Very Low Algorithmic Latency
err2023-01-01
err14
errOAAI
errWang, Zhong-Qiu; Wichern, Gordon; Watanabe, Shinji; Le Roux, Jonathan
errShare
errSave
Improving Speech Enhancement Performance by Leveraging Contextual Broad Phonetic Class Information
err2023-01-01
err1
errOAAI
errLu, Yen-Ju; Chang, Chia-Yu; Yu, Cheng; Liu, Ching-Feng; Hung, Jeih-weih; Watanabe, Shinji; Tsao, Yu
errShare
errSave
A dilemma of ground truth in noisy speech separation and an to lessen the of data
err2023-01-01
err0
errOAAI
errMaciejewski, Matthew; Shi, Jing; Watanabe, Shinji; Khudanpur, Sanjeev
errShare
errSave
LegoNN: Building Modular Encoder-Decoder Models
err2023-01-01
err3
errOAAI
errDalmia, Siddharth; Okhonko, Dmytro; Lewis, Mike; Edunov, Sergey; Watanabe, Shinji; Metze, Florian; Zettlemoyer, Luke; Mohamed, Abdelrahman
errShare
errSave
Online Neural Diarization of Unlimited Numbers of Speakers Using Global and Local Attractors
err2023-01-01
err11
errOAAI
errHoriguchi, Shota; Watanabe, Shinji; Garcia, Paola; Takashima, Yuki; Kawaguchi, Yohei
errShare
errSave
errShare
errSave
Self-Supervised Speech Representation Learning: A Review
err2022-10-01
err92
errOAAI
errMohamed, Abdelrahman; Lee, Hung-yi; Borgholt, Lasse; Havtorn, Jakob D.; Edin, Joakim; Igel, Christian; Kirchhoff, Katrin; Li, Shang-Wen; Livescu, Karen; Maaloe, Lars; Sainath, Tara N.; Watanabe, Shinji
errShare
errSave
Editorial Editorial of Special Issue on Self-Supervised Learning for Speech and Audio Processing
err2022-10-01
err0
errOAAI
errLee, Hung-Yi; Watanabe, Shinji; Livescu, Karen; Mohamed, Abdelrahman; Sainath, Tara
errShare
errSave
errShare
errSave
An investigation of neural uncertainty estimation for target speaker extraction equipped RNN transducer
err2022-05-01
err1
PREAI
errShi, Jiatong; Zhang, Chunlei; Weng, Chao; Watanabe, Shinji; Yu, Meng; Yu, Dong
errShare
errSave
A review of speaker diarization: Recent advances with deep learning
err2022-03-01
err161
errOAAI
errPark, Tae Jin; Kanda, Naoyuki; Dimitriadis, Dimitrios; Han, Kyu J.; Watanabe, Shinji; Narayanan, Shrikanth
errShare
errSave
Joint speaker diarization and speech recognition based on region proposal networks
err2022-03-01
err7
PREAI
errHuang, Zili; Delcroix, Marc; Garcia, Leibny Paola; Watanabe, Shinji; Raj, Desh; Khudanpur, Sanjeev
errShare
errSave