Oral Session: Speech Enhancement and Recognition (O2-D.T3)
Track 3: Image, Speech, Signal and Video Processing
Schedule: Monday 17 at 16h30-17h50, Gratte-Ciel 3
Details
| # | Title and Authors |
|---|---|
| 893 |
Sign-To-Speech Prosody Transfer Via Sign Reconstruction-Based Gan
Manabe, Toranosuke; Shibata, Yuto; Takamichi, Shinnosuke; Aoki, Yoshimitsu
|
| 939 |
Ps-Tts: Phonetic Synchronization In Text-To-Speech For Achieving Natural Automated Dubbing
hong, changi; song, yoonah; park, hwayoung; bang, chaewoon; ku, dayeon; lee, dohyun; kim, hongkook
|
| 1217 |
Mus: Multilingual Synergy With Shared Representations For Visual Speech Recognition
Fan, Yuheng; Yang, Shuang; Shan, Shiguang; Chen, Xilin
|
| 1468 |
Rectifying Self-Supervised Speech Representations For Diffusion-Based Speech Enhancement
Liu, Yichen; Wang, Weiqiang
|