Awesome Computer Vision
π
Papers
π§
Topics
π₯
Trending
πΊοΈ
Map
π
Leaderboards
π
Learn
π€
Ask AI
β―
More
π₯
Authors
π
Reading Packs
π
Datasets
π οΈ
Tools
π°
News
π
Blogs
βοΈ
Newsletter
π―
Research Radar
π
Saved
+ Add Paper
βΎ
β
β authors
Β·
overview
Loading authorβ¦
π€
Ask AI
Xuesong Yang β most-cited papers & profile Β· Computer Vision
β authors
Β·
overview
Xuesong Yang
6
papers Β·
0
citations Β·
14
h-index
Google Scholar β
Semantic Scholar β
OpenAlex β
Most-cited papers
One Model, Many Latencies: Universal Speech Enhancement for Diverse Real-Time Applications
2026
MagpieTTS-LF: Inference-Time Long-Form Speech Generation Without Training on Long-Form data
2026
Frame-Stacked Local Transformers For Efficient Multi-Codebook Speech Generation
2025
Align2Speak: Improving TTS for Low Resource Languages via ASR-Guided Online Preference Optimization
2025
Acoustic Landmarks Contain More Information About the Phone String than Other Frames for Automatic Speech Recognition with Deep Neural Network Acoustic Model
2017
Topics
Speech Recognition
Text-to-Speech
Speech Translation
Audio Generation
Music Generation
Speech Enhancement