Awesome AI for Science
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Dong Yu — most-cited papers & profile · AI for Science
← authors
·
overview
Dong Yu
33
papers ·
160
citations ·
84
h-index
Seattle University · KLA (United States)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
R-Zero: Self-Evolving Reasoning LLM from Zero Data
2025 · 115 citations
CDE: Curiosity-Driven Exploration for Efficient Reinforcement Learning in Large Language Models
2025 · 26 citations
EmoSteer-TTS: Fine-Grained and Training-Free Emotion-Controllable Text-to-Speech via Activation Steering
2025 · 9 citations
Efficient Scaling for LLM-based ASR
2025 · 9 citations
SRC-gAudio: Sampling-Rate-Controlled Audio Generation
2024 · 1 citations
Can LLMs Guide Their Own Exploration? Gradient-Guided Reinforcement Learning for LLM Reasoning
2025
AudioRAG+: Feedback-driven Retrieval-augmented Audio Generation with Large Audio Language Models
2025
TTA: Transcribe, Translate and Alignment for Cross-lingual Speech Representation
2025
Auden-Voice: General-Purpose Voice Encoder for Speech and Language Understanding
2025
VCB Bench: An Evaluation Benchmark for Audio-Grounded Large Language Model Conversational Agents
2025
VCB Bench: An Evaluation Benchmark for Audio-Grounded Large Language Model Conversational Agents
2025
Vox-Evaluator: Enhancing Stability and Fidelity for Zero-shot TTS with A Multi-Level Evaluator
2025
Towards Hallucination-Free Music: A Reinforcement Learning Preference Optimization Framework for Reliable Song Generation
2025
Self-Rewarding Vision-Language Model via Reasoning Decomposition
2025
Thoughts Are All Over the Place: On the Underthinking of o1-Like LLMs
2025
Top co-authors
Rodrigo Becerra Silva
· 1
Xiang Yi
· 1
Ziyi Song
· 1
Topics
Speech Recognition
Audio Generation
Training Techniques
Evaluation
Audio Understanding
Text-to-Speech
Speech Translation
Speech Enhancement
Efficiency
Multimodal Audio