Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Kun Zhou — most-cited papers & profile · Speech Audio
← authors
·
overview
Kun Zhou
15
papers ·
52
citations ·
18
h-index
Fudan University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Converting Anyone's Emotion: Towards Speaker-Independent Emotional Voice Conversion
2020 · 15 citations
Seen and Unseen emotional style transfer for voice conversion with a new emotional speech dataset
2020 · 14 citations
VAW-GAN for Singing Voice Conversion with Non-parallel Training Data
2020 · 10 citations
VAW-GAN for Disentanglement and Recomposition of Emotional Elements in Speech
2020 · 6 citations
Limited Data Emotional Voice Conversion Leveraging Text-to-Speech: Two-stage Sequence-to-Sequence Training
2021 · 4 citations
Expressive Voice Conversion: A Joint Framework for Speaker Identity and Emotional Style Transfer
2021 · 2 citations
Conditional Latent Diffusion-Based Speech Enhancement Via Dual Context Learning
2025 · 1 citations
Online Audio-Visual Autoregressive Speaker Extraction
2025
Hierarchical Control of Emotion Rendering in Speech Synthesis
2024
HiFi-SR: A Unified Generative Transformer-Convolutional Adversarial Network for High-Fidelity Speech Super-Resolution
2025
Spectrum and Prosody Conversion for Cross-lingual Voice Conversion with CycleGAN
2020
Fine-Grained Quantitative Emotion Editing for Speech Generation
2024
Converting Anyone's Voice: End-to-End Expressive Voice Conversion with a Conditional Diffusion Model
2024
Phonetic Enhanced Language Modeling for Text-to-Speech Synthesis
2024
Enhancing Emotional Text-to-Speech Controllability with Natural Language Guidance through Contrastive Learning and Diffusion Models
2024
Top co-authors
Berrak Sisman
· 8
Haizhou Li
· 8
Bin Ma
· 4
Shengkui Zhao
· 4
Chong Zhang
· 2
Sho Inoue
· 2
Shuai Wang
· 2
Yukun Ma
· 2
Zexu Pan
· 2
Zongyang Du
· 2
and Haizhou Li
· 1
Andreas Triantafyllopoulos
· 1
Topics
Audio Generation
Voice Cloning
Text-to-Speech
Speech Enhancement
Speaker Analysis
Speech Recognition
Music Generation
Audio Understanding
Multimodal Audio
Speech Translation