Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Junkun Chen — most-cited papers & profile · Speech Audio
← authors
·
overview
Junkun Chen
17
papers ·
56
citations ·
22
h-index
Microsoft (United States) · Ganzhou People's Hospital · Shangri-la Institute · Microsoft Research (United Kingdom)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
MAM: Masked Acoustic Modeling for End-to-End Speech-to-Text Translation
2020 · 14 citations
Fused Acoustic and Text Encoding for Multimodal Bilingual Pretraining and Speech Translation
2021 · 6 citations
A$^3$T: Alignment-Aware Acoustic and Text Pretraining for Speech Synthesis and Editing
2022 · 1 citations
DiariST: Streaming Speech Translation with Speaker Diarization
2023 · 1 citations
Improving Stability in Simultaneous Speech Translation: A Revision-Controllable Decoding Approach
2023 · 1 citations
Leveraging Timestamp Information for Serialized Joint Streaming Recognition and Translation
2023 · 1 citations
Rethinking Speech-LLM Integration for ASR: Effective Joint Speech-Text Training by Interleaving
2026
Do LLMs Need Architectural Changes for Simultaneous Speech Translation? A Prefix-to-Prefix Data Driven Approach
2026
Streaming Speaker Change Detection and Gender Classification for Transducer-Based Multi-Talker Speech Translation
2025
Direct Simultaneous Speech-to-Text Translation Assisted by Synchronized Streaming ASR
2021
PaddleSpeech: An Easy-to-Use All-in-One Speech Toolkit
2022
ERNIE-SAT: Speech and Text Joint Pretraining for Cross-Lingual Multi-Speaker Text-to-Speech
2022
Token-Level Serialized Output Training for Joint Streaming ASR and ST Leveraging Textual Alignments
2023
Soft Language Identification for Language-Agnostic Many-to-One End-to-End Speech Translation
2024
Investigating Neural Audio Codecs for Speech Language Model-Based Speech Generation
2024
Top co-authors
Jinyu Li
· 7
Renjie Zheng
· 6
Jian Xue
· 5
Peidong Wang
· 5
Liang Huang
· 3
Mingbo Ma
· 3
Naoyuki Kanda
· 3
Xiaofei Wang
· 3
Aswin Shanmugam Subramanian
· 2
Dongmei Wang
· 2
He Bai
· 2
Liang Huang
· 2
Topics
Speech Translation
Speech Recognition
Text-to-Speech
Audio Generation
Multimodal Audio
Speaker Analysis
Audio Understanding
Speech Enhancement
Voice Cloning
Music Generation