Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Tomoki Hayashi — most-cited papers & profile · Speech Audio
← authors
·
overview
Tomoki Hayashi
23
papers ·
391
citations ·
30
h-index
Tohoku University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
ESPnet: End-to-End Speech Processing Toolkit
2018 · 74 citations
Non-Parallel Voice Conversion with Cyclic Variational Autoencoder
2019 · 67 citations
Recent Developments on ESPnet Toolkit Boosted by Conformer
2020 · 40 citations
Voice Transformer Network: Sequence-to-Sequence Voice Conversion Using Transformer with Text-to-Speech Pretraining
2019 · 38 citations
ESPnet2-TTS: Extending the Edge of TTS Research
2021 · 28 citations
Collapsed speech segment detection and suppression for WaveNet vocoder
2018 · 27 citations
Non-autoregressive sequence-to-sequence voice conversion
2021 · 22 citations
DiscreTalk: Text-to-Speech as a Machine Translation Problem
2020 · 21 citations
crank: An Open-Source Software for Nonparallel Voice Conversion Based on Vector-Quantized Variational Autoencoder
2021 · 15 citations
ESPnet-TTS: Unified, Reproducible, and Integratable Open Source End-to-End Text-to-Speech Toolkit
2019 · 12 citations
Quasi-Periodic WaveNet Vocoder: A Pitch Dependent Dilated Convolution Model for Parametric Speech Generation
2019 · 10 citations
ESPnet-ST: All-in-One Speech Translation Toolkit
2020 · 9 citations
The 2020 ESPnet update: new features, broadened applications, performance improvements, and future plans
2020 · 6 citations
Back-Translation-Style Data Augmentation for End-to-End ASR
2018 · 5 citations
Statistical Voice Conversion with Quasi-Periodic WaveNet Vocoder
2019 · 3 citations
Top co-authors
Tomoki Toda
· 15
Shinji Watanabe
· 12
Yi-Chiao Wu
· 10
Wen-Chin Huang
· 8
Kazuhiro Kobayashi
· 7
Patrick Lumban Tobing
· 6
Kazuya Takeda
· 4
Takaaki Hori
· 4
Hirofumi Inaguma
· 3
Shigeki Karita
· 3
Takenori Yoshimura
· 3
Chenda Li
· 2
Topics
Text-to-Speech
Speech Recognition
Speech Translation
Audio Generation
Voice Cloning
Speech Enhancement
Audio Understanding
Multimodal Audio
Music Generation