Awesome Computer Vision
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Soumi Maiti — most-cited papers & profile · Computer Vision
← authors
·
overview
Soumi Maiti
21
papers ·
42
citations ·
13
h-index
Carnegie Mellon University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Towards Practical and Efficient Image-to-Speech Captioning with Vision-Language Pre-training and Multi-modal Tokens
2023
Top co-authors
Jeong Hun Yeo
· 1
Jeongsoo Choi
· 1
Minsu Kim
· 1
Shinji Watanabe
· 1
Yong Man Ro
· 1
Topics
3D Vision
Visual Language