Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yuhan Wang — most-cited papers & profile · Multimodal
← authors
·
overview
Yuhan Wang
15
papers ·
156
citations ·
0
h-index
Chongqing Technology and Business University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
LSTTN: A Long-Short Term Transformer-based Spatio-temporal Neural Network for Traffic Flow Forecasting
2024 · 103 citations
Contrastive Diffusion Model with Auxiliary Guidance for Coarse-to-Fine PET Reconstruction
2023 · 28 citations
TCSinger 2: Customizable Multilingual Zero-shot Singing Voice Synthesis
2025 · 12 citations
HifiFace: 3D Shape and Semantic Prior Guided High Fidelity Face Swapping
2021 · 8 citations
BARNet: Bilinear Attention Network with Adaptive Receptive Fields for Surgical Instrument Segmentation
2020 · 5 citations
Let RGB Be the Language of Vision
2026
One Demonstration Is Enough for Real-World Robotic Reinforcement Learning
2026
ClinSeekAgent: Automating Multimodal Evidence Seeking for Agentic Clinical Reasoning
2026
KGBridge: Knowledge-Guided Prompt Learning for Non-overlapping Cross-Domain Recommendation
2025
Discrete Diffusion Models with MLLMs for Unified Medical Multimodal Generation
2025
Enhancing Transferability and Consistency in Cross-Domain Recommendations via Supervised Disentanglement
2025
Retrieval Models Aren't Tool-Savvy: Benchmarking Tool Retrieval for Large Language Models
2025
GPT-IMAGE-EDIT-1.5M: A Million-Scale, GPT-Generated Image Dataset
2025
Dexterous Non-Prehensile Manipulation for Ungraspable Object via Extrinsic Dexterity
2025
Topics
3D Vision
Segmentation
Image Generation
Audio Generation
Control
Manipulation
Cold Start & Cross-Domain
Graph-based
Diffusion Models
Evaluation