Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Haoqian Wang — most-cited papers & profile · Multimodal
← authors
·
overview
Haoqian Wang
20
papers ·
51
citations ·
37
h-index
Ministry of Agriculture and Rural Development · Shenzhen Institute of Information Technology · Xi'an Polytechnic University · Wuhan University · Tsinghua–Berkeley Shenzhen Institute · Tsinghua University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Flow-Guided Sparse Transformer for Video Deblurring
2022 · 22 citations
Learning Visibility Field for Detailed 3D Human Reconstruction and Relighting
2023 · 15 citations
PoseDet: Fast Multi-Person Pose Estimation Using Pose Embedding
2021 · 6 citations
MST++: Multi-stage Spectral-wise Transformer for Efficient Spectral Reconstruction
2022 · 4 citations
Prompt-SID: Learning Structural Representation Prompt via Latent Diffusion for Single-Image Denoising
2025 · 2 citations
Real-time Human-Centric Segmentation for Complex Video Scenes
2021 · 1 citations
M$^2$Depth: Self-supervised Two-Frame Multi-camera Metric Depth Estimation
2024 · 1 citations
When Models Judge Themselves: Unsupervised Self-Evolution for Multimodal Reasoning
2026
RoboWheel: A Data Engine from Real-World Human Demonstrations for Cross-Embodiment Robotic Learning
2025
MeshCoder: LLM-Powered Structured Mesh Code Generation from Point Clouds
2025
Taming Hallucinations: Boosting MLLMs' Video Understanding via Counterfactual Video Generation
2025
r-G2P: Evaluating and Enhancing Robustness of Grapheme to Phoneme Conversion by Controlled noise introducing and Contextual information incorporation
2022
Adaptive Sparse and Monotonic Attention for Transformer-based Automatic Speech Recognition
2022
Learning Invariant Representation and Risk Minimized for Unsupervised Accent Domain Adaptation
2022
Prior-enhanced Temporal Action Localization using Subject-aware Spatial Attention
2022
Topics
Image Restoration
Video Understanding
Object Detection
Speech Recognition
3D Vision
Image Generation
Vision-Language
Reinforcement Learning
Training Techniques
Tracking