Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Jianfeng Wang — most-cited papers & profile · Multimodal
← authors
·
overview
Jianfeng Wang
23
papers ·
471
citations ·
37
h-index
Shandong University of Technology · Northwestern Polytechnical University · Chang'an University · China Aerodynamics Research and Development Center · Zhejiang Industry Polytechnic College
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
AutoAssign: Differentiable Label Assignment for Dense Object Detection
2020 · 194 citations
Face Attention Network: An Effective Face Detector for the Occluded Faces
2017 · 144 citations
GRiT: A Generative Region-to-text Transformer for Object Understanding
2022 · 30 citations
An Empirical Study of Training End-to-End Vision-and-Language Transformers
2021 · 22 citations
Hierarchically Structured Reinforcement Learning for Topically Coherent Visual Story Generation
2018 · 21 citations
SFace: An Efficient Network for Face Detection in Large Scale Variations
2018 · 20 citations
End-to-End Object Detection with Fully Convolutional Network
2020 · 14 citations
Adversarial Feature Augmentation and Normalization for Visual Recognition
2021 · 10 citations
Is Object Detection Necessary for Human-Object Interaction Recognition?
2021 · 4 citations
The Overlooked Classifier in Human-Object Interaction Recognition
2021 · 2 citations
Spatial-Frequency U-Net for Denoising Diffusion Probabilistic Models
2023 · 2 citations
NUWA-XL: Diffusion over Diffusion for eXtremely Long Video Generation
2023 · 1 citations
DAP: Detection-Aware Pre-training with Weak Supervision
2021
Learning 3D Photography Videos via Self-supervised Diffusion on Single Images
2023
Bring Metric Functions into Diffusion Models
2024
Topics
Object Detection
Evaluation
Vision-Language
Training Techniques
Visual Language
Image Generation
3D Vision
Video Understanding
Diffusion Models
Training & Sampling