Awesome Computer Vision
π
Papers
π§
Topics
π₯
Trending
πΊοΈ
Map
π
Leaderboards
π
Learn
π€
Ask AI
β―
More
π₯
Authors
π
Reading Packs
π
Datasets
π οΈ
Tools
π°
News
π
Blogs
βοΈ
Newsletter
π―
Research Radar
π
Saved
+ Add Paper
βΎ
β
β authors
Β·
overview
Loading authorβ¦
π€
Ask AI
Haonan Lu β most-cited papers & profile Β· Computer Vision
β authors
Β·
overview
Haonan Lu
13
papers Β·
12
citations Β·
0
h-index
Google Scholar β
Semantic Scholar β
OpenAlex β
Most-cited papers
Edit Everything: A Text-Guided Generative System for Images Editing
2023 Β· 7 citations
Compositional Text-to-Image Synthesis with Attention Map Control of Diffusion Models
2023 Β· 2 citations
LLMI3D: MLLM-based 3D Perception from a Single 2D Image
2024 Β· 2 citations
InsCL: A Data-efficient Continual Learning Paradigm for Fine-tuning Large Language Models with Instructions
2024 Β· 1 citations
EVA: Efficient Reinforcement Learning for End-to-End Video Agent
2026
ProMSA:Progressive Multimodal Search Agents for Knowledge-Based Visual Question Answering
2026
Clearer Sight, Fewer Lies: Oriented Pickup Preference Optimization for Multimodal Hallucination Mitigation
2026
Clearer Sight, Fewer Lies: Oriented Pickup Preference Optimization for Multimodal Hallucination Mitigation
2026
Consistency as Inductive Bias: Learning Cross-View Invariance for Robust Multimodal Reasoning
2026
The MiniMax-M2 Series: Mini Activations Unleashing Max Real-World Intelligence
2026
When Models Judge Themselves: Unsupervised Self-Evolution for Multimodal Reasoning
2026
AndesVL Technical Report: An Efficient Mobile-side Multimodal Large Language Model
2025
GenX: Mastering Code and Test Generation with Execution Feedback
2024
Topics
Training Techniques
Visual QA & Reasoning
Vision-Language
Efficiency
Vision-Language Models
Benchmarks
Reinforcement Learning
Model Architecture
Text-to-Image
Conditioning & Control