Awesome Computer Vision
π
Papers
π§
Topics
π₯
Trending
πΊοΈ
Map
π
Leaderboards
π
Learn
π€
Ask AI
β―
More
π₯
Authors
π
Reading Packs
π
Datasets
π οΈ
Tools
π°
News
π
Blogs
βοΈ
Newsletter
π―
Research Radar
π
Saved
+ Add Paper
βΎ
β
β authors
Β·
overview
Loading authorβ¦
π€
Ask AI
Jiafei Duan β most-cited papers & profile Β· Computer Vision
β authors
Β·
overview
Jiafei Duan
14
papers Β·
15
citations
Google Scholar β
Semantic Scholar β
OpenAlex β
Most-cited papers
Manipulate-Anything: Automating Real-World Robots using Vision-Language Models
2024 Β· 5 citations
AHA: A Vision-Language-Model for Detecting and Reasoning Over Failures in Robotic Manipulation
2024 Β· 4 citations
Octopi: Object Property Reasoning with Large Tactile-Language Models
2024 Β· 2 citations
RoboPoint: A Vision-Language Model for Spatial Affordance Prediction for Robotics
2024 Β· 2 citations
AR2-D2:Training a Robot Without a Robot
2023 Β· 1 citations
THE COLOSSEUM: A Benchmark for Evaluating Generalization for Robotic Manipulation
2024 Β· 1 citations
MolmoAct2: Action Reasoning Models for Real-world Deployment
2026
MolmoB0T: Large-Scale Simulation Enables Zero-Shot Manipulation
2026
FailSafe: Reasoning and Recovery from Failures in Vision-Language-Action Models
2025
MolmoAct: Action Reasoning Models that can Reason in Space
2025
GraspMolmo: Generalizable Task-Oriented Grasping via Large-Scale Synthetic Data Generation
2025
Pointarena: Probing Multimodal Grounding Through Language-guided Pointing
2025
RoboMD: Uncovering Robot Vulnerabilities through Semantic Potential Fields
2024
The One RING: a Robotic Indoor Navigation Generalist
2024
Topics
Manipulation
Sim-to-Real
Control
Human-Robot Interaction
Perception
Multi-Robot
Navigation
Visual QA & Reasoning
Benchmarks
Embodied & Agents