Awesome Computer Vision
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Chenyang Gu — most-cited papers & profile · Computer Vision
← authors
·
overview
Chenyang Gu
17
papers ·
4
citations ·
3
h-index
Nanyang Technological University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Fast-in-Slow: A Dual-System Foundation Model Unifying Fast Manipulation within Slow Reasoning
2025 · 2 citations
RoboMIND: Benchmark on Multi-embodiment Intelligence Normative Data for Robot Manipulation
2024 · 2 citations
LaST-R1: Reinforcing Robotic Manipulation via Adaptive Physical Latent Reasoning
2026
Look Before Acting: Enhancing Vision Foundation Representations for Vision-Language-Action Models
2026
TwinRL: Digital Twin-Driven Reinforcement Learning for Real-World Robotic Manipulation
2026
Mitigating Selection Bias in Large Language Models via Permutation-Aware GRPO
2026
LaST$_0$: Latent Spatio-Temporal Chain-of-Thought for Robotic Vision-Language-Action Model
2026
ManualVLA: A Unified VLA Model for Chain-of-Thought Manual Generation and Robotic Manipulation
2025
RoboMIND 2.0: A Multimodal, Bimanual Mobile Manipulation Dataset for Generalizable Embodied Intelligence
2025
LaST0: Latent Spatio-Temporal Chain-of-Thought for Robotic Vision-Language-Action Model
2026
MLA: A Multisensory Language-Action Model for Multimodal Understanding and Forecasting in Robotic Manipulation
2025
AC-DiT: Adaptive Coordination Diffusion Transformer for Mobile Manipulation
2025
Scaling Spatial Intelligence With Multimodal Foundation Models
2025
Causal Inspired Multi Modal Recommendation
2025
HybridVLA: Collaborative Diffusion and Autoregression in a Unified Vision-Language-Action Model
2025
Topics
Manipulation
Control
Perception
Sim-to-Real
Human-Robot Interaction
Vision-Language Models
Video-Language
Embodied & Agents
Multi-Robot
Benchmarks