Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Hao Shi — most-cited papers & profile · Speech Audio
← authors
·
overview
Hao Shi
12
papers ·
0
citations ·
19
h-index
Sun Yat-sen University · Peking University · Sixth Affiliated Hospital of Sun Yat-sen University · CARE Fertility · PLA Army Engineering University · Zhejiang University · Tsinghua University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
MemoryVLA++: Temporal Modeling via Memory and Imagination in Vision-Language-Action Models
2026
VL2Spike: Spike-driven Distillation from VLMs for Low-Power Visual Perception in Embodied AI
2026
SpatialActor: Exploring Disentangled Spatial Representations for Robust Robotic Manipulation
2025
mmWalk: Towards Multi-modal Multi-view Walking Assistance
2025
Dexbotic: Open-Source Vision-Language-Action Toolbox
2025
QuaDreamer: Controllable Panoramic Video Generation for Quadruped Robots
2025
GeoVLA: Empowering 3D Representations in Vision-Language-Action Models
2025
MemoryVLA: Perceptual-Cognitive Memory in Vision-Language-Action Models for Robotic Manipulation
2025
Humanpcr: Probing MLLM Capabilities In Diverse Human-centric Scenes
2025
Memoryvla: Perceptual-cognitive Memory In Vision-language-action Models For Robotic Manipulation
2025
Spatialactor: Exploring Disentangled Spatial Representations For Robust Robotic Manipulation
2025
Densegrounding: Improving Dense Language-vision Semantics For Ego-centric 3D Visual Grounding
2025
Topics
Manipulation
Perception
Vision-Language Models
Control
Human-Robot Interaction
Embodied & Agents
Multi-Robot
Sim-to-Real
Benchmarks
Visual QA & Reasoning