Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yan Huang — most-cited papers & profile · Speech Audio
← authors
·
overview
Yan Huang
41
papers ·
119
citations ·
44
h-index
China Mobile (China) · Dongguan University of Technology · South China University of Technology
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Neighbor-view Enhanced Model For Vision And Language Navigation
2021 · 70 citations
MTS-DVGAN: Anomaly Detection in Cyber-Physical Systems using a Dual Variational Generative Adversarial Network
2023 · 25 citations
BEVBert: Multimodal Map Pre-training for Language-guided Navigation
2022 · 11 citations
Open-Vocabulary Octree-Graph for 3D Scene Understanding
2024 · 9 citations
Frequency-domain Multi-modal Fusion for Language-guided Medical Image Segmentation
2025 · 2 citations
Dual-modal Tactile E-skin: Enabling Bidirectional Human-Robot Interaction via Integrated Tactile Perception and Feedback
2024 · 2 citations
Improving Vision-Language-Action Model Fine-Tuning with Structured Stage and Keyframe Supervision
2026
Improving Vision-Language-Action Model Fine-Tuning with Structured Stage and Keyframe Supervision
2026
E-TTS: A New Embodied Test-Time Scaling Framework for Robotic Manipulation
2026
DIM-WAM: World-Action Modeling with Diverse Historical Event Memory
2026
Towards Trustworthy Embodied Intelligence: A Systems Framework and Graded Trustworthiness Levels
2026
SKIP: Sparse Keyframe Interpolation Paradigm for Efficient Embodied World Models
2026
WAM-Nav: Asymmetric Latent World-Action Modeling for Unified Visual Navigation
2026
Multi-View Video Diffusion Policy: A 3D Spatio-Temporal-Aware Video Action Model
2026
FloorPlan-VLN: A New Paradigm for Floor Plan Guided Vision-Language Navigation
2026
Topics
Manipulation
Control
Perception
Human-Robot Interaction
Navigation
Vision-Language Models
Embodied & Agents
Video-Language
Sim-to-Real
Multi-Robot