Awesome AI Agents
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yi Xu — most-cited papers & profile · AI Agents
← authors
·
overview
Yi Xu
25
papers ·
23
citations ·
37
h-index
Guangdong University of Technology · Jilin University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
MMQ: Multimodal Mixture-of-Quantization Tokenization for Semantic ID Generation and User Behavioral Adaptation
2025 · 14 citations
Taming the Long Tail: Denoising Collaborative Information for Robust Semantic ID Generation
2025 · 5 citations
A Quantum Secret Sharing Scheme Among Three Parties Ultilizing Four-qubit Smolin Bound Entangled State
2006 · 2 citations
RLGS: Reinforcement Learning-Based Adaptive Hyperparameter Tuning for Gaussian Splatting
2025 · 1 citations
MMQ: Multimodal Mixture-of-quantization Tokenization For Semantic ID Generation And User Behavioral Adaptation
2025 · 1 citations
Sema Code: Decoupling AI Coding Agents into Programmable, Embeddable Infrastructure
2026
Towards High-Consistency Embodied World Model with Multi-View Trajectory Videos
2025
ActiveUMI: Robotic Manipulation with Active Perception from Robot-Free Human Demonstrations
2025
dVLA: Diffusion Vision-Language-Action Model with Multimodal Chain-of-Thought
2025
dVLA: Diffusion Vision-Language-Action Model with Multimodal Chain-of-Thought
2025
Understanding while Exploring: Semantics-driven Active Mapping
2025
Representation Potentials Of Foundation Models For Multimodal Alignment: A Survey
2025
Structuring GUI Elements Through Vision Language Models: Towards Action Space Generation
2025
Visual Planning: Let's Think Only With Images
2025
Out-of-sight Embodied Agents: Multimodal Tracking, Sensor Fusion, And Trajectory Forecasting
2025
Topics
Vision-Language Models
Manipulation
Control
Perception
Human-Robot Interaction
Embodied & Agents
Ranking & CTR
Image-Text Retrieval
Video-Language
Multi-Robot