Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Senqiao Yang — most-cited papers & profile · Multimodal
← authors
·
overview
Senqiao Yang
15
papers ·
5
citations ·
10
h-index
Chinese University of Hong Kong
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
RoboMamba: Efficient Vision-Language-Action Model for Robotic Reasoning and Manipulation
2024 · 3 citations
PM-DETR: Domain Adaptive Prompt Memory for Object Detection with Transformers
2023 · 2 citations
Starvla-\(α\): Reducing Complexity In Vision-language-action Systems
2026
Mage-VL: An Efficient Codec-Native Streaming Multimodal Foundation Model
2026
Mage-Flow: An Efficient Native-Resolution Foundation Model for Image Generation and Editing
2026
StarVLA-$α$: Reducing Complexity in Vision-Language-Action Systems
2026
MGM-Omni: Scaling Omni LLMs to Personalized Long-Horizon Speech
2025
Mitigating Object Hallucinations via Sentence-Level Early Intervention
2025
Logits-Based Finetuning
2025
Step-DPO: Step-wise Preference Optimization for Long-chain Reasoning of LLMs
2024
VisionZip: Longer is Better but Not Necessary in Vision Language Models
2024
Top co-authors
Bin Li
· 1
Haoqing Wang
· 1
Jiahao Li
· 1
Jinghao Guo
· 1
Jinglu Wang
· 1
Kaichen Zhang
· 1
Peng Zhang
· 1
Shicheng Zheng
· 1
Wenxuan Xie
· 1
Xiang An
· 1
Xiao Li
· 1
Xiaoyi Zhang
· 1
Topics
Efficiency
Training Techniques
Manipulation
Control
Perception
Vision-Language
Evaluation
Code
Fine-Tuning
cs.ET