Awesome AI for Code
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Xiaoyu Liu — most-cited papers & profile · AI for Code
← authors
·
overview
Xiaoyu Liu
26
papers ·
29
citations ·
7
h-index
Nanjing University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
On permutation invariant training for speech source separation
2021 · 10 citations
Occluded Video Instance Segmentation: A Benchmark
2021 · 8 citations
Spatially Adaptive Self-Supervised Learning for Real-World Image Denoising
2023 · 4 citations
VITA-1.5: Towards GPT-4o Level Real-Time Vision and Speech Interaction
2025 · 3 citations
DrM: Mastering Visual Reinforcement Learning through Dormant Ratio Minimization
2023 · 3 citations
CoA-VLA: Improving Vision-Language-Action Models via Visual-Textual Chain-of-Affordance
2024 · 1 citations
Multi-Aspect Cross-modal Quantization for Generative Recommendation
2025
VITA-VLA: Efficiently Teaching Vision-Language Models to Act via Action Expert Distillation
2025
Distributed Quantum Information Processing: A Review of Recent Progress
2025
VITA-E: Natural Embodied Interaction with Concurrent Seeing, Hearing, Speaking, and Acting
2025
Dual form Complementary Masking for Domain-Adaptive Image Segmentation
2025
ViCrit: A Verifiable Reinforcement Learning Proxy Task for Visual Perception in VLMs
2025
ViCrit: A Verifiable Reinforcement Learning Proxy Task for Visual Perception in VLMs
2025
VITA-E: Natural Embodied Interaction With Concurrent Seeing, Hearing, Speaking, And Acting
2025
DISCO Balances the Scales: Adaptive Domain- and Difficulty-Aware Reinforcement Learning on Imbalanced Data
2025
Top co-authors
Fan Li
· 1
Huan Wang
· 1
Jiaqi Xu
· 1
Ming Liu
· 1
Wangmeng Zuo
· 1
Zhixin Wang
· 1
Topics
Speech Enhancement
Speech Translation
Speech Recognition
Manipulation
Perception
Control
Model-Based RL
Value-Based
Audio Understanding
Text-to-Speech