Awesome AI for Code
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Xiyao Wang — most-cited papers & profile · AI for Code
← authors
·
overview
Xiyao Wang
24
papers ·
12
citations ·
13
h-index
Beihua University · Jilin University · First Hospital of Jilin University · Jilin University of Chemical Technology
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
TACO: Temporal Latent Action-Driven Contrastive Loss for Visual Reinforcement Learning
2023 · 5 citations
DrM: Mastering Visual Reinforcement Learning through Dormant Ratio Minimization
2023 · 3 citations
Transfer RL across Observation Feature Spaces via Model-Based Regularization
2022 · 2 citations
Live in the Moment: Learning Dynamics Model Adapted to Evolving Policy
2022 · 2 citations
Agentic Critical Training
2026
ROVER: Benchmarking Reciprocal Cross-Modal Reasoning for Omnimodal Generation
2025
Agent Learning via Early Experience
2025
Agent Learning via Early Experience
2025
LLaVA-Critic-R1: Your Critic Model is Secretly a Strong Policy Model
2025
LLaVA-OneVision-1.5: Fully Open Framework for Democratized Multimodal Training
2025
ViCrit: A Verifiable Reinforcement Learning Proxy Task for Visual Perception in VLMs
2025
SoTA with Less: MCTS-Guided Sample Selection for Data-Efficient Visual Reasoning Self-Improvement
2025
ViCrit: A Verifiable Reinforcement Learning Proxy Task for Visual Perception in VLMs
2025
LLaVA-Critic-R1: Your Critic Model is Secretly a Strong Policy Model
2025
LLaVA-OneVision-1.5: Fully Open Framework for Democratized Multimodal Training
2025
Top co-authors
Ben Athiwaratkun
· 1
Bingxin Zhao
· 1
Bingxuan Li
· 1
Heng Wang
· 1
Jiaxuan You
· 1
Jisen Li
· 1
Nanyi Jiang
· 1
Pan Lu
· 1
Xiaoxia Wu
· 1
Xuying Ning
· 1
Yifan Shen
· 1
Yuqing Jian
· 1
Topics
Model-Based RL
Reinforcement Learning
Value-Based
Training Techniques
Vision-Language
Exploration
Benchmarks
Vision-Language Models
Evaluation
RLHF & Alignment