Awesome AI for Science
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Wei Shen — most-cited papers & profile · AI for Science
← authors
·
overview
Wei Shen
35
papers ·
19
citations ·
47
h-index
Shanghai Jiao Tong University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Pre-dpo: Improving Data Utilization In Direct Preference Optimization Using A Guiding Reference Model
2025 · 7 citations
Finding Lookalike Customers for E-Commerce Marketing
2023 · 3 citations
StepCoder: Improve Code Generation with Reinforcement Learning from Compiler Feedback
2024 · 3 citations
REINFORCE++: Stabilizing Critic-Free Policy Optimization with Global Advantage Normalization
2025 · 2 citations
Skywork-Reward-V2: Scaling Preference Data Curation via Human-AI Synergy
2025 · 1 citations
OpenRLHF: An Easy-to-use, Scalable and High-performance RLHF Framework
2024 · 1 citations
OpenRLHF: An Easy-to-use, Scalable and High-performance RLHF Framework
2024 · 1 citations
Safety Control of Service Robots with LLMs and Embodied Knowledge Graphs
2024 · 1 citations
Text-Image Conditioned 3D Generation
2026
MMRad-22K: A Structured Multimodal Evidence Dataset for Chest X-ray Report Generation
2026
NEARL-CLIP: Interacted Query Adaptation with Orthogonal Regularization for Medical Vision-Language Understanding
2025
TreePO: Bridging the Gap of Policy Optimization and Efficacy and Inference Efficiency with Heuristic Tree-based Modeling
2025
MLorc: Momentum Low-rank Compression for Memory Efficient Large Language Model Adaptation
2025
Exploring Data Scaling Trends and Effects in Reinforcement Learning from Human Feedback
2025
Pre-DPO: Improving Data Utilization in Direct Preference Optimization Using a Guiding Reference Model
2025
Top co-authors
Cong Shen
· 1
Jiawei Zhang
· 1
Minhui Huang
· 1
Ruichuan Huang
· 1
Topics
Reinforcement Learning
Training Techniques
RLHF & Alignment
Evaluation
Vision-Language Models
Fine-Tuning
Policy Gradient
Model-Based RL
Safety & Alignment
Efficiency