Awesome AI for Science
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yaliang Li — most-cited papers & profile · AI for Science
← authors
·
overview
Yaliang Li
19
papers ·
265
citations ·
44
h-index
Alibaba Group (China)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Sequential Recommendation with Self-Attentive Multi-Adversarial Network
2020 · 127 citations
On-Policy RL Meets Off-Policy Experts: Harmonizing Supervised Fine-Tuning and Reinforcement Learning via Dynamic Weighting
2025 · 68 citations
On-Policy RL Meets Off-Policy Experts: Harmonizing Supervised Fine-Tuning and Reinforcement Learning via Dynamic Weighting
2025 · 68 citations
Agent-Oriented Planning in Multi-Agent Systems
2024 · 2 citations
Agentic Memory: Learning Unified Long-Term and Short-Term Memory Management for Large Language Model Agents
2026
Branch-and-Browse: Efficient and Controllable Web Exploration with Tree-Structured Reasoning and Action Memory
2025
On the Entropy Dynamics in Reinforcement Fine-Tuning of Large Language Models
2026
Enhancing Multimodal Retrieval via Complementary Information Extraction and Alignment
2026
Group-Relative REINFORCE Is Secretly an Off-Policy Algorithm: Demystifying Some Myths About GRPO and Its Friends
2025
ReDiSC: A Reparameterized Masked Diffusion Model for Scalable Node Classification with Structured Predictions
2025
Automated Profile Inference with Language Model Agents
2025
On-Policy RL Meets Off-Policy Experts: Harmonizing Supervised Fine-Tuning and Reinforcement Learning via Dynamic Weighting
2025
Group-Relative REINFORCE Is Secretly an Off-Policy Algorithm: Demystifying Some Myths About GRPO and Its Friends
2025
Multi-grained Hypergraph Interest Modeling for Conversational Recommendation
2023
An Auction-based Marketplace for Model Trading in Federated Learning
2024
Topics
Training Techniques
Fine-Tuning
Efficiency
cs.LG
cs.AI
Evaluation
Policy Gradient
Offline RL
Memory
Browser Agents