Awesome Large Language Models
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yong Yu — most-cited papers & profile · Large Language Models
← authors
·
overview
Yong Yu
41
papers ·
1096
citations ·
79
h-index
Shanghai Jiao Tong University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
SeqGAN: Sequence Generative Adversarial Nets with Policy Gradient
2016 · 294 citations
Hybrid Actor-Critic Reinforcement Learning in Parameterized Action Space
2019 · 164 citations
Interactive Recommender System via Knowledge Graph-enhanced Reinforcement Learning
2020 · 160 citations
An Efficient Neighborhood-based Interaction Model for Recommendation on Heterogeneous Graph
2020 · 113 citations
Activation Maximization Generative Adversarial Nets
2017 · 47 citations
Lipschitz Generative Adversarial Nets
2019 · 39 citations
MAgent: A Many-Agent Reinforcement Learning Platform for Artificial Collective Intelligence
2017 · 34 citations
Towards Making the Most of BERT in Neural Machine Translation
2019 · 31 citations
MARS: Markov Molecular Sampling for Multi-objective Drug Discovery
2021 · 29 citations
Bag of Tricks for Node Classification with Graph Neural Networks
2021 · 28 citations
A Study of AI Population Dynamics with Million-agent Reinforcement Learning
2017 · 19 citations
HyperST-Net: Hypernetworks for Spatio-Temporal Forecasting
2018 · 17 citations
MapGo: Model-Assisted Policy Optimization for Goal-Oriented Tasks
2021 · 13 citations
MapGo: Model-Assisted Policy Optimization for Goal-Oriented Tasks
2021 · 13 citations
Bidirectional Model-based Policy Optimization
2020 · 12 citations
Top co-authors
Weinan Zhang
· 2
Bo Chen
· 1
Hangyu Wang
· 1
Haoxuan Li
· 1
Jianghao Lin
· 1
Jiarui Jin
· 1
Jun Wang
· 1
Mengyue Yang
· 1
Ruiming Tang
· 1
Xiaoting He
· 1
Yang Yang
· 1
Yiming Yang
· 1
Topics
Policy Gradient
Model-Based RL
Collaborative Filtering
Two-Tower & Retrieval
LLM-based
GANs
Training & Sampling
Value-Based
Cold Start & Cross-Domain
Multi-Agent