Awesome AI for Code
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Yuheng Zhang — most-cited papers & profile · AI for Code
← authors
·
overview
Yuheng Zhang
17
papers ·
46
citations ·
21
h-index
Sun Yat-sen University · Nanjing University of Aeronautics and Astronautics · Tsinghua University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Iterative Nash Policy Optimization: Aligning Llms With General Preferences Via No-regret Learning
2024 · 40 citations
Improving Robustness to Model Inversion Attacks via Mutual Information Regularization
2020 · 6 citations
Pessimism-Free Offline Learning in General-Sum Games via KL Regularization
2026
Rethinking Importance Sampling in LLM Policy Optimization: A Cumulative Token Perspective
2026
Beyond Pessimism: Offline Learning in KL-regularized Games
2026
Instructing LLMs to Negotiate using Reinforcement Learning with Verifiable Rewards
2026
Beyond State-Wise Mirror Descent: Offline Policy Optimization with Parametric Policies
2026
RoboMIND 2.0: A Multimodal, Bimanual Mobile Manipulation Dataset for Generalizable Embodied Intelligence
2025
Identifying and Calibrating Overconfidence in Noisy Speech Recognition
2025
Improving Sampling Efficiency in RLVR through Adaptive Rollout and Response Reuse
2025
ArtVIP: Articulated Digital Assets of Visual Realism, Modular Interaction, and Physical Fidelity for Robot Learning
2025
Statistical Tractability of Off-policy Evaluation of History-dependent Policies in POMDPs
2025
Offline Learning in Markov Games with General Function Approximation
2023
Online Iterative Reinforcement Learning from Human Feedback with General Preference Model
2024
Teaching LLMs to Refine with Tools
2024
Topics
cs.LG
Offline RL
Reinforcement Learning
Training Techniques
cs.AI
Game AI
Model-Based RL
In-Context Learning
Safety & Alignment
cs.GT