Awesome AI for Code
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Hongru Wang — most-cited papers & profile · AI for Code
← authors
·
overview
Hongru Wang
25
papers ·
288
citations ·
9
h-index
Liaocheng People's Hospital · Southeast University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
ToolRL: Reward is All Tool Learning Needs
2025 · 236 citations
Prompting and Evaluating Large Language Models for Proactive Dialogues: Clarification, Target-guided, and Non-collaboration
2023 · 5 citations
Mlingconf: A Comprehensive Study Of Multilingual Confidence Estimation On Large Language Models
2024 · 4 citations
Impart: Importance-aware Delta-sparsification For Improved Model Compression And Merging In Llms
2025 · 4 citations
The Landscape of Agentic Reinforcement Learning for LLMs: A Survey
2025 · 1 citations
RM-R1: Reward Modeling as Reasoning
2025 · 1 citations
RM-R1: Reward Modeling as Reasoning
2025 · 1 citations
Acting Less is Reasoning More! Teaching Model to Act Efficiently
2025 · 1 citations
Integrating Pretrained Language Model for Dialogue Policy Learning
2021 · 1 citations
Illusions of Confidence? Diagnosing LLM Truthfulness via Neighborhood Consistency
2026
Learning from Own Solutions: Self-Conditioned Credit Assignment for Reinforcement Learning with Verifiable Rewards
2026
Rethinking the Role of Entropy in Optimizing Tool-Use Behaviors for Large Language Model Agents
2026
Bridging the Agent-World Gap: Text World Models for LLM-based Agents
2026
Search-R2: Enhancing Search-Integrated Reasoning via Actor-Refiner Collaboration
2026
Towards Fair and Comprehensive Evaluation of Routers in Collaborative LLM Systems
2026
Top co-authors
Boyang Xue
· 1
Kam-Fai Wong
· 1
Rui Wang
· 1
Tianqing Fang
· 1
Wenhao Yu
· 1
Yi Chen
· 1
Topics
Evaluation
RLHF & Alignment
Model-Based RL
Training Techniques
Safety & Alignment
Efficiency
Policy Gradient
Fine-Tuning
Model Architecture
Meta-RL