Awesome Graph Learning
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Zhiheng Xi — most-cited papers & profile · Graph Learning
← authors
·
overview
Zhiheng Xi
24
papers ·
81
citations ·
0
h-index
Fudan University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Reasoning or Memorization? Unreliable Results of Reinforcement Learning Due to Data Contamination
2025 · 68 citations
What's Wrong with Your Code Generated by Large Language Models? An Extensive Study
2024 · 6 citations
ToolHop: A Query-Driven Benchmark for Evaluating Large Language Models in Multi-Hop Tool Use
2025 · 3 citations
ToolHop: A Query-Driven Benchmark for Evaluating Large Language Models in Multi-Hop Tool Use
2025 · 3 citations
Agentic Harness Engineering: Observability-Driven Automatic Evolution of Coding-Agent Harnesses
2026 · 1 citations
Feedback-Driven Tool-Use Improvements in Large Language Models via Automated Build Environments
2025
Can RL Improve Generalization Of LLM Agents? An Empirical Study
2026
ABC-Bench: Benchmarking Agentic Backend Coding in Real-World Development
2026
AgentPRM: Process Reward Models for LLM Agents via Step-Wise Promise and Progress
2025
Critique-RL: Training Language Models for Critiquing through Two-Stage Reinforcement Learning
2025
Parrot: A Training Pipeline Enhances Both Program CoT and Natural Language CoT for Reasoning
2025
VRPO: Rethinking Value Modeling for Robust RL Training under Noisy Supervision
2025
MagicGUI: A Foundational Mobile GUI Agent with Scalable Data Pipeline and Reinforcement Fine-tuning
2025
Feedback-Driven Tool-Use Improvements in Large Language Models via Automated Build Environments
2025
Feedback-Driven Tool-Use Improvements in Large Language Models via Automated Build Environments
2025
Topics
Evaluation
Reinforcement Learning
RLHF & Alignment
Training Techniques
Model-Based RL
Code Generation
Policy Gradient
Value-Based
Code Models
Software Engineering