Awesome AI for Code
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Jiayu Liu — most-cited papers & profile · AI for Code
← authors
·
overview
Jiayu Liu
16
papers ·
17
citations ·
0
h-index
Chinese PLA General Hospital
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Advancing Tool-Augmented Large Language Models via Meta-Verification and Reflection Learning
2025 · 14 citations
Combining Reinforcement Learning and Inverse Reinforcement Learning for Asset Allocation Recommendations
2022 · 3 citations
SocraticPO: Policy Optimization via Interactive Guidance
2026
CostBench: Evaluating Multi-Turn Cost-Optimal Planning and Adaptation in Dynamic Environments for LLM Tool-Use Agents
2025
NAACL: Noise-AwAre Verbal Confidence Calibration for LLMs in RAG Systems
2026
CreativityBench: Evaluating Agent Creative Reasoning via Affordance-Based Tool Repurposing
2026
Ψ-Bench: Evaluating Persona-Sensitive Influencing in Persuasive Dialogues
2026
PlanBench-XL: Evaluating Long-Horizon Planning of LLM Tool-Use Agents in Large-Scale Tool Ecosystems
2026
Step 3.5 Flash: Open Frontier-Level Intelligence with 11B Active Parameters
2026
Linear Dynamics in the RLVR Training of Large Language Models
2026
Linear Dynamics in the RLVR Training of Large Language Models
2026
Step-3 is Large yet Affordable: Model-system Co-design for Cost-effective Decoding
2025
CritiCal: Can Critique Help LLM Uncertainty or Confidence Calibration?
2025
CostBench: Evaluating Multi-Turn Cost-Optimal Planning and Adaptation in Dynamic Environments for LLM Tool-Use Agents
2025
FedDW: Distilling Weights through Consistency Optimization in Heterogeneous Federated Learning
2024
Top co-authors
Bingxin Zhao
· 1
Bingxuan Li
· 1
Desong Meng
· 1
Eddie Yang
· 1
Jieyi Wang
· 1
Kunlun Zhu
· 1
Nanyi Jiang
· 1
Pan Lu
· 1
Xiusi Chen
· 1
Yuxin Guo
· 1
Zirui Fan
· 1
Topics
Evaluation
Agentic
cs.CL
Efficiency
Planning
Multi-Agent
Tool Use
cs.LG
cs.AI
Reinforcement Learning