Awesome Speech Audio
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Tong Zhang — most-cited papers & profile · Speech Audio
← authors
·
overview
Tong Zhang
49
papers ·
35
citations ·
55
h-index
University of Illinois Urbana-Champaign · East China University of Technology · Fiberhome Technology Group (China)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Traversing Pareto Optimal Policies: Provably Efficient Multi-Objective Reinforcement Learning
2024 · 12 citations
TheoremLlama: Transforming General-Purpose LLMs into Lean4 Experts
2024 · 11 citations
Listwise Preference Alignment Optimization for Tail Item Recommendation
2025 · 4 citations
Learning-based Multi-View Stereo: A Survey
2024 · 2 citations
Two-dimensional geometric template diffusion for boosting single-sequence protein structure prediction
2026 · 1 citations
RM-R1: Reward Modeling as Reasoning
2025 · 1 citations
Multi-Modal Hypergraph Enhanced LLM Learning for Recommendation
2025 · 1 citations
EmbodiedBench: Comprehensive Benchmarking Multi-modal Large Language Models for Vision-Driven Embodied Agents
2025 · 1 citations
Entropy-Regularized Process Reward Model
2024 · 1 citations
Leveraging Locality to Boost Sample Efficiency in Robotic Manipulation
2024 · 1 citations
Future-KL Regularized GRPO: Process-Level Credit Assignment from $f$-Divergence Regularization
2026
Code as Agent Harness
2026
AsyncWebRL: Efficient Multi-Step RL for Visual Web Agents
2026
Visual-like 2D Geometric Template Diffusion for Boosting Single-Sequence Protein Structure Prediction
2026
Qwen-VLA: Unifying Vision-Language-Action Modeling across Tasks, Environments, and Robot Embodiments
2026
Top co-authors
Boyun Zhang
· 1
Dongjie Fu
· 1
Tao Jin
· 1
Wenhao Yan
· 1
Xize Cheng
· 1
Yongbo He
· 1
Zihan Zhang
· 1
Topics
Reinforcement Learning
Training Techniques
Manipulation
Control
Model-Based RL
Evaluation
Multi-Agent
Fine-Tuning
Efficiency
Policy Gradient