Awesome AI for Code
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Tong Zhu — most-cited papers & profile · AI for Code
← authors
·
overview
Tong Zhu
34
papers ·
88
citations ·
0
h-index
East China Normal University · South China University of Technology
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
LLaMA-MoE: Building Mixture-of-Experts from LLaMA with Continual Pre-training
2024 · 2 citations
Linear-MoE: Linear Sequence Modeling Meets Mixture-of-Experts
2025
Dynamic Data Mixing Maximizes Instruction Tuning for Mixture-of-Experts
2024
LLaMA-MoE v2: Exploring Sparsity of LLaMA from Perspective of Mixture-of-Experts with Post-Training
2024
NesTools: A Dataset for Evaluating Nested Tool Learning Abilities of Large Language Models
2024
Top co-authors
Xiaoye Qu
· 4
Yu Cheng
· 4
Weigao Sun
· 2
Wenliang Chen
· 2
Conghui He
· 1
Disen Lan
· 1
Han Han
· 1
Hao Xiong
· 1
Jingqi Tong
· 1
Mengsong Wu
· 1
Xiang Zhang
· 1
Xuyang Hu
· 1
Topics
large
parameter-efficient
mechanism
benchmarks
cs.LG
training
pretraining
Code Models
Software Engineering