Awesome Large Language Models
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Shuming Ma — most-cited papers & profile · Large Language Models
← authors
·
overview
Shuming Ma
8
papers ·
50
citations
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
The Era of 1-bit LLMs: All Large Language Models are in 1.58 Bits
2024 · 37 citations
LongReasonArena: A Long Reasoning Benchmark for Large Language Models
2025
BitNet b1.58 2B4T Technical Report
2025
LongNet: Scaling Transformers to 1,000,000,000 Tokens
2023
BitNet: Scaling 1-bit Transformers for Large Language Models
2023
Q-Sparse: All Large Language Models can be Fully Sparsely-Activated
2024
MH-MoE:Multi-Head Mixture-of-Experts
2024
Top co-authors
Furu Wei
· 7
Shaohan Huang
· 5
Hongyu Wang
· 4
Li Dong
· 3
Ruiping Wang
· 3
Jiayu Ding
· 2
Lingxiao Ma
· 2
Wenhui Wang
· 2
Xingxing Zhang
· 2
Fan Yang
· 1
Huaijie Wang
· 1
Jilong Xue
· 1
Topics
Efficiency
Model Architecture
Training Techniques
Evaluation
Fine-Tuning
Code