Awesome Large Language Models
π
Papers
π§
Topics
π₯
Trending
πΊοΈ
Map
π
Leaderboards
π
Learn
π€
Ask AI
β―
More
π₯
Authors
π
Reading Packs
π
Datasets
π οΈ
Tools
π°
News
π
Blogs
βοΈ
Newsletter
π―
Research Radar
π
Saved
+ Add Paper
βΎ
β
β all topics
overview
MoE
loadingβ¦
π€
Ask AI
Awesome MoE β curated papers, datasets & benchmarks Β· Awesome Large Language Models
β all topics
overview
MoE
12 papers tagged MoE β re-sort below
Papers
π₯ Trending (default)
π Most cited
π Newest first
π€ A β Z by title
12 papers Β· trending (default)
numbers = π₯ heat
Qwen3.5-Omni Technical Report
(2026)
Qwen Team
7.08
DECO: Sparse Mixture-of-Experts with Dense-Comparable Performance on End-Side Devices
(2026)
Chenyang Song et al.
1.94
Confidence-Adaptive SwiGLU for Mixture-of-Experts
(2026)
Shaohua Li et al.
1.94
Beyond SFT-to-RL: Pre-alignment via Black-Box On-Policy Distillation for Multimodal RL
(2026)
Sudong Wang et al.
1.83
Make LoRA Great Again: Boosting LoRA with Adaptive Singular Values and Mixture-of-Experts Optimization Alignment
(2025)
Chenghao Fan et al.
1.28
SAIL-VL2 Technical Report
(2025)
Weijie Yin et al.
1.28
Rewiring Experts on the Fly:Continuous Rerouting for Better Online Adaptation in Mixture-of-Expert models
(2025)
Guinan Su et al.
1.28
Every Step Evolves: Scaling Reinforcement Learning for Trillion-Scale Thinking Model
(2025)
Ling Team et al.
1.28
From Sparse to Soft Mixtures of Experts
(2023)
Joan Puigcerver et al.
β
Memory Augmented Language Models through Mixture of Word Experts
(2023)
Cicero Nogueira dos Santos et al.
β
MoE-Mamba: Efficient Selective State Space Models with Mixture of Experts
(2024)
Maciej PiΓ³ro et al.
β
NeKo: Toward Post Recognition Generative Correction Large Language Models with Task-Oriented Experts
(2024)
Yen-Ting Lin et al.
β