Awesome Large Language Models
π
Papers
π§
Topics
π₯
Trending
πΊοΈ
Map
π
Leaderboards
π
Learn
π€
Ask AI
β―
More
π₯
Authors
π
Reading Packs
π
Datasets
π οΈ
Tools
π°
News
π
Blogs
βοΈ
Newsletter
π―
Research Radar
π
Saved
+ Add Paper
βΎ
β
β all topics
overview
pruning
loadingβ¦
π€
Ask AI
Awesome pruning β curated papers, datasets & benchmarks Β· Awesome Large Language Models
β all topics
overview
pruning
20 papers tagged pruning β re-sort below
Papers
π₯ Trending (default)
π Most cited
π Newest first
π€ A β Z by title
20 papers Β· trending (default)
numbers = π₯ heat
Ministral 3
(2026)
Alexander H. Liu et al.
1.94
Demystifying When Pruning Works via Representation Hierarchies
(2026)
Shwai He et al.
1.94
SeGPruner: Semantic-Geometric Visual Token Pruner for 3D Question Answering
(2026)
Wenli Li et al.
1.94
MAAT: Multi-phase Adapter-Aware Targeted Unlearning
(2026)
Suryash Yagnik et al.
1.94
SDR: Set-Distance Rewards for Radiology Report Generation
(2026)
Halil Ibrahim Gulluk et al.
1.94
BEAVER: A Training-Free Hierarchical Prompt Compression Method via Structure-Aware Page Selection
(2026)
Zhengpei Hu et al.
1.78
QuoTA: Query-oriented Token Assignment via CoT Query Decouple for Long Video Comprehension
(2025)
Yongdong Luo et al.
1.28
StreamVLN: Streaming Vision-and-Language Navigation via SlowFast Context Modeling
(2025)
Meng Wei et al.
1.28
Finding Dori: Memorization in Text-to-Image Diffusion Models Is Less Local Than Assumed
(2025)
Antoni Kowalczuk et al.
1.28
Pruning the Unsurprising: Efficient Code Reasoning via First-Token Surprisal
(2025)
Wenhao Zeng et al.
1.28
Can Visual Input Be Compressed? A Visual Token Compression Benchmark for Large Multimodal Models
(2025)
Tianfan Peng et al.
1.28
Understanding and Harnessing Sparsity in Unified Multimodal Models
(2025)
Shwai He et al.
1.28
Alchemist: Unlocking Efficiency in Text-to-Image Model Training via Meta-Gradient Data Selection
(2025)
Kaixin Ding et al.
1.28
Hiformer: Heterogeneous Feature Interactions Learning with Transformers for Recommender Systems
(2023)
Huan Gui et al.
β
PathFinder: Guided Search over Multi-Step Reasoning Paths
(2023)
Olga Golovneva et al.
β
An Image is Worth 1/2 Tokens After Layer 2: Plug-and-Play Inference Acceleration for Large Vision-Language Models
(2024)
Liang Chen et al.
β
LLM Pruning and Distillation in Practice: The Minitron Approach
(2024)
Sharath Turuvekere Sreenivas et al.
β
SaRA: High-Efficient Diffusion Model Fine-tuning with Progressive Sparse Low-Rank Adaptation
(2024)
Teng Hu et al.
β
A Survey of Small Language Models
(2024)
Chien Van Nguyen et al.
β
HtmlRAG: HTML is Better Than Plain Text for Modeling Retrieved Knowledge in RAG Systems
(2024)
Jiejun Tan et al.
β