Awesome Large Language Models
π
Papers
π§
Topics
π₯
Trending
πΊοΈ
Map
π
Leaderboards
π
Learn
π€
Ask AI
β―
More
π₯
Authors
π
Reading Packs
π
Datasets
π οΈ
Tools
π°
News
π
Blogs
βοΈ
Newsletter
π―
Research Radar
π
Saved
+ Add Paper
βΎ
β
β all topics
overview
metric
loadingβ¦
π€
Ask AI
Awesome metric β curated papers, datasets & benchmarks Β· Awesome Large Language Models
β all topics
overview
metric
12 papers tagged metric β re-sort below
Papers
π₯ Trending (default)
π Most cited
π Newest first
π€ A β Z by title
12 papers Β· trending (default)
numbers = π₯ heat
Image Generators are Generalist Vision Learners
(2026)
Valentin Gabeur et al.
1.94
Ο-Rec: A Verifiable Benchmark for Agentic Recommender Systems
(2026)
Bharath Sivaram Narasimhan et al.
1.94
3D HAMSTER: Bridging Planning and Control in Hierarchical Vision Language Action Models through 3D Trajectory Guidance
(2026)
Dongyoon Hwang et al.
1.94
VRBench: A Benchmark for Multi-Step Reasoning in Long Narrative Videos
(2025)
Jiashuo Yu et al.
1.28
Pruning the Unsurprising: Efficient Code Reasoning via First-Token Surprisal
(2025)
Wenhao Zeng et al.
1.28
TensorBLEU: Vectorized GPU-based BLEU Score Implementation for Per-Sentence In-Training Evaluation
(2025)
Adam Filipek
1.28
The Best of N Worlds: Aligning Reinforcement Learning with Best-of-N Sampling via max@k Optimisation
(2025)
Farid Bagirov et al.
1.28
Beyond Token-level Supervision: Unlocking the Potential of Decoding-based Regression via Reinforcement Learning
(2025)
Ming Chen et al.
1.28
Guiding Vision-Language Model Selection for Visual Question-Answering Across Tasks, Domains, and Knowledge Types
(2024)
Neelabh Sinha et al.
β
Is Preference Alignment Always the Best Option to Enhance LLM-Based Translation? An Empirical Analysis
(2024)
Hippolyte Gisserot-Boukhlef et al.
β
AuroraCap: Efficient, Performant Video Detailed Captioning and a New Benchmark
(2024)
Wenhao Chai et al.
β
MMIE: Massive Multimodal Interleaved Comprehension Benchmark for Large Vision-Language Models
(2024)
Peng Xia et al.
β