Awesome Large Language Models
π
Papers
π§
Topics
π₯
Trending
πΊοΈ
Map
π
Leaderboards
π
Learn
π€
Ask AI
β―
More
π₯
Authors
π
Reading Packs
π
Datasets
π οΈ
Tools
π°
News
π
Blogs
βοΈ
Newsletter
π―
Research Radar
π
Saved
+ Add Paper
βΎ
β
β all topics
overview
domain
loadingβ¦
π€
Ask AI
Awesome domain β curated papers, datasets & benchmarks Β· Awesome Large Language Models
β all topics
overview
domain
24 papers tagged domain β re-sort below
Papers
π₯ Trending (default)
π Most cited
π Newest first
π€ A β Z by title
24 papers Β· trending (default)
numbers = π₯ heat
AgenticDataBench: A Comprehensive Benchmark for Data Agents
(2026)
Zhaoyan Sun et al.
2.00
Beyond Binary Preference: Aligning Diffusion Models to Fine-grained Criteria by Decoupling Attributes
(2026)
Chenye Meng et al.
1.94
An Empirical Study on Preference Tuning Generalization and Diversity Under Domain Shift
(2026)
Constantinos Karouzos et al.
1.94
LM-Lexicon: Improving Definition Modeling via Harmonizing Semantic Experts
(2026)
Yang Liu et al.
1.94
FinToolBench: Evaluating LLM Agents for Real-World Financial Tool Use
(2026)
Jiaxuan Lu et al.
1.94
PRL-Bench: A Comprehensive Benchmark Evaluating LLMs' Capabilities in Frontier Physics Research
(2026)
Tingjia Miao et al.
1.94
Convergent Evolution: How Different Language Models Learn Similar Number Representations
(2026)
Deqing Fu et al.
1.94
MINTEval: Evaluating Memory under Multi-Target Interference in Long-Horizon Agent Systems
(2026)
Hyunji Lee et al.
1.94
AnyGroundBench: A Specialized-Domain Benchmark for Video Grounding in Vision-Language Models
(2026)
Rintaro Otsubo et al.
1.94
COLLEAGUE.SKILL: Automated AI Skill Generation via Expert Knowledge Distillation
(2026)
Tianyi Zhou et al.
1.89
Programming with Data: Test-Driven Data Engineering for Self-Improving LLMs from Raw Corpora
(2026)
Chenkai Pan et al.
1.83
IMAGINE-E: Image Generation Intelligence Evaluation of State-of-the-art Text-to-Image Models
(2025)
Jiayi Lei et al.
1.28
R&B: Domain Regrouping and Data Mixture Balancing for Efficient Foundation Model Training
(2025)
Albert Ge et al.
1.28
What Makes for Text to 360-degree Panorama Generation with Stable Diffusion?
(2025)
Jinhong Ni et al.
1.28
RExBench: Can coding agents autonomously implement AI research extensions?
(2025)
Nicholas Edwards et al.
1.28
Scaling Laws for Optimal Data Mixtures
(2025)
Mustafa Shukor et al.
1.28
Select to Know: An Internal-External Knowledge Self-Selection Framework for Domain-Specific Question Answering
(2025)
Bolei He et al.
1.28
EHR-R1: A Reasoning-Enhanced Foundational Language Model for Electronic Health Record Analysis
(2025)
Yusheng Liao et al.
1.28
AIonopedia: an LLM agent orchestrating multimodal learning for ionic liquid discovery
(2025)
Yuqi Yin et al.
1.28
One-for-All: Generalized LoRA for Parameter-Efficient Fine-tuning
(2023)
Arnav Chavan et al.
β
Jurassic World Remake: Bringing Ancient Fossils Back to Life via Zero-Shot Long Image-to-Image Translation
(2023)
Alexander Martin et al.
β
Knowledge Composition using Task Vectors with Learned Anisotropic Scaling
(2024)
Frederic Z. Zhang et al.
β
Agent Workflow Memory
(2024)
Zora Zhiruo Wang et al.
β
ReMoE: Fully Differentiable Mixture-of-Experts with ReLU Routing
(2024)
Ziteng Wang et al.
β