Awesome Large Language Models
π
Papers
π§
Topics
π₯
Trending
πΊοΈ
Map
π
Leaderboards
π
Learn
π€
Ask AI
β―
More
π₯
Authors
π
Reading Packs
π
Datasets
π οΈ
Tools
π°
News
π
Blogs
βοΈ
Newsletter
π―
Research Radar
π
Saved
+ Add Paper
βΎ
β
β all topics
overview
external
loadingβ¦
π€
Ask AI
Awesome external β curated papers, datasets & benchmarks Β· Awesome Large Language Models
β all topics
overview
external
14 papers tagged external β re-sort below
Papers
π₯ Trending (default)
π Most cited
π Newest first
π€ A β Z by title
14 papers Β· trending (default)
numbers = π₯ heat
THINKSAFE: Self-Generated Safety Alignment for Reasoning Models
(2026)
Seanie Lee et al.
1.94
Web2BigTable: A Bi-Level Multi-Agent LLM System for Internet-Scale Information Search and Extraction
(2026)
Yuxuan Huang et al.
1.94
WorldMemArena: Evaluating Multimodal Agent Memory Through Action-World Interaction
(2026)
Chengzhi Liu et al.
1.94
Search-o1: Agentic Search-Enhanced Large Reasoning Models
(2025)
Xiaoxi Li et al.
1.28
SafeRAG: Benchmarking Security in Retrieval-Augmented Generation of Large Language Model
(2025)
Xun Liang et al.
1.28
GIMMICK -- Globally Inclusive Multimodal Multitask Cultural Knowledge Benchmarking
(2025)
Florian Schneider et al.
1.28
PlainQAFact: Automatic Factuality Evaluation Metric for Biomedical Plain Language Summaries Generation
(2025)
Zhiwen You et al.
1.28
Agentic Reinforced Policy Optimization
(2025)
Guanting Dong et al.
1.28
ARM-Thinker: Reinforcing Multimodal Generative Reward Models with Agentic Tool Use and Visual Reasoning
(2025)
Shengyuan Ding et al.
1.28
LLaVA-Plus: Learning to Use Tools for Creating Multimodal Agents
(2023)
Shilong Liu et al.
β
Weaver: Foundation Models for Creative Writing
(2024)
Tiannan Wang et al.
β
MyVLM: Personalizing VLMs for User-Specific Queries
(2024)
Yuval Alaluf et al.
β
HEMM: Holistic Evaluation of Multimodal Foundation Models
(2024)
Paul Pu Liang et al.
β
AgentPoison: Red-teaming LLM Agents via Poisoning Memory or Knowledge Bases
(2024)
Zhaorun Chen et al.
β