Awesome Large Language Models
π
Papers
π§
Topics
π₯
Trending
πΊοΈ
Map
π
Leaderboards
π
Learn
π€
Ask AI
β―
More
π₯
Authors
π
Reading Packs
π
Datasets
π οΈ
Tools
π°
News
π
Blogs
βοΈ
Newsletter
π―
Research Radar
π
Saved
+ Add Paper
βΎ
β
β all topics
overview
factual
loadingβ¦
π€
Ask AI
Awesome factual β curated papers, datasets & benchmarks Β· Awesome Large Language Models
β all topics
overview
factual
12 papers tagged factual β re-sort below
Papers
π₯ Trending (default)
π Most cited
π Newest first
π€ A β Z by title
12 papers Β· trending (default)
numbers = π₯ heat
Preserving Privacy, Increasing Accessibility, and Reducing Cost: An On-Device Artificial Intelligence Model for Medical Transcription and Note Generation
(2025)
Johnson Thomas et al.
2.87
MemSyco-Bench: Benchmarking Sycophancy in Agent Memory
(2026)
Zhishang Xiang et al.
2.00
Wiki Live Challenge: Challenging Deep Research Agents with Expert-Level Wikipedia Articles
(2026)
Shaohan Wang et al.
1.94
Seeing Isn't Believing: Uncovering Blind Spots in Evaluator Vision-Language Models
(2026)
Mohammed Safi Ur Rahman Khan et al.
1.94
Formalizing Latent Thoughts: Four Axioms of Thought Representation in LLMs
(2026)
Fahd Seddik et al.
1.94
Linear representations in language models can change dramatically over a conversation
(2026)
Andrew Kyle Lampinen et al.
1.67
How to Steer LLM Latents for Hallucination Detection?
(2025)
Seongheon Park et al.
1.28
WikiAutoGen: Towards Multi-Modal Wikipedia-Style Article Generation
(2025)
Zhongyu Yang et al.
1.28
Provable Benefits of In-Tool Learning for Large Language Models
(2025)
Sam Houliston et al.
1.28
When Big Models Train Small Ones: Label-Free Model Parity Alignment for Efficient Visual Question Answering using Small VLMs
(2025)
Abhirama Subramanyam Penamakuri et al.
1.28
Mitigating Object and Action Hallucinations in Multimodal LLMs via Self-Augmented Contrastive Alignment
(2025)
Kai-Po Chang et al.
1.28
CLINIC: Evaluating Multilingual Trustworthiness in Language Models for Healthcare
(2025)
Akash Ghosh et al.
1.28