Awesome Generative Models
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Leshem Choshen — most-cited papers & profile · Generative Models
← authors
·
overview
Leshem Choshen
19
papers ·
0
citations ·
15
h-index
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
When AI Benchmarks Plateau: A Systematic Study of Benchmark Saturation
2026
CRISP: Complex Reasoning with Interpretable Step-based Plans
2025
Beyond Binary Rewards: Training LMs to Reason About Their Uncertainty
2025
Global PIQA: Evaluating Physical Commonsense Reasoning Across 100+ Languages and Cultures
2025
DOVE: A Large-Scale Multi-Dimensional Predictions Dataset Towards Meaningful LLM Evaluation
2025
NeurIPS 2023 LLM Efficiency Fine-tuning Competition
2025
Efficient Benchmarking of Language Models
2023
Genie: Achieving Human Parity in Content-Grounded Datasets Generation
2024
Unforgettable Generalization in Language Models
2024
Benchmark Agreement Testing Done Right: A Guide for LLM Benchmark Evaluation
2024
Top co-authors
Assaf Arbelle
· 1
Eric Zhang
· 1
Felipe Maia Polo
· 1
Jacob Andreas
· 1
Leonid Karlinsky
· 1
Mikhail Yurochkin
· 1
M. Jehanzeb Mirza
· 1
Nimrod Shabtay
· 1
Raja Giryes
· 1
Sivan Doveh
· 1
Wei Lin
· 1
Yuekai Sun
· 1
Topics
Evaluation
Survey Paper
Training Techniques
Fine-Tuning
Efficiency
Vision-Language
Planning
Benchmarks
Code Agents
Reinforcement Learning