Awesome AI for Code
π
Papers
π§
Topics
π₯
Trending
πΊοΈ
Map
π
Leaderboards
π
Learn
π€
Ask AI
β―
More
π₯
Authors
π
Reading Packs
π
Datasets
π οΈ
Tools
π°
News
π
Blogs
βοΈ
Newsletter
π―
Research Radar
π
Saved
+ Add Paper
βΎ
β
β all topics
overview
code
loadingβ¦
π€
Ask AI
Awesome code β curated papers, datasets & benchmarks Β· Awesome AI for Code
β all topics
overview
code
22 papers tagged code β re-sort below
Papers
π₯ Trending (default)
π Most cited
π Newest first
π€ A β Z by title
22 papers Β· trending (default)
numbers = π₯ heat
Cross-Domain Evaluation of Transformer-Based Vulnerability Detection on Open & Industry Data
(2025)
Moritz Mock et al.
3.81
BenchMAX: A Comprehensive Multilingual Evaluation Suite for Large Language Models
(2025)
Xu Huang et al.
2.87
EpiCaR: Knowing What You Don't Know Matters for Better Reasoning in LLMs
(2026)
Jewon Yeom et al.
1.94
CodePercept: Code-Grounded Visual STEM Perception for MLLMs
(2026)
Tongkun Guan et al.
1.94
NGM: A Plug-and-Play Training-Free Memory Module for LLMs
(2026)
Yuwen Qu et al.
1.94
Grammar-Constrained Decoding Can Jailbreak LLMs into Generating Malicious Code
(2026)
Yitong Zhang et al.
1.94
JAMER: Project-Level Code Framework Dataset and Benchmark on Professional Game Engines
(2026)
Jianwen Sun et al.
1.94
Mid-Training with Self-Generated Data Improves Reinforcement Learning in Language Models
(2026)
Aswin RRV et al.
1.89
SEVerA: Verified Synthesis of Self-Evolving Agents
(2026)
Debangshu Banerjee et al.
1.78
CodeCircuit: Toward Inferring LLM-Generated Code Correctness via Attribution Graphs
(2026)
Yicheng He et al.
1.72
Nanbeige4.1-3B: A Small General Model that Reasons, Aligns, and Acts
(2026)
Chen Yang et al.
1.72
SparseLoRA: Accelerating LLM Fine-Tuning with Contextual Sparsity
(2025)
Samir Khaki et al.
1.28
Use Property-Based Testing to Bridge LLM Code Generation and Validation
(2025)
Lehan He et al.
1.28
Skywork-SWE: Unveiling Data Scaling Laws for Software Engineering in LLMs
(2025)
Liang Zeng et al.
1.28
IWR-Bench: Can LVLMs reconstruct interactive webpage from a user interaction video?
(2025)
Yang Chen et al.
1.28
ReLook: Vision-Grounded RL with a Multimodal LLM Critic for Agentic Web Coding
(2025)
Yuhang Li et al.
1.28
LLC: Accurate, Multi-purpose Learnt Low-dimensional Binary Codes
(2021)
Aditya Kusupati et al.
β
Boosting Learning for LDPC Codes to Improve the Error-Floor Performance
(2023)
Hee-Youl Kwak et al.
β
SciCode: A Research Coding Benchmark Curated by Scientists
(2024)
Minyang Tian et al.
β
OpenDevin: An Open Platform for AI Software Developers as Generalist Agents
(2024)
Xingyao Wang et al.
β
Horizon-Length Prediction: Advancing Fill-in-the-Middle Capabilities for Code Generation with Lookahead Planning
(2024)
Yifeng Ding et al.
β
CAD-Recode: Reverse Engineering CAD Code from Point Clouds
(2024)
Danila Rukhovich et al.
β