Awesome Large Language Models
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Ruoxi Jia — most-cited papers & profile · Large Language Models
← authors
·
overview
Ruoxi Jia
19
papers ·
232
citations ·
26
h-index
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Fine-tuning Aligned Language Models Compromises Safety, Even When Users Do Not Intend To!
2023 · 40 citations
SORRY-Bench: Systematically Evaluating Large Language Model Safety Refusal
2024 · 6 citations
Get more for less: Principled Data Selection for Warming Up Fine-Tuning in LLMs
2024 · 3 citations
LLM Can be a Dangerous Persuader: Empirical Study of Persuasion Safety in Large Language Models
2025 · 1 citations
DiPT: Enhancing LLM reasoning through diversified perspective-taking
2024
Top co-authors
Peter Henderson
· 2
Prateek Mittal
· 2
Tinghao Xie
· 2
Xiangyu Qi
· 2
Anit Kumar Sahu
· 1
Bo Li
· 1
Boyi Wei
· 1
Dacheng Li
· 1
Danqi Chen
· 1
Feiyang Kang
· 1
Heajun An
· 1
Himanshu Jahagirdar
· 1
Topics
Fine-Tuning
Safety & Alignment
Training Techniques
RAG
Efficiency
cs.CL
cs.AI
cs.HC
Code
Evaluation