Awesome Large Language Models
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Alexander Robey — most-cited papers & profile · Large Language Models
← authors
·
overview
Alexander Robey
7
papers ·
76
citations ·
14
h-index
Carnegie Mellon University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
SmoothLLM: Defending Large Language Models Against Jailbreaking Attacks
2023 · 29 citations
Defending Large Language Models against Jailbreak Attacks via Semantic Smoothing
2024 · 2 citations
Safety Pretraining: Toward the Next Generation of Safe AI
2025 · 1 citations
Steering Dialogue Dynamics for Robustness against Multi-turn Jailbreaking Attacks
2025
Top co-authors
George J. Pappas
· 2
Hamed Hassani
· 2
Andy Zou
· 1
Bairu Hou
· 1
Changliu Liu
· 1
Dylan Sam
· 1
Eric Wong
· 1
Eric Wong
· 1
Hanjiang Hu
· 1
Jiabao Ji
· 1
J. Zico Kolter
· 1
Matt Fredrikson
· 1
Topics
Safety & Alignment
Evaluation
Code
Prompting