Awesome Cybersecurity
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Himabindu Lakkaraju — most-cited papers & profile · Cybersecurity
← authors
·
overview
Himabindu Lakkaraju
5
papers ·
382
citations ·
30
h-index
Harvard University Press
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
In-context Unlearning: Language Models As Few Shot Unlearners
2023 · 212 citations
Faithfulness Vs. Plausibility: On The (un)reliability Of Explanations From Large Language Models
2024 · 107 citations
Quantifying Uncertainty In Natural Language Explanations Of Large Language Models
2023 · 36 citations
Manipulating Large Language Models To Increase Product Visibility
2024 · 27 citations
Towards Robust Off-Policy Evaluation via Human Inputs
2022
Topics
Evaluation
Prompting
Safety & Alignment
In-Context Learning
Efficiency
Training Techniques
Fine-Tuning
Offline RL
Safe RL