← all papers · overview

Training Data Selection With Gradient Orthogonality For Efficient Domain Adaptation

Abstract

Fine-tuning large language models (LLMs) for specialized domains often necessitates a trade-off between acquiring domain expertise and retaining general reasoning capabilities, a phenomenon known as catastrophic forgetting. Existing remedies face a dichotomy: gradient surgery methods offer geometric safety but incur prohibitive computational costs via online projections, while efficient data selec

Related papers

Ranked by semantic similarity — how closely each paper's abstract matches this one (100% = near-identical topic).