Awesome AI for Science
π
Papers
π§
Topics
π₯
Trending
πΊοΈ
Map
π
Leaderboards
π
Learn
π€
Ask AI
β―
More
π₯
Authors
π
Reading Packs
π
Datasets
π οΈ
Tools
π°
News
π
Blogs
βοΈ
Newsletter
π―
Research Radar
π
Saved
+ Add Paper
βΎ
β
β authors
Β·
overview
Loading authorβ¦
π€
Ask AI
Tianyu Pang β most-cited papers & profile Β· AI for Science
β authors
Β·
overview
Tianyu Pang
17
papers Β·
34
citations Β·
0
h-index
University of Hong Kong Β· South China University of Technology
Google Scholar β
Semantic Scholar β
OpenAlex β
Most-cited papers
Defeating the Training-Inference Mismatch via FP16
2025 Β· 34 citations
VerlTool: Towards Holistic Agentic Reinforcement Learning with Tool Use
2025
Defeating the Training-Inference Mismatch via FP16
2025
Why LLM Safety Guardrails Collapse After Fine-tuning: A Similarity Analysis Between Alignment and Fine-tuning Datasets
2025
Sailor2: Sailing in South-East Asia with Inclusive Multilingual LLMs
2025
Optimizing Anytime Reasoning via Budget Relative Policy Optimization
2025
BanditSpec: Adaptive Speculative Decoding via Bandit Algorithms
2025
LIFT the Veil for the Truth: Principal Weights Emerge after Rank Reduction for Reasoning-Focused Supervised Fine-Tuning
2025
Muon Outperforms Adam in Tail-End Associative Memory Learning
2025
Accumulative Poisoning Attacks On Real-time Data
2021
Weak-to-Strong Jailbreaking on Large Language Models
2024
RegMix: Data Mixture as Regression for Language Model Pre-training
2024
Cheating Automatic LLM Benchmarks: Null Models Achieve High Win Rates
2024
Topics
Efficiency
Training Techniques
Fine-Tuning
fine-tuning
Reinforcement Learning
Code
Evaluation
RLHF & Alignment
Policy Gradient
Value-Based