Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Xintao Wang — most-cited papers & profile · Multimodal
← authors
·
overview
Xintao Wang
18
papers ·
300
citations ·
38
h-index
Wuhan University of Technology · Fudan University · Ganzhou People's Hospital · Kuaishou (China)
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
From Persona To Personalization: A Survey On Role-playing Language Agents
2024 · 222 citations
Teaching Large Language Models To Express Knowledge Boundary From Their Own Signals
2024 · 31 citations
GRPO-Guard: Mitigating Implicit Over-Optimization in Flow Matching via Regulated Clipping
2025 · 26 citations
Character Is Destiny: Can Role-playing Language Agents Make Persona-driven Decisions?
2024 · 21 citations
DUO-VSR: Dual-Stream Distillation for One-Step Video Super-Resolution
2026
DUO-VSR: Dual-Stream Distillation for One-Step Video Super-Resolution
2026
SVG-T2I: Scaling Up Text-to-Image Latent Diffusion Model Without Variational Autoencoder
2025
Harnessing Uncertainty: Entropy-Modulated Policy Gradients for Long-Horizon LLM Agents
2025
Learning Video Generation for Robotic Manipulation with Collaborative Trajectory Control
2025
DiffMoE: Dynamic Token Selection for Scalable Diffusion Transformers
2025
Path-Restore: Learning Network Path Selection for Image Restoration
2019
GLEAN: Generative Latent Bank for Large-Factor Image Super-Resolution
2020
Topics
Diffusion Models
Text-to-Image
Vision-Language
Agentic
Evaluation
Policy Gradient
RLHF & Alignment
GANs
Training & Sampling
Image Restoration