Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Wenhao Jiang — most-cited papers & profile · Multimodal
← authors
·
overview
Wenhao Jiang
11
papers ·
41
citations ·
0
h-index
Guangdong University Of Finances and Economics · Zhongda Hospital Southeast University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Learning to Guide Decoding for Image Captioning
2018 · 23 citations
VLMixer: Unpaired Vision-Language Pre-training via Cross-Modal CutMix
2022 · 12 citations
RAISE: Reinforced Adaptive Instruction Selection For Large Language Models
2025 · 3 citations
SDE-SQL: Enhancing Text-to-SQL Generation in Large Language Models via Self-Driven Exploration with SQL Probes
2025 · 1 citations
Evaluating Clinical Competencies of Large Language Models with a General Practice Benchmark
2025 · 1 citations
Recurrent Fusion Network for Image Captioning
2018 · 1 citations
LEA: Label Enumeration Attack in Vertical Federated Learning
2026
Enhancing Geometric Perception in VLMs via Translator-Guided Reinforcement Learning
2026
AdmTree: Compressing Lengthy Context with Adaptive Semantic Trees
2025
Federated Large Language Models: Feasibility, Robustness, Security and Future Directions
2025
Topics
Visual Language
Fine-Tuning
Efficiency
Training Techniques
cs.LG
Image Generation
Reinforcement Learning
Code Models
Code Generation
Code Understanding