Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Jiaxing Huang — most-cited papers & profile · Multimodal
← authors
·
overview
Jiaxing Huang
22
papers ·
400
citations ·
21
h-index
Tianjin University · Nanyang Technological University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
R1-VL: Learning to Reason with Multimodal Large Language Models via Step-wise Group Relative Policy Optimization
2025 · 274 citations
Cross-View Regularization for Domain Adaptive Panoptic Segmentation
2021 · 48 citations
Domain Adaptive Video Segmentation via Temporal Consistency Regularization
2021 · 43 citations
Longhalqa: Long-context Hallucination Evaluation For Multimodal Large Language Models
2024 · 7 citations
DA-DETR: Domain Adaptive Detection Transformer with Information Fusion
2021 · 5 citations
FBC-GAN: Diverse and Flexible Image Synthesis via Foreground-Background Composition
2021 · 5 citations
Semantic-Aligned Matching for Enhanced DETR Convergence and Multi-Scale Feature Fusion
2022 · 5 citations
Open-Vocabulary Object Detection via Language Hierarchy
2024 · 5 citations
Hierarchy Composition GAN for High-fidelity Image Synthesis
2019 · 2 citations
Hierarchy Composition GAN for High-fidelity Image Synthesis
2019 · 2 citations
Spectral Unsupervised Domain Adaptation for Visual Recognition
2021 · 2 citations
Domain Adaptive Video Segmentation via Temporal Pseudo Supervision
2022 · 2 citations
A Survey On Agentic Multimodal Large Language Models
2025
OpenClaw-Skill: Collective Skill Tree Search for Agentic Large Language Models
2026
OpenClaw-Skill: Collective Skill Tree Search for Agentic Large Language Models
2026
Topics
Segmentation
Object Detection
Model-Based RL
RLHF & Alignment
Evaluation
Policy Gradient
Vision-Language
RAG
Reinforcement Learning
Training Techniques