Awesome Time Series
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Peng Gao — most-cited papers & profile · Time Series
← authors
·
overview
Peng Gao
29
papers ·
264
citations ·
27
h-index
University of Wollongong · Changzhou University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
CSWin-UNet: Transformer UNet with Cross-Shaped Windows for Medical Image Segmentation
2024 · 151 citations
OGMN: Occlusion-guided Multi-task Network for Object Detection in UAV Images
2023 · 62 citations
Instruct2Act: Mapping Multi-modality Instructions to Robotic Actions with Large Language Model
2023 · 31 citations
Longhalqa: Long-context Hallucination Evaluation For Multimodal Large Language Models
2024 · 7 citations
MMT-Bench: A Comprehensive Multimodal Benchmark for Evaluating Large Vision-Language Models Towards Multitask AGI
2024 · 6 citations
A3VLM: Actionable Articulation-Aware Vision Language Model
2024 · 2 citations
Lumina-mGPT: Illuminate Flexible Photorealistic Text-to-Image Generation with Multimodal Generative Pretraining
2024 · 2 citations
ReciNet: Reciprocal Space-Aware Long-Range Modeling for Crystalline Property Prediction
2025 · 1 citations
MLOmics: Cancer Multi-Omics Database for Machine Learning
2024 · 1 citations
SKT: Integrating State-Aware Keypoint Trajectories with Vision-Language Models for Robotic Garment Manipulation
2024 · 1 citations
Spatial Preference Rewarding For Mllms Spatial Understanding
2025
Collaborative Planning with Concurrent Synchronization for Operationally Constrained UAV-UGV Teams
2026
ACPO: Adaptive Curriculum Policy Optimization for Aligning Vision-Language Models in Complex Reasoning
2025
MME-CoT: Benchmarking Chain-of-Thought in Large Multimodal Models for Reasoning Quality, Robustness, and Efficiency
2025
Visionary-r1: Mitigating Shortcuts In Visual Reasoning With Reinforcement Learning
2025
Topics
Perception
Multi-Robot
Manipulation
Vision-Language Models
Navigation
Evaluation
Control
Efficiency
Visual QA & Reasoning
Human-Robot Interaction