Awesome Multimodal
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Thanh-Toan Do — most-cited papers & profile · Multimodal
← authors
·
overview
Thanh-Toan Do
11
papers ·
37
citations ·
31
h-index
Australian Regenerative Medicine Institute · Monash University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
V2CNet: A Deep Learning Framework to Translate Videos to Commands for Robotic Manipulation
2019 · 25 citations
Image-based Vehicle Analysis using Deep Neural Network: A Systematic Study
2016 · 12 citations
Sharpness-aware Minimization In Logit Space Efficiently Enhances Direct Preference Optimization
2026
Layer-Wise High-Impact Parameter Ratio Optimization in Post-Training Quantization for Large Language Models
2025
SceneCut: Joint Geometric and Object Segmentation for Indoor Scenes
2017
Object Captioning and Retrieval with Natural Language
2018
Visual Localization Under Appearance Change: Filtering Approaches
2018
Simultaneous Feature Aggregating and Hashing for Compact Binary Code Learning
2019
Uncertainty in Model-Agnostic Meta-Learning using Variational Inference
2019
MirrorNet: Bio-Inspired Camouflaged Object Segmentation
2020
Camouflaged Instance Segmentation In-The-Wild: Dataset, Method, and Benchmark Suite
2021
Topics
Object Detection
Segmentation
Training Techniques
Efficiency
Autonomous Driving
Visual Language
Safety & Alignment
Fine-Tuning
3D Vision
Tracking