Awesome Computer Vision
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Wenqi Shao — most-cited papers & profile · Computer Vision
← authors
·
overview
Wenqi Shao
17
papers ·
628
citations ·
18
h-index
Shanghai Artificial Intelligence Laboratory
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
Omniquant: Omnidirectionally Calibrated Quantization For Large Language Models
2023 · 385 citations
Imagebind-llm: Multi-modality Instruction Tuning
2023 · 174 citations
BESA: Pruning Large Language Models With Blockwise Parameter-efficient Sparsity Allocation
2024 · 51 citations
MPBench: A Comprehensive Multimodal Reasoning Benchmark for Process Errors Identification
2025 · 10 citations
Intern-S1: A Scientific Multimodal Foundation Model
2025 · 5 citations
RoboScript: Code Generation for Free-Form Manipulation Tasks across Real and Simulation
2024 · 3 citations
VTPerception-R1: Enhancing Multimodal Reasoning via Explicit Visual and Textual Perceptual Grounding
2025
Intern-S1: A Scientific Multimodal Foundation Model
2025
Cardiac-CLIP: A Vision-Language Foundation Model for 3D Cardiac CT Images
2025
OWMM-Agent: Open World Mobile Manipulation With Multi-modal Agentic Data Synthesis
2025
InternSpatial: A Comprehensive Dataset for Spatial Reasoning in Vision-Language Models
2025
EMOS: Embodiment-aware Heterogeneous Multi-robot Operating System with LLM Agents
2024
DexHandDiff: Interaction-aware Diffusion Planning for Adaptive Dexterous Manipulation
2024
GPT4RoI: Instruction Tuning Large Language Model on Region-of-Interest
2023
OmniQuant: Omnidirectionally Calibrated Quantization for Large Language Models
2023
Topics
Training Techniques
Efficiency
Model Architecture
Manipulation
Benchmarks
Vision-Language Models
Perception
Control
Fine-Tuning
Vision-Language