Awesome Computer Vision
π
Papers
π§
Topics
π₯
Trending
πΊοΈ
Map
π
Leaderboards
π
Learn
π€
Ask AI
β―
More
π₯
Authors
π
Reading Packs
π
Datasets
π οΈ
Tools
π°
News
π
Blogs
βοΈ
Newsletter
π―
Research Radar
π
Saved
+ Add Paper
βΎ
β
β authors
Β·
overview
Loading authorβ¦
π€
Ask AI
Shaosheng Cao β most-cited papers & profile Β· Computer Vision
β authors
Β·
overview
Shaosheng Cao
14
papers Β·
0
citations
Google Scholar β
Semantic Scholar β
OpenAlex β
Most-cited papers
Robust Tool Use via Fission-GRPO: Learning to Recover from Execution Errors
2026
Decouple Searching from Training: Scaling Data Mixing via Model Merging for Large Language Model Pre-training
2026
One Token Is Enough: Improving Diffusion Language Models with a Sink Token
2026
Optimizing Generative Ranking Relevance via Reinforcement Learning in Xiaohongshu Search
2025
RedOne 2.0: Rethinking Domain-specific LLM Post-Training in Social Networking Services
2025
MT\(^3\): Scaling Mllm-based Text Image Machine Translation Via Multi-task Reinforcement Learning
2025
Sns-bench-vl: Benchmarking Multimodal Large Language Models In Social Networking Services
2025
Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models
2025
Actial: Activate Spatial Reasoning Ability of Multimodal Large Language Models
2025
Cluster-Driven Expert Pruning for Mixture-of-Experts Large Language Models
2025
Vision-R1: Incentivizing Reasoning Capability in Multimodal Large Language Models
2025
CodeIF: Benchmarking the Instruction-Following Capabilities of Large Language Models for Code Generation
2025
IW-Bench: Evaluating Large Multimodal Models for Converting Image-to-Web
2024
Dynamic-LLaVA: Efficient Multimodal Large Language Models via Dynamic Vision-language Context Sparsification
2024
Topics
RAG
cs.AI
Vision-Language Models
Visual QA & Reasoning
Video-Language
Reinforcement Learning
Vision-Language
Learning
Code Generation
Code Models