Awesome Large Language Models
π
Papers
π§
Topics
π₯
Trending
πΊοΈ
Map
π
Leaderboards
π
Learn
π€
Ask AI
β―
More
π₯
Authors
π
Reading Packs
π
Datasets
π οΈ
Tools
π°
News
π
Blogs
βοΈ
Newsletter
π―
Research Radar
π
Saved
+ Add Paper
βΎ
β
β authors
Β·
overview
Loading authorβ¦
π€
Ask AI
Kaitong Cai β most-cited papers & profile Β· Large Language Models
β authors
Β·
overview
Kaitong Cai
9
papers Β·
0
citations
Google Scholar β
Semantic Scholar β
OpenAlex β
Most-cited papers
MM-CoT:A Benchmark for Probing Visual Chain-of-Thought Reasoning in Multimodal Models
2025
HybridToken-VLM: Hybrid Token Compression for Vision-Language Models
2025
STORM: Search-Guided Generative World Models for Robotic Manipulation
2025
Guardian: Decoupling Exploration from Safety in Reinforcement Learning
2025
Flashvlm: Text-guided Visual Token Selection For Large Multimodal Models
2025
STORM: Search-guided Generative World Models For Robotic Manipulation
2025
Coagent: Collaborative Planning And Consistency Agent For Coherent Video Generation
2025
Cf-vlm:counterfactual Vision-language Fine-tuning
2025
Top-down Semantic Refinement For Image Captioning
2025
Topics
Vision-Language Models
Visual QA & Reasoning
Benchmarks
Video-Language
Embodied & Agents
Manipulation
Exploration
Safe RL
Offline RL
Audio-Visual