Awesome AI Agents
📄
Papers
🧭
Topics
🔥
Trending
🗺️
Map
🏆
Leaderboards
🎓
Learn
🤖
Ask AI
⋯
More
👥
Authors
📚
Reading Packs
📊
Datasets
🛠️
Tools
📰
News
📝
Blogs
✉️
Newsletter
🎯
Research Radar
🔖
Saved
+ Add Paper
☾
☀
← authors
·
overview
Loading author…
🤖
Ask AI
Zhengzhong Tu — most-cited papers & profile · AI Agents
← authors
·
overview
Zhengzhong Tu
17
papers ·
17
citations ·
16
h-index
Texas A&M University System · Mitchell Institute · Texas A&M University
Google Scholar ↗
Semantic Scholar ↗
OpenAlex ↗
Most-cited papers
DecAlign: Hierarchical Cross-Modal Alignment for Decoupled Multimodal Representation Learning
2025 · 17 citations
Visko Orbis 1.0: A Live Model for Real-Time Interactive Long Video Generation
2026
How Independent are Large Language Models? A Statistical Framework for Auditing Behavioral Entanglement and Reweighting Verifier Ensembles
2026
FASA: Frequency-aware Sparse Attention
2026
Does RLVR Extend Reasoning Boundaries? Investigating Capability Expansion in Vision-Language Models
2025
TimePre: Bridging Accuracy, Efficiency, and Stability in Probabilistic Time-Series Forecasting
2025
LLMs Can Get "Brain Rot": A Pilot Study on Twitter/X
2025
VISTA: Generative Visual Imagination for Vision-and-Language Navigation
2025
MoDoMoDo: Multi-Domain Data Mixtures for Multimodal LLM Reinforcement Learning
2025
Demystifying the Visual Quality Paradox in Multimodal Large Language Models
2025
LLMs Can Get "Brain Rot"!
2025
VLM-3R: Vision-Language Models Augmented with Instruction-Aligned 3D Reconstruction
2025
MoDoMoDo: Multi-Domain Data Mixtures for Multimodal LLM Reinforcement Learning
2025
Secure On-Device Video OOD Detection Without Backpropagation
2025
MWFormer: Multi-Weather Image Restoration Using Degradation-Aware Transformers
2024
Topics
cs.CL
Training Techniques
Benchmarks
Vision-Language Models
cs.AI
Vision-Language
Fine-Tuning
Audio-Visual
Image Generation
Video Understanding