Awesome Speech Audio
π
Papers
π§
Topics
π₯
Trending
πΊοΈ
Map
π
Leaderboards
π
Learn
π€
Ask AI
β―
More
π₯
Authors
π
Reading Packs
π
Datasets
π οΈ
Tools
π°
News
π
Blogs
βοΈ
Newsletter
π―
Research Radar
π
Saved
+ Add Paper
βΎ
β
β authors
Β·
overview
Loading authorβ¦
π€
Ask AI
Zixuan Wang β most-cited papers & profile Β· Speech Audio
β authors
Β·
overview
Zixuan Wang
18
papers Β·
3
citations Β·
0
h-index
National Chung Cheng University
Google Scholar β
Semantic Scholar β
OpenAlex β
Most-cited papers
C3LLM: Conditional Multimodal Content Generation Using Large Language Models
2024 Β· 3 citations
StarVLA-$Ξ±$: Reducing Complexity in Vision-Language-Action Systems
2026
AgenticRec: End-to-End Tool-Integrated Policy Optimization for Ranking-Oriented Recommender Agents
2026
Unified-mas: Universally Generating Domain-specific Nodes For Empowering Automatic Multi-agent Systems
2026
Step 3.5 Flash: Open Frontier-Level Intelligence with 11B Active Parameters
2026
UCM: Unifying Camera Control and Memory with Time-aware Positional Encoding Warping for World Models
2026
Step 3.5 Flash: Open Frontier-Level Intelligence with 11B Active Parameters
2026
Scaling Latent Reasoning via Looped Language Models
2025
GroundAct: Can LLM Agents Ground Actions in Environmental States?
2025
LiveCodeBench Pro: How Do Olympiad Medalists Judge LLMs in Competitive Programming?
2025
ANNIE: Be Careful Of Your Robots
2025
Spatialladder: Progressive Training For Spatial Reasoning In Vision-language Models
2025
Omniear: Benchmarking Agent Reasoning In Embodied Tasks
2025
Reasoning-enhanced Domain-adaptive Pretraining Of Multimodal Large Language Models For Short Video Content Governance
2025
Transformers Learn to Implement Multi-step Gradient Descent with Chain of Thought
2025
Topics
Model Architecture
Training Techniques
Control
Perception
Multi-Agent
Benchmarks
Vision-Language Models
In-Context Learning
Navigation
Code Models