T2I-CompBench
Emerging8papers using it
2024first seen
'T-2I-CompBench' is a benchmark used to evaluate text-image alignment in multimodal diffusion transformers by assessing aspects such as object appearance, attribute binding, and spatial relationships.
Papers using T2I-CompBench (8)
- IV-CoT: Implicit Visual Chain-of-Thought for Structure-Aware Text-to-Image GenerationCan AI Draw Science? A Benchmark for Evaluating Scientific Figure Generation by Text-to-Image and Multimodal ModelsPrompt Reinjection: Alleviating Prompt Forgetting in Multimodal Diffusion Transformers for Text-to-Image GenerationIterative Refinement Improves Compositional Image GenerationShape of Thought: Progressive Object Assembly via Visual Chain-of-ThoughtSRUM: Fine-Grained Self-Rewarding for Unified Multimodal ModelsRethinking Cross-Modal Interaction in Multimodal Diffusion TransformersREVISION: Rendering Tools Enable Spatial Fidelity in Vision-Language
Models