IterComp: Iterative Composition-Aware Feedback Learning from Model Gallery for Text-to-Image Generation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Zhang, Xinchen, Yang, Ling, Li, Guohao, Cai, Yaqi, Xie, Jiake, Tang, Yong, Yang, Yujiu, Wang, Mengdi, Cui, Bin |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
RealCompo: Balancing Realism and Compositionality Improves Text-to-Image Diffusion Models
par: Zhang, Xinchen, et autres
Publié: (2024)
par: Zhang, Xinchen, et autres
Publié: (2024)
Diffusion-Sharpening: Fine-tuning Diffusion Models with Denoising Trajectory Sharpening
par: Tian, Ye, et autres
Publié: (2025)
par: Tian, Ye, et autres
Publié: (2025)
LiFi: Lightweight Controlled Text Generation with Fine-Grained Control Codes
par: Shi, Chufan, et autres
Publié: (2024)
par: Shi, Chufan, et autres
Publié: (2024)
CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback
par: Wan, Yixin, et autres
Publié: (2025)
par: Wan, Yixin, et autres
Publié: (2025)
IterInv: Iterative Inversion for Pixel-Level T2I Models
par: Tang, Chuanming, et autres
Publié: (2023)
par: Tang, Chuanming, et autres
Publié: (2023)
IterGen: Iterative Semantic-aware Structured LLM Generation with Backtracking
par: Ugare, Shubham, et autres
Publié: (2024)
par: Ugare, Shubham, et autres
Publié: (2024)
IterKey: Iterative Keyword Generation with LLMs for Enhanced Retrieval Augmented Generation
par: Hayashi, Kazuki, et autres
Publié: (2025)
par: Hayashi, Kazuki, et autres
Publié: (2025)
Story-Iter: A Training-free Iterative Paradigm for Long Story Visualization
par: Mao, Jiawei, et autres
Publié: (2024)
par: Mao, Jiawei, et autres
Publié: (2024)
IterInject: Indirect Prompt Injection Against LLM Agents via Feedback-Guided Iterative Optimization
par: Chen, Zixuan, et autres
Publié: (2026)
par: Chen, Zixuan, et autres
Publié: (2026)
IterSelectTune: An Iterative Training Framework for Efficient Instruction-Tuning Data Selection
par: Song, Jielin, et autres
Publié: (2024)
par: Song, Jielin, et autres
Publié: (2024)
Iterated Invariant Extended Kalman Filter (IterIEKF)
par: Goffin, Sven, et autres
Publié: (2024)
par: Goffin, Sven, et autres
Publié: (2024)
AgentComp: From Agentic Reasoning to Compositional Mastery in Text-to-Image Models
par: Zarei, Arman, et autres
Publié: (2025)
par: Zarei, Arman, et autres
Publié: (2025)
Generative Universal Verifier as Multimodal Meta-Reasoner
par: Zhang, Xinchen, et autres
Publié: (2025)
par: Zhang, Xinchen, et autres
Publié: (2025)
ReasonFlux: Hierarchical LLM Reasoning via Scaling Thought Templates
par: Yang, Ling, et autres
Publié: (2025)
par: Yang, Ling, et autres
Publié: (2025)
IterAlign: Iterative Constitutional Alignment of Large Language Models
par: Chen, Xiusi, et autres
Publié: (2024)
par: Chen, Xiusi, et autres
Publié: (2024)
IterIS: Iterative Inference-Solving Alignment for LoRA Merging
par: Chen, Hongxu, et autres
Publié: (2024)
par: Chen, Hongxu, et autres
Publié: (2024)
IterCQR: Iterative Conversational Query Reformulation with Retrieval Guidance
par: Jang, Yunah, et autres
Publié: (2023)
par: Jang, Yunah, et autres
Publié: (2023)
ScoreFlow: Mastering LLM Agent Workflows via Score-based Preference Optimization
par: Wang, Yinjie, et autres
Publié: (2025)
par: Wang, Yinjie, et autres
Publié: (2025)
IterL2Norm: Fast Iterative L2-Normalization
par: Ye, ChangMin, et autres
Publié: (2024)
par: Ye, ChangMin, et autres
Publié: (2024)
Mastering Text-to-Image Diffusion: Recaptioning, Planning, and Generating with Multimodal LLMs
par: Yang, Ling, et autres
Publié: (2024)
par: Yang, Ling, et autres
Publié: (2024)
Iter Criminis
Publié: (2004)
Publié: (2004)
T2I-CompBench++: An Enhanced and Comprehensive Benchmark for Compositional Text-to-image Generation
par: Huang, Kaiyi, et autres
Publié: (2023)
par: Huang, Kaiyi, et autres
Publié: (2023)
Multi-path Exploration and Feedback Adjustment for Text-to-Image Person Retrieval
par: Kang, Bin, et autres
Publié: (2024)
par: Kang, Bin, et autres
Publié: (2024)
IterSIMP-σ: Evaluating LLM-Assisted Spatial Interventions in Stress-Aware Topology Optimization
par: Yang, Shaoliang, et autres
Publié: (2026)
par: Yang, Shaoliang, et autres
Publié: (2026)
Contextualized Diffusion Models for Text-Guided Image and Video Generation
par: Yang, Ling, et autres
Publié: (2024)
par: Yang, Ling, et autres
Publié: (2024)
VideoTetris: Towards Compositional Text-to-Video Generation
par: Tian, Ye, et autres
Publié: (2024)
par: Tian, Ye, et autres
Publié: (2024)
HermesFlow: Seamlessly Closing the Gap in Multimodal Understanding and Generation
par: Yang, Ling, et autres
Publié: (2025)
par: Yang, Ling, et autres
Publié: (2025)
MaskCD: Mitigating LVLM Hallucinations by Image Head Masked Contrastive Decoding
par: Deng, Jingyuan, et autres
Publié: (2025)
par: Deng, Jingyuan, et autres
Publié: (2025)
Beyond Pixels: Text Enhances Generalization in Real-World Image Restoration
par: Sun, Haoze, et autres
Publié: (2024)
par: Sun, Haoze, et autres
Publié: (2024)
Seeing is Improving: Visual Feedback for Iterative Text Layout Refinement
par: Guo, Junrong, et autres
Publié: (2026)
par: Guo, Junrong, et autres
Publié: (2026)
Text2SQL-Flow: A Robust SQL-Aware Data Augmentation Framework for Text-to-SQL
par: Cai, Qifeng, et autres
Publié: (2025)
par: Cai, Qifeng, et autres
Publié: (2025)
Rich Human Feedback for Text-to-Image Generation
par: Liang, Youwei, et autres
Publié: (2023)
par: Liang, Youwei, et autres
Publié: (2023)
IterQR: An Iterative Framework for LLM-based Query Rewrite in e-Commercial Search System
par: Chen, Shangyu, et autres
Publié: (2025)
par: Chen, Shangyu, et autres
Publié: (2025)
Culture-TRIP: Culturally-Aware Text-to-Image Generation with Iterative Prompt Refinement
par: Jeong, Suchae, et autres
Publié: (2025)
par: Jeong, Suchae, et autres
Publié: (2025)
Text Anomaly Detection with Simplified Isolation Kernel
par: Cao, Yang, et autres
Publié: (2025)
par: Cao, Yang, et autres
Publié: (2025)
Towards Token-Level Text Anomaly Detection
par: Cao, Yang, et autres
Publié: (2026)
par: Cao, Yang, et autres
Publié: (2026)
Visual-CoG: Stage-Aware Reinforcement Learning with Chain of Guidance for Text-to-Image Generation
par: Li, Yaqi, et autres
Publié: (2025)
par: Li, Yaqi, et autres
Publié: (2025)
CompSlider: Compositional Slider for Disentangled Multiple-Attribute Image Generation
par: Zhu, Zixin, et autres
Publié: (2025)
par: Zhu, Zixin, et autres
Publié: (2025)
GalleryGPT: Analyzing Paintings with Large Multimodal Models
par: Bin, Yi, et autres
Publié: (2024)
par: Bin, Yi, et autres
Publié: (2024)
T2V-CompBench: A Comprehensive Benchmark for Compositional Text-to-video Generation
par: Sun, Kaiyue, et autres
Publié: (2024)
par: Sun, Kaiyue, et autres
Publié: (2024)
Documents similaires
-
RealCompo: Balancing Realism and Compositionality Improves Text-to-Image Diffusion Models
par: Zhang, Xinchen, et autres
Publié: (2024) -
Diffusion-Sharpening: Fine-tuning Diffusion Models with Denoising Trajectory Sharpening
par: Tian, Ye, et autres
Publié: (2025) -
LiFi: Lightweight Controlled Text Generation with Fine-Grained Control Codes
par: Shi, Chufan, et autres
Publié: (2024) -
CompAlign: Improving Compositional Text-to-Image Generation with a Complex Benchmark and Fine-Grained Feedback
par: Wan, Yixin, et autres
Publié: (2025) -
IterInv: Iterative Inversion for Pixel-Level T2I Models
par: Tang, Chuanming, et autres
Publié: (2023)