LumiGen: An LVLM-Enhanced Iterative Framework for Fine-Grained Text-to-Image Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Dong, Xiaoqi, Zhou, Xiangyu, Evans, Nicholas, Lin, Yujia |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
LumiX: Structured and Coherent Text-to-Intrinsic Generation
di: Han, Xu, et al.
Pubblicazione: (2025)
di: Han, Xu, et al.
Pubblicazione: (2025)
FlexControl: Computation-Aware ControlNet with Differentiable Router for Text-to-Image Generation
di: Fang, Zheng, et al.
Pubblicazione: (2025)
di: Fang, Zheng, et al.
Pubblicazione: (2025)
LumiNet: Latent Intrinsics Meets Diffusion Models for Indoor Scene Relighting
di: Xing, Xiaoyan, et al.
Pubblicazione: (2024)
di: Xing, Xiaoyan, et al.
Pubblicazione: (2024)
Gen-C: Populating Virtual Worlds with Generative Crowds
di: Panayiotou, Andreas, et al.
Pubblicazione: (2025)
di: Panayiotou, Andreas, et al.
Pubblicazione: (2025)
LayerCraft: Enhancing Text-to-Image Generation with CoT Reasoning and Layered Object Integration
di: Zhang, Yuyao, et al.
Pubblicazione: (2025)
di: Zhang, Yuyao, et al.
Pubblicazione: (2025)
Don't Mesh with Me: Generating Constructive Solid Geometry Instead of Meshes by Fine-Tuning a Code-Generation LLM
di: Mews, Maximilian, et al.
Pubblicazione: (2024)
di: Mews, Maximilian, et al.
Pubblicazione: (2024)
Expressive Text-to-Image Generation with Rich Text
di: Ge, Songwei, et al.
Pubblicazione: (2023)
di: Ge, Songwei, et al.
Pubblicazione: (2023)
ElastoGen: 4D Generative Elastodynamics
di: Feng, Yutao, et al.
Pubblicazione: (2024)
di: Feng, Yutao, et al.
Pubblicazione: (2024)
DreamBlend: Advancing Personalized Fine-tuning of Text-to-Image Diffusion Models
di: Ram, Shwetha, et al.
Pubblicazione: (2024)
di: Ram, Shwetha, et al.
Pubblicazione: (2024)
LGCC: Enhancing Flow Matching Based Text-Guided Image Editing with Local Gaussian Coupling and Context Consistency
di: Liu, Fangbing, et al.
Pubblicazione: (2025)
di: Liu, Fangbing, et al.
Pubblicazione: (2025)
Harness Local Rewards for Global Benefits: Effective Text-to-Video Generation Alignment with Patch-level Reward Models
di: Wang, Shuting, et al.
Pubblicazione: (2025)
di: Wang, Shuting, et al.
Pubblicazione: (2025)
FlowMotion: Target-Predictive Conditional Flow Matching for Jitter-Reduced Text-Driven Human Motion Generation
di: Cuba, Manolo Canales, et al.
Pubblicazione: (2025)
di: Cuba, Manolo Canales, et al.
Pubblicazione: (2025)
Generating Multi-Image Synthetic Data for Text-to-Image Customization
di: Kumari, Nupur, et al.
Pubblicazione: (2025)
di: Kumari, Nupur, et al.
Pubblicazione: (2025)
Instant3D: Instant Text-to-3D Generation
di: Li, Ming, et al.
Pubblicazione: (2023)
di: Li, Ming, et al.
Pubblicazione: (2023)
SpotDiff: Spotting and Disentangling Interference in Feature Space for Subject-Preserving Image Generation
di: Li, Yongzhi, et al.
Pubblicazione: (2025)
di: Li, Yongzhi, et al.
Pubblicazione: (2025)
Multimodal Benchmarking and Recommendation of Text-to-Image Generation Models
di: Wanaskar, Kapil, et al.
Pubblicazione: (2025)
di: Wanaskar, Kapil, et al.
Pubblicazione: (2025)
GenCAD: Image-Conditioned Computer-Aided Design Generation with Transformer-Based Contrastive Representation and Diffusion Priors
di: Alam, Md Ferdous, et al.
Pubblicazione: (2024)
di: Alam, Md Ferdous, et al.
Pubblicazione: (2024)
DreamDPO: Aligning Text-to-3D Generation with Human Preferences via Direct Preference Optimization
di: Zhou, Zhenglin, et al.
Pubblicazione: (2025)
di: Zhou, Zhenglin, et al.
Pubblicazione: (2025)
Steerable Scene Generation with Post Training and Inference-Time Search
di: Pfaff, Nicholas, et al.
Pubblicazione: (2025)
di: Pfaff, Nicholas, et al.
Pubblicazione: (2025)
GraphShaper: Geometry-aware Alignment for Improving Transfer Learning in Text-Attributed Graphs
di: Zhang, Heng, et al.
Pubblicazione: (2025)
di: Zhang, Heng, et al.
Pubblicazione: (2025)
MidSurfNet: Learnable Face Pairing and Interference Implicit Fields for Generalized Mid-surface Abstraction
di: Ye, Li, et al.
Pubblicazione: (2026)
di: Ye, Li, et al.
Pubblicazione: (2026)
Generative Panoramic Image Stitching
di: Tuli, Mathieu, et al.
Pubblicazione: (2025)
di: Tuli, Mathieu, et al.
Pubblicazione: (2025)
SPICE: A Synergistic, Precise, Iterative, and Customizable Image Editing Workflow
di: Tang, Kenan, et al.
Pubblicazione: (2025)
di: Tang, Kenan, et al.
Pubblicazione: (2025)
DebiasPI: Inference-time Debiasing by Prompt Iteration of a Text-to-Image Generative Model
di: Bonna, Sarah, et al.
Pubblicazione: (2025)
di: Bonna, Sarah, et al.
Pubblicazione: (2025)
Navigating Text-To-Image Customization: From LyCORIS Fine-Tuning to Model Evaluation
di: Yeh, Shih-Ying, et al.
Pubblicazione: (2023)
di: Yeh, Shih-Ying, et al.
Pubblicazione: (2023)
Learning to Synthesize Compatible Fashion Items Using Semantic Alignment and Collocation Classification: An Outfit Generation Framework
di: Zhou, Dongliang, et al.
Pubblicazione: (2025)
di: Zhou, Dongliang, et al.
Pubblicazione: (2025)
One-Step Image Translation with Text-to-Image Models
di: Parmar, Gaurav, et al.
Pubblicazione: (2024)
di: Parmar, Gaurav, et al.
Pubblicazione: (2024)
Training-Free Consistent Text-to-Image Generation
di: Tewel, Yoad, et al.
Pubblicazione: (2024)
di: Tewel, Yoad, et al.
Pubblicazione: (2024)
REED-VAE: RE-Encode Decode Training for Iterative Image Editing with Diffusion Models
di: Almog, Gal, et al.
Pubblicazione: (2025)
di: Almog, Gal, et al.
Pubblicazione: (2025)
PosterO: Structuring Layout Trees to Enable Language Models in Generalized Content-Aware Layout Generation
di: Hsu, HsiaoYuan, et al.
Pubblicazione: (2025)
di: Hsu, HsiaoYuan, et al.
Pubblicazione: (2025)
Customizing Text-to-Image Models with a Single Image Pair
di: Jones, Maxwell, et al.
Pubblicazione: (2024)
di: Jones, Maxwell, et al.
Pubblicazione: (2024)
Attention-Based Learning for Fluid State Interpolation and Editing in a Time-Continuous Framework
di: Roy, Bruno
Pubblicazione: (2024)
di: Roy, Bruno
Pubblicazione: (2024)
A Batch-Insensitive Dynamic GNN Approach to Address Temporal Discontinuity in Graph Streams
di: Zhou, Yang, et al.
Pubblicazione: (2025)
di: Zhou, Yang, et al.
Pubblicazione: (2025)
MCMC: Bridging Rendering, Optimization and Generative AI
di: Singh, Gurprit, et al.
Pubblicazione: (2025)
di: Singh, Gurprit, et al.
Pubblicazione: (2025)
Evaluating Machine Learning Approaches for ASCII Art Generation
di: Coumar, Sai, et al.
Pubblicazione: (2025)
di: Coumar, Sai, et al.
Pubblicazione: (2025)
A Few-Step Generative Model on Cumulative Flow Maps
di: Li, Zhiqi, et al.
Pubblicazione: (2026)
di: Li, Zhiqi, et al.
Pubblicazione: (2026)
GenHMR: Generative Human Mesh Recovery
di: Saleem, Muhammad Usama, et al.
Pubblicazione: (2024)
di: Saleem, Muhammad Usama, et al.
Pubblicazione: (2024)
Mitigating Semantic Collapse in Generative Personalization with Test-Time Embedding Adjustment
di: Bui, Anh, et al.
Pubblicazione: (2025)
di: Bui, Anh, et al.
Pubblicazione: (2025)
Neon: Negative Extrapolation From Self-Training Improves Image Generation
di: Alemohammad, Sina, et al.
Pubblicazione: (2025)
di: Alemohammad, Sina, et al.
Pubblicazione: (2025)
AnimateDiff: Animate Your Personalized Text-to-Image Diffusion Models without Specific Tuning
di: Guo, Yuwei, et al.
Pubblicazione: (2023)
di: Guo, Yuwei, et al.
Pubblicazione: (2023)
Documenti analoghi
-
LumiX: Structured and Coherent Text-to-Intrinsic Generation
di: Han, Xu, et al.
Pubblicazione: (2025) -
FlexControl: Computation-Aware ControlNet with Differentiable Router for Text-to-Image Generation
di: Fang, Zheng, et al.
Pubblicazione: (2025) -
LumiNet: Latent Intrinsics Meets Diffusion Models for Indoor Scene Relighting
di: Xing, Xiaoyan, et al.
Pubblicazione: (2024) -
Gen-C: Populating Virtual Worlds with Generative Crowds
di: Panayiotou, Andreas, et al.
Pubblicazione: (2025) -
LayerCraft: Enhancing Text-to-Image Generation with CoT Reasoning and Layered Object Integration
di: Zhang, Yuyao, et al.
Pubblicazione: (2025)