RAVEL: Rare Concept Generation and Editing via Graph-driven Relational Guidance
Fuente:
arXiv
Salvato in:
| Autori principali: | Venkatesh, Kavana, Dalva, Yusuf, Lourentzou, Ismini, Yanardag, Pinar |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
FluxSpace: Disentangled Semantic Editing in Rectified Flow Transformers
di: Dalva, Yusuf, et al.
Pubblicazione: (2024)
di: Dalva, Yusuf, et al.
Pubblicazione: (2024)
CREA: A Collaborative Multi-Agent Framework for Creative Image Editing and Generation
di: Venkatesh, Kavana, et al.
Pubblicazione: (2025)
di: Venkatesh, Kavana, et al.
Pubblicazione: (2025)
LoRAShop: Training-Free Multi-Concept Image Generation and Editing with Rectified Flow Transformers
di: Dalva, Yusuf, et al.
Pubblicazione: (2025)
di: Dalva, Yusuf, et al.
Pubblicazione: (2025)
AdaState: Self-Evolving Anchors for Streaming Video Generation
di: Dalva, Yusuf, et al.
Pubblicazione: (2026)
di: Dalva, Yusuf, et al.
Pubblicazione: (2026)
The Curious Case of End Token: A Zero-Shot Disentangled Image Editing using CLIP
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2024)
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2024)
GANTASTIC: GAN-based Transfer of Interpretable Directions for Disentangled Image Editing in Text-to-Image Diffusion Models
di: Dalva, Yusuf, et al.
Pubblicazione: (2024)
di: Dalva, Yusuf, et al.
Pubblicazione: (2024)
Personalized Image Editing in Text-to-Image Diffusion Models via Collaborative Direct Preference Optimization
di: Dunlop, Connor, et al.
Pubblicazione: (2025)
di: Dunlop, Connor, et al.
Pubblicazione: (2025)
Commonsense for Zero-Shot Natural Language Video Localization
di: Holla, Meghana, et al.
Pubblicazione: (2023)
di: Holla, Meghana, et al.
Pubblicazione: (2023)
From Zero to Hero: Training-Free Custom Concept Spawning in World Models
di: Akdemir, Kiymet, et al.
Pubblicazione: (2026)
di: Akdemir, Kiymet, et al.
Pubblicazione: (2026)
LayerFusion: Harmonized Multi-Layer Text-to-Image Generation with Generative Priors
di: Dalva, Yusuf, et al.
Pubblicazione: (2024)
di: Dalva, Yusuf, et al.
Pubblicazione: (2024)
ELBA: Learning by Asking for Embodied Visual Navigation and Task Completion
di: Shen, Ying, et al.
Pubblicazione: (2023)
di: Shen, Ying, et al.
Pubblicazione: (2023)
Phantom: Physics-Infused Video Generation via Joint Modeling of Visual and Latent Physical Dynamics
di: Shen, Ying, et al.
Pubblicazione: (2026)
di: Shen, Ying, et al.
Pubblicazione: (2026)
Open World Scene Graph Generation using Vision Language Models
di: Dutta, Amartya, et al.
Pubblicazione: (2025)
di: Dutta, Amartya, et al.
Pubblicazione: (2025)
MIST: Mitigating Intersectional Bias with Disentangled Cross-Attention Editing in Text-to-Image Diffusion Models
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2024)
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2024)
ORACLE: Leveraging Mutual Information for Consistent Character Generation with LoRAs in Diffusion Models
di: Akdemir, Kiymet, et al.
Pubblicazione: (2024)
di: Akdemir, Kiymet, et al.
Pubblicazione: (2024)
Diverse Video Generation with Determinantal Point Process-Guided Policy Optimization
di: Kazimi, Tahira, et al.
Pubblicazione: (2025)
di: Kazimi, Tahira, et al.
Pubblicazione: (2025)
Canvas-to-Image: Compositional Image Generation with Multimodal Controls
di: Dalva, Yusuf, et al.
Pubblicazione: (2025)
di: Dalva, Yusuf, et al.
Pubblicazione: (2025)
Fine-Grained Preference Optimization Improves Spatial Reasoning in VLMs
di: Shen, Yifan, et al.
Pubblicazione: (2025)
di: Shen, Yifan, et al.
Pubblicazione: (2025)
Rare-to-Frequent: Unlocking Compositional Generation Power of Diffusion Models on Rare Concepts with LLM Guidance
di: Park, Dongmin, et al.
Pubblicazione: (2024)
di: Park, Dongmin, et al.
Pubblicazione: (2024)
Plot'n Polish: Zero-shot Story Visualization and Disentangled Editing with Text-to-Image Diffusion Models
di: Akdemir, Kiymet, et al.
Pubblicazione: (2025)
di: Akdemir, Kiymet, et al.
Pubblicazione: (2025)
Dynamic View Synthesis as an Inverse Problem
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2025)
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2025)
Explaining in Diffusion: Explaining a Classifier Through Hierarchical Semantics with Text-to-Image Diffusion Models
di: Kazimi, Tahira, et al.
Pubblicazione: (2024)
di: Kazimi, Tahira, et al.
Pubblicazione: (2024)
Audit & Repair: An Agentic Framework for Consistent Story Visualization in Text-to-Image Diffusion Models
di: Akdemir, Kiymet, et al.
Pubblicazione: (2025)
di: Akdemir, Kiymet, et al.
Pubblicazione: (2025)
LoRAverse: A Submodular Framework to Retrieve Diverse Adapters for Diffusion Models
di: Sonmezer, Mert, et al.
Pubblicazione: (2025)
di: Sonmezer, Mert, et al.
Pubblicazione: (2025)
PRIMA: Multi-Image Vision-Language Models for Reasoning Segmentation
di: Wahed, Muntasir, et al.
Pubblicazione: (2024)
di: Wahed, Muntasir, et al.
Pubblicazione: (2024)
3D-VCD: Hallucination Mitigation in 3D-LLM Embodied Agents through Visual Contrastive Decoding
di: Ogunleye, Makanjuola, et al.
Pubblicazione: (2026)
di: Ogunleye, Makanjuola, et al.
Pubblicazione: (2026)
MotionShop: Zero-Shot Motion Transfer in Video Diffusion Models with Mixture of Score Guidance
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2024)
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2024)
VEGGIE: Instructional Editing and Reasoning Video Concepts with Grounded Generation
di: Yu, Shoubin, et al.
Pubblicazione: (2025)
di: Yu, Shoubin, et al.
Pubblicazione: (2025)
Image-to-Image Translation with Disentangled Latent Vectors for Face Editing
di: Dalva, Yusuf, et al.
Pubblicazione: (2023)
di: Dalva, Yusuf, et al.
Pubblicazione: (2023)
LoRACLR: Contrastive Adaptation for Customization of Diffusion Models
di: Simsar, Enis, et al.
Pubblicazione: (2024)
di: Simsar, Enis, et al.
Pubblicazione: (2024)
Counterfactual Segmentation Reasoning: Diagnosing and Mitigating Pixel-Grounding Hallucination
di: Li, Xinzhuo, et al.
Pubblicazione: (2025)
di: Li, Xinzhuo, et al.
Pubblicazione: (2025)
ConceptAttention: Diffusion Transformers Learn Highly Interpretable Features
di: Helbling, Alec, et al.
Pubblicazione: (2025)
di: Helbling, Alec, et al.
Pubblicazione: (2025)
BACON: Improving Clarity of Image Captions via Bag-of-Concept Graphs
di: Yang, Zhantao, et al.
Pubblicazione: (2024)
di: Yang, Zhantao, et al.
Pubblicazione: (2024)
Concept Lancet: Image Editing with Compositional Representation Transplant
di: Luo, Jinqi, et al.
Pubblicazione: (2025)
di: Luo, Jinqi, et al.
Pubblicazione: (2025)
Probabilistic Concept Graph Reasoning for Multimodal Misinformation Detection
di: Yang, Ruichao, et al.
Pubblicazione: (2026)
di: Yang, Ruichao, et al.
Pubblicazione: (2026)
Group Relative Attention Guidance for Image Editing
di: Zhang, Xuanpu, et al.
Pubblicazione: (2025)
di: Zhang, Xuanpu, et al.
Pubblicazione: (2025)
Aligning Latent Geometry for Spherical Flow Matching in Image Generation
di: Meral, Tuna Han Salih, et al.
Pubblicazione: (2026)
di: Meral, Tuna Han Salih, et al.
Pubblicazione: (2026)
Infinity-RoPE: Action-Controllable Infinite Video Generation Emerges From Autoregressive Self-Rollout
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2025)
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2025)
Contrastive Test-Time Composition of Multiple LoRA Models for Image Generation
di: Meral, Tuna Han Salih, et al.
Pubblicazione: (2024)
di: Meral, Tuna Han Salih, et al.
Pubblicazione: (2024)
Best of Both Worlds: Multimodal Reasoning and Generation via Unified Discrete Flow Matching
di: Susladkar, Onkar, et al.
Pubblicazione: (2026)
di: Susladkar, Onkar, et al.
Pubblicazione: (2026)
Documenti analoghi
-
FluxSpace: Disentangled Semantic Editing in Rectified Flow Transformers
di: Dalva, Yusuf, et al.
Pubblicazione: (2024) -
CREA: A Collaborative Multi-Agent Framework for Creative Image Editing and Generation
di: Venkatesh, Kavana, et al.
Pubblicazione: (2025) -
LoRAShop: Training-Free Multi-Concept Image Generation and Editing with Rectified Flow Transformers
di: Dalva, Yusuf, et al.
Pubblicazione: (2025) -
AdaState: Self-Evolving Anchors for Streaming Video Generation
di: Dalva, Yusuf, et al.
Pubblicazione: (2026) -
The Curious Case of End Token: A Zero-Shot Disentangled Image Editing using CLIP
di: Yesiltepe, Hidir, et al.
Pubblicazione: (2024)