LIME: Localized Image Editing via Attention Regularization in Diffusion Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Simsar, Enis, Tonioni, Alessio, Xian, Yongqin, Hofmann, Thomas, Tombari, Federico |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
UIP2P: Unsupervised Instruction-based Image Editing via Edit Reversibility Constraint
por: Simsar, Enis, et al.
Publicado: (2024)
por: Simsar, Enis, et al.
Publicado: (2024)
LoRACLR: Contrastive Adaptation for Customization of Diffusion Models
por: Simsar, Enis, et al.
Publicado: (2024)
por: Simsar, Enis, et al.
Publicado: (2024)
FullFlow: Upgrading Text-to-Image Flow Matching Models for Bidirectional Vision--Language Generation
por: Bill, Eric Tillmann, et al.
Publicado: (2026)
por: Bill, Eric Tillmann, et al.
Publicado: (2026)
RefAM: Attention Magnets for Zero-Shot Referral Segmentation
por: Kukleva, Anna, et al.
Publicado: (2025)
por: Kukleva, Anna, et al.
Publicado: (2025)
Text-Conditioned Resampler For Long Form Video Understanding
por: Korbar, Bruno, et al.
Publicado: (2023)
por: Korbar, Bruno, et al.
Publicado: (2023)
Omnia de EgoTempo: Benchmarking Temporal Understanding of Multi-Modal LLMs in Egocentric Videos
por: Plizzari, Chiara, et al.
Publicado: (2025)
por: Plizzari, Chiara, et al.
Publicado: (2025)
Shifting the Breaking Point of Flow Matching for Multi-Instance Editing
por: Zaccagnino, Carmine, et al.
Publicado: (2026)
por: Zaccagnino, Carmine, et al.
Publicado: (2026)
Contrastive Test-Time Composition of Multiple LoRA Models for Image Generation
por: Meral, Tuna Han Salih, et al.
Publicado: (2024)
por: Meral, Tuna Han Salih, et al.
Publicado: (2024)
Stylebreeder: Exploring and Democratizing Artistic Styles through Text-to-Image Models
por: Zheng, Matthew, et al.
Publicado: (2024)
por: Zheng, Matthew, et al.
Publicado: (2024)
FOCUS: Optimal Control for Multi-Entity World Modeling in Text-to-Image Generation
por: Bill, Eric Tillmann, et al.
Publicado: (2025)
por: Bill, Eric Tillmann, et al.
Publicado: (2025)
JEDI: The Force of Jensen-Shannon Divergence in Disentangling Diffusion Models
por: Bill, Eric Tillmann, et al.
Publicado: (2025)
por: Bill, Eric Tillmann, et al.
Publicado: (2025)
MegaPortrait: Revisiting Diffusion Control for High-fidelity Portrait Generation
por: Yang, Han, et al.
Publicado: (2024)
por: Yang, Han, et al.
Publicado: (2024)
SSL-R1: Self-Supervised Visual Reinforcement Post-Training for Multimodal Large Language Models
por: Xie, Jiahao, et al.
Publicado: (2026)
por: Xie, Jiahao, et al.
Publicado: (2026)
R-CoV: Region-Aware Chain-of-Verification for Alleviating Object Hallucinations in LVLMs
por: Xie, Jiahao, et al.
Publicado: (2026)
por: Xie, Jiahao, et al.
Publicado: (2026)
PixLens: A Novel Framework for Disentangled Evaluation in Diffusion-Based Image Editing with Object Detection + SAM
por: Stefanache, Stefan, et al.
Publicado: (2024)
por: Stefanache, Stefan, et al.
Publicado: (2024)
Active Data Curation Effectively Distills Large-Scale Multimodal Models
por: Udandarao, Vishaal, et al.
Publicado: (2024)
por: Udandarao, Vishaal, et al.
Publicado: (2024)
Test-Time Visual In-Context Tuning
por: Xie, Jiahao, et al.
Publicado: (2025)
por: Xie, Jiahao, et al.
Publicado: (2025)
SHYI: Action Support for Contrastive Learning in High-Fidelity Text-to-Image Generation
por: Xia, Tianxiang, et al.
Publicado: (2025)
por: Xia, Tianxiang, et al.
Publicado: (2025)
MOBIUS: Big-to-Mobile Universal Instance Segmentation via Multi-modal Bottleneck Fusion and Calibrated Decoder Pruning
por: Segu, Mattia, et al.
Publicado: (2025)
por: Segu, Mattia, et al.
Publicado: (2025)
Toward a Diffusion-Based Generalist for Dense Vision Tasks
por: Fan, Yue, et al.
Publicado: (2024)
por: Fan, Yue, et al.
Publicado: (2024)
IC-Portrait: In-Context Matching for View-Consistent Personalized Portrait
por: Yang, Han, et al.
Publicado: (2025)
por: Yang, Han, et al.
Publicado: (2025)
BRAVE: Broadening the visual encoding of vision-language models
por: Kar, Oğuzhan Fatih, et al.
Publicado: (2024)
por: Kar, Oğuzhan Fatih, et al.
Publicado: (2024)
PARCEL: Pool-Anchored Resampling with Conditioned Elastic Queries for Efficient Vision-Language Understanding
por: Kuzucu, Selim, et al.
Publicado: (2026)
por: Kuzucu, Selim, et al.
Publicado: (2026)
Denoising Diffusion via Image-Based Rendering
por: Anciukevičius, Titas, et al.
Publicado: (2024)
por: Anciukevičius, Titas, et al.
Publicado: (2024)
Immunizing Images from Text to Image Editing via Adversarial Cross-Attention
por: Trippodo, Matteo, et al.
Publicado: (2025)
por: Trippodo, Matteo, et al.
Publicado: (2025)
InseRF: Text-Driven Generative Object Insertion in Neural 3D Scenes
por: Shahbazi, Mohamad, et al.
Publicado: (2024)
por: Shahbazi, Mohamad, et al.
Publicado: (2024)
Zero-Shot Styled Text Image Generation, but Make It Autoregressive
por: Pippi, Vittorio, et al.
Publicado: (2025)
por: Pippi, Vittorio, et al.
Publicado: (2025)
Autoregressive Styled Text Image Generation, but Make it Reliable
por: Zaccagnino, Carmine, et al.
Publicado: (2025)
por: Zaccagnino, Carmine, et al.
Publicado: (2025)
CubeDiff: Repurposing Diffusion-Based Image Models for Panorama Generation
por: Kalischek, Nikolai, et al.
Publicado: (2025)
por: Kalischek, Nikolai, et al.
Publicado: (2025)
Guided Image Synthesis via Initial Image Editing in Diffusion Model
por: Mao, Jiafeng, et al.
Publicado: (2023)
por: Mao, Jiafeng, et al.
Publicado: (2023)
3D-LATTE: Latent Space 3D Editing from Textual Instructions
por: Parelli, Maria, et al.
Publicado: (2025)
por: Parelli, Maria, et al.
Publicado: (2025)
LIME-Eval: Rethinking Low-light Image Enhancement Evaluation via Object Detection
por: Li, Mingjia, et al.
Publicado: (2024)
por: Li, Mingjia, et al.
Publicado: (2024)
Image Editing As Programs with Diffusion Models
por: Hu, Yujia, et al.
Publicado: (2025)
por: Hu, Yujia, et al.
Publicado: (2025)
MIST: Mitigating Intersectional Bias with Disentangled Cross-Attention Editing in Text-to-Image Diffusion Models
por: Yesiltepe, Hidir, et al.
Publicado: (2024)
por: Yesiltepe, Hidir, et al.
Publicado: (2024)
AttentionDrag: Exploiting Latent Correlation Knowledge in Pre-trained Diffusion Models for Image Editing
por: Yang, Biao, et al.
Publicado: (2025)
por: Yang, Biao, et al.
Publicado: (2025)
MDE-Edit: Masked Dual-Editing for Multi-Object Image Editing via Diffusion Models
por: Zhu, Hongyang, et al.
Publicado: (2025)
por: Zhu, Hongyang, et al.
Publicado: (2025)
Training-free Online Video Step Grounding
por: Zanella, Luca, et al.
Publicado: (2025)
por: Zanella, Luca, et al.
Publicado: (2025)
SmileSplat: Generalizable Gaussian Splats for Unconstrained Sparse Images
por: Li, Yanyan, et al.
Publicado: (2024)
por: Li, Yanyan, et al.
Publicado: (2024)
ESCAPE: Equivariant Shape Completion via Anchor Point Encoding
por: Bekci, Burak, et al.
Publicado: (2024)
por: Bekci, Burak, et al.
Publicado: (2024)
MOSAIC-GS: Monocular Scene Reconstruction via Advanced Initialization for Complex Dynamic Environments
por: Morkva, Svitlana, et al.
Publicado: (2026)
por: Morkva, Svitlana, et al.
Publicado: (2026)
Ejemplares similares
-
UIP2P: Unsupervised Instruction-based Image Editing via Edit Reversibility Constraint
por: Simsar, Enis, et al.
Publicado: (2024) -
LoRACLR: Contrastive Adaptation for Customization of Diffusion Models
por: Simsar, Enis, et al.
Publicado: (2024) -
FullFlow: Upgrading Text-to-Image Flow Matching Models for Bidirectional Vision--Language Generation
por: Bill, Eric Tillmann, et al.
Publicado: (2026) -
RefAM: Attention Magnets for Zero-Shot Referral Segmentation
por: Kukleva, Anna, et al.
Publicado: (2025) -
Text-Conditioned Resampler For Long Form Video Understanding
por: Korbar, Bruno, et al.
Publicado: (2023)