Towards Efficient Exemplar Based Image Editing with Multimodal VLMs
Fuente:
arXiv
Saved in:
| Main Authors: | Jadhav, Avadhoot, Srivastava, Ashutosh, Java, Abhinav, Singh, Silky, Menta, Tarun Ram, Jandial, Surgan, Krishnamurthy, Balaji |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
ReEdit: Multimodal Exemplar-Based Image Editing with Diffusion Models
by: Srivastava, Ashutosh, et al.
Published: (2024)
by: Srivastava, Ashutosh, et al.
Published: (2024)
LEAST: "Local" text-conditioned image style transfer
by: Singh, Silky, et al.
Published: (2024)
by: Singh, Silky, et al.
Published: (2024)
S2H-DPO: Hardness-Aware Preference Optimization for Vision-Language Models
by: Shukla, Nitish, et al.
Published: (2026)
by: Shukla, Nitish, et al.
Published: (2026)
HIRE: Lightweight High-Resolution Image Feature Enrichment for Multimodal LLMs
by: SR, Nikitha, et al.
Published: (2025)
by: SR, Nikitha, et al.
Published: (2025)
DoPTA: Improving Document Layout Analysis using Patch-Text Alignment
by: SR, Nikitha, et al.
Published: (2024)
by: SR, Nikitha, et al.
Published: (2024)
EOPose : Exemplar-based object reposing using Generalized Pose Correspondences
by: Mehrotra, Sarthak, et al.
Published: (2025)
by: Mehrotra, Sarthak, et al.
Published: (2025)
Thinking Fair and Slow: On the Efficacy of Structured Prompts for Debiasing Language Models
by: Furniturewala, Shaz, et al.
Published: (2024)
by: Furniturewala, Shaz, et al.
Published: (2024)
Delta-Adapter: Scalable Exemplar-Based Image Editing with Single-Pair Supervision
by: Chen, Jiacheng, et al.
Published: (2026)
by: Chen, Jiacheng, et al.
Published: (2026)
Reversible Inversion for Training-Free Exemplar-guided Image Editing
by: Li, Yuke, et al.
Published: (2025)
by: Li, Yuke, et al.
Published: (2025)
PairEdit: Learning Semantic Variations for Exemplar-based Image Editing
by: Lu, Haoguang, et al.
Published: (2025)
by: Lu, Haoguang, et al.
Published: (2025)
TechING: Towards Real World Technical Image Understanding via VLMs
by: Nadeem, Tafazzul, et al.
Published: (2026)
by: Nadeem, Tafazzul, et al.
Published: (2026)
Understanding Task Transfer in Vision-Language Models
by: Sachdeva, Bhuvan, et al.
Published: (2025)
by: Sachdeva, Bhuvan, et al.
Published: (2025)
Exemplar Masking for Multimodal Incremental Learning
by: Lee, Yi-Lun, et al.
Published: (2024)
by: Lee, Yi-Lun, et al.
Published: (2024)
MMTok: Multimodal Coverage Maximization for Efficient Inference of VLMs
by: Dong, Sixun, et al.
Published: (2025)
by: Dong, Sixun, et al.
Published: (2025)
Towards Generalized Multi-Image Editing for Unified Multimodal Models
by: Xu, Pengcheng, et al.
Published: (2026)
by: Xu, Pengcheng, et al.
Published: (2026)
Multimodal Event Detection: Current Approaches and Defining the New Playground through LLMs and VLMs
by: Dey, Abhishek, et al.
Published: (2025)
by: Dey, Abhishek, et al.
Published: (2025)
Towards Efficient Diffusion-Based Image Editing with Instant Attention Masks
by: Zou, Siyu, et al.
Published: (2024)
by: Zou, Siyu, et al.
Published: (2024)
Measuring and Improving Persuasiveness of Large Language Models
by: Singh, Somesh, et al.
Published: (2024)
by: Singh, Somesh, et al.
Published: (2024)
Exemplar Med-DETR: Toward Generalized and Robust Lesion Detection in Mammogram Images and beyond
by: Bhat, Sheethal, et al.
Published: (2025)
by: Bhat, Sheethal, et al.
Published: (2025)
DiffSign: AI-Assisted Generation of Customizable Sign Language Videos With Enhanced Realism
by: Krishnamurthy, Sudha, et al.
Published: (2024)
by: Krishnamurthy, Sudha, et al.
Published: (2024)
AFRAgent : An Adaptive Feature Renormalization Based High Resolution Aware GUI agent
by: Anand, Neeraj, et al.
Published: (2025)
by: Anand, Neeraj, et al.
Published: (2025)
Learning from Exemplars for Interactive Image Segmentation
by: Li, Kun, et al.
Published: (2024)
by: Li, Kun, et al.
Published: (2024)
Can VLMs Detect and Localize Fine-Grained AI-Edited Images?
by: Sun, Zhen, et al.
Published: (2025)
by: Sun, Zhen, et al.
Published: (2025)
AesthetiQ: Enhancing Graphic Layout Design via Aesthetic-Aware Preference Alignment of Multi-modal Large Language Models
by: Patnaik, Sohan, et al.
Published: (2025)
by: Patnaik, Sohan, et al.
Published: (2025)
MIGE: Mutually Enhanced Multimodal Instruction-Based Image Generation and Editing
by: Tian, Xueyun, et al.
Published: (2025)
by: Tian, Xueyun, et al.
Published: (2025)
Towards Non-Exemplar Semi-Supervised Class-Incremental Learning
by: Liu, Wenzhuo, et al.
Published: (2024)
by: Liu, Wenzhuo, et al.
Published: (2024)
Exposing Hallucinations To Suppress Them: VLMs Representation Editing With Generative Anchors
by: Shi, Youxu, et al.
Published: (2025)
by: Shi, Youxu, et al.
Published: (2025)
EditTransfer++: Toward Faithful and Efficient Visual-Prompt-Guided Image Editing
by: Chen, Lan, et al.
Published: (2026)
by: Chen, Lan, et al.
Published: (2026)
Towards Design Compositing
by: Mahajan, Abhinav, et al.
Published: (2026)
by: Mahajan, Abhinav, et al.
Published: (2026)
Efficient High-Resolution Image Editing with Hallucination-Aware Loss and Adaptive Tiling
by: Kwon, Young D., et al.
Published: (2025)
by: Kwon, Young D., et al.
Published: (2025)
Towards Unified Multimodal Editing with Enhanced Knowledge Collaboration
by: Pan, Kaihang, et al.
Published: (2024)
by: Pan, Kaihang, et al.
Published: (2024)
Few Exemplar-Based General Medical Image Segmentation via Domain-Aware Selective Adaptation
by: Xu, Chen, et al.
Published: (2024)
by: Xu, Chen, et al.
Published: (2024)
DiffVax: Optimization-Free Image Immunization Against Diffusion-Based Editing
by: Ozden, Tarik Can, et al.
Published: (2024)
by: Ozden, Tarik Can, et al.
Published: (2024)
Guidance Free Image Editing via Explicit Conditioning
by: Noroozi, Mehdi, et al.
Published: (2025)
by: Noroozi, Mehdi, et al.
Published: (2025)
Are VLMs Really Blind
by: Singh, Ayush, et al.
Published: (2024)
by: Singh, Ayush, et al.
Published: (2024)
Efficient Non-Exemplar Class-Incremental Learning with Retrospective Feature Synthesis
by: Bai, Liang, et al.
Published: (2024)
by: Bai, Liang, et al.
Published: (2024)
MIRA: Multimodal Iterative Reasoning Agent for Image Editing
by: Zeng, Ziyun, et al.
Published: (2025)
by: Zeng, Ziyun, et al.
Published: (2025)
StyleBooth: Image Style Editing with Multimodal Instruction
by: Han, Zhen, et al.
Published: (2024)
by: Han, Zhen, et al.
Published: (2024)
Moonshot: Towards Controllable Video Generation and Editing with Multimodal Conditions
by: Zhang, David Junhao, et al.
Published: (2024)
by: Zhang, David Junhao, et al.
Published: (2024)
Appearance Matching Adapter for Exemplar-based Semantic Image Synthesis in-the-Wild
by: Jin, Siyoon, et al.
Published: (2024)
by: Jin, Siyoon, et al.
Published: (2024)
Similar Items
-
ReEdit: Multimodal Exemplar-Based Image Editing with Diffusion Models
by: Srivastava, Ashutosh, et al.
Published: (2024) -
LEAST: "Local" text-conditioned image style transfer
by: Singh, Silky, et al.
Published: (2024) -
S2H-DPO: Hardness-Aware Preference Optimization for Vision-Language Models
by: Shukla, Nitish, et al.
Published: (2026) -
HIRE: Lightweight High-Resolution Image Feature Enrichment for Multimodal LLMs
by: SR, Nikitha, et al.
Published: (2025) -
DoPTA: Improving Document Layout Analysis using Patch-Text Alignment
by: SR, Nikitha, et al.
Published: (2024)