Kontinuous Kontext: Continuous Strength Control for Instruction-based Image Editing
Fuente:
arXiv
Salvato in:
| Autori principali: | Parihar, Rishubh, Patashnik, Or, Ostashev, Daniil, Babu, R. Venkatesh, Cohen-Or, Daniel, Wang, Kuan-Chieh |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Compass Control: Multi Object Orientation Control for Text-to-Image Generation
di: Parihar, Rishubh, et al.
Pubblicazione: (2025)
di: Parihar, Rishubh, et al.
Pubblicazione: (2025)
Object-level Visual Prompts for Compositional Image Generation
di: Parmar, Gaurav, et al.
Pubblicazione: (2025)
di: Parmar, Gaurav, et al.
Pubblicazione: (2025)
SeeThrough3D: Occlusion Aware 3D Control in Text-to-Image Generation
di: Agrawal, Vaibhav, et al.
Pubblicazione: (2026)
di: Agrawal, Vaibhav, et al.
Pubblicazione: (2026)
PreciseControl: Enhancing Text-To-Image Diffusion Models with Fine-Grained Attribute Control
di: Parihar, Rishubh, et al.
Pubblicazione: (2024)
di: Parihar, Rishubh, et al.
Pubblicazione: (2024)
Text2Place: Affordance-aware Text Guided Human Placement
di: Parihar, Rishubh, et al.
Pubblicazione: (2024)
di: Parihar, Rishubh, et al.
Pubblicazione: (2024)
Omni-ID: Holistic Identity Representation Designed for Generative Tasks
di: Qian, Guocheng, et al.
Pubblicazione: (2024)
di: Qian, Guocheng, et al.
Pubblicazione: (2024)
MoA: Mixture-of-Attention for Subject-Context Disentanglement in Personalized Image Generation
di: Wang, Kuan-Chieh, et al.
Pubblicazione: (2024)
di: Wang, Kuan-Chieh, et al.
Pubblicazione: (2024)
MonoPlace3D: Learning 3D-Aware Object Placement for 3D Monocular Detection
di: Parihar, Rishubh, et al.
Pubblicazione: (2025)
di: Parihar, Rishubh, et al.
Pubblicazione: (2025)
Nested Attention: Semantic-aware Attention Values for Concept Personalization
di: Patashnik, Or, et al.
Pubblicazione: (2025)
di: Patashnik, Or, et al.
Pubblicazione: (2025)
Scaling Group Inference for Diverse and High-Quality Generation
di: Parmar, Gaurav, et al.
Pubblicazione: (2025)
di: Parmar, Gaurav, et al.
Pubblicazione: (2025)
Reflecting Reality: Enabling Diffusion Models to Produce Faithful Mirror Reflections
di: Dhiman, Ankit, et al.
Pubblicazione: (2024)
di: Dhiman, Ankit, et al.
Pubblicazione: (2024)
Balancing Act: Distribution-Guided Debiasing in Diffusion Models
di: Parihar, Rishubh, et al.
Pubblicazione: (2024)
di: Parihar, Rishubh, et al.
Pubblicazione: (2024)
In-Context Sync-LoRA for Portrait Video Editing
di: Polaczek, Sagi, et al.
Pubblicazione: (2025)
di: Polaczek, Sagi, et al.
Pubblicazione: (2025)
ComposeMe: Attribute-Specific Image Prompts for Controllable Human Image Generation
di: Qian, Guocheng Gordon, et al.
Pubblicazione: (2025)
di: Qian, Guocheng Gordon, et al.
Pubblicazione: (2025)
Tight Inversion: Image-Conditioned Inversion for Real Image Editing
di: Kadosh, Edo, et al.
Pubblicazione: (2025)
di: Kadosh, Edo, et al.
Pubblicazione: (2025)
TurboEdit: Text-Based Image Editing Using Few-Step Diffusion Models
di: Deutch, Gilad, et al.
Pubblicazione: (2024)
di: Deutch, Gilad, et al.
Pubblicazione: (2024)
Be Yourself: Bounded Attention for Multi-Subject Text-to-Image Generation
di: Dahary, Omer, et al.
Pubblicazione: (2024)
di: Dahary, Omer, et al.
Pubblicazione: (2024)
Continuous Control of Editing Models via Adaptive-Origin Guidance
di: Wolf, Alon, et al.
Pubblicazione: (2026)
di: Wolf, Alon, et al.
Pubblicazione: (2026)
Image Generation from Contextually-Contradictory Prompts
di: Huberman, Saar, et al.
Pubblicazione: (2025)
di: Huberman, Saar, et al.
Pubblicazione: (2025)
Preventing Shortcuts in Adapter Training via Providing the Shortcuts
di: Goyal, Anujraaj Argo, et al.
Pubblicazione: (2025)
di: Goyal, Anujraaj Argo, et al.
Pubblicazione: (2025)
Be Decisive: Noise-Induced Layouts for Multi-Subject Generation
di: Dahary, Omer, et al.
Pubblicazione: (2025)
di: Dahary, Omer, et al.
Pubblicazione: (2025)
Consolidating Attention Features for Multi-view Image Editing
di: Patashnik, Or, et al.
Pubblicazione: (2024)
di: Patashnik, Or, et al.
Pubblicazione: (2024)
CLIPDrag: Combining Text-based and Drag-based Instructions for Image Editing
di: Jiang, Ziqi, et al.
Pubblicazione: (2024)
di: Jiang, Ziqi, et al.
Pubblicazione: (2024)
DLEBench: Evaluating Small-scale Object Editing Ability for Instruction-based Image Editing Model
di: Hong, Shibo, et al.
Pubblicazione: (2026)
di: Hong, Shibo, et al.
Pubblicazione: (2026)
SAEdit: Token-level control for continuous image editing via Sparse AutoEncoder
di: Kamenetsky, Ronen, et al.
Pubblicazione: (2025)
di: Kamenetsky, Ronen, et al.
Pubblicazione: (2025)
Stable Flow: Vital Layers for Training-Free Image Editing
di: Avrahami, Omri, et al.
Pubblicazione: (2024)
di: Avrahami, Omri, et al.
Pubblicazione: (2024)
Personalized Image Editing in Text-to-Image Diffusion Models via Collaborative Direct Preference Optimization
di: Dunlop, Connor, et al.
Pubblicazione: (2025)
di: Dunlop, Connor, et al.
Pubblicazione: (2025)
HQ-Edit: A High-Quality Dataset for Instruction-based Image Editing
di: Hui, Mude, et al.
Pubblicazione: (2024)
di: Hui, Mude, et al.
Pubblicazione: (2024)
I2EBench: A Comprehensive Benchmark for Instruction-based Image Editing
di: Ma, Yiwei, et al.
Pubblicazione: (2024)
di: Ma, Yiwei, et al.
Pubblicazione: (2024)
Query-Kontext: An Unified Multimodal Model for Image Generation and Editing
di: Song, Yuxin, et al.
Pubblicazione: (2025)
di: Song, Yuxin, et al.
Pubblicazione: (2025)
FreeEdit: Mask-free Reference-based Image Editing with Multi-modal Instruction
di: He, Runze, et al.
Pubblicazione: (2024)
di: He, Runze, et al.
Pubblicazione: (2024)
$\texttt{Complex-Edit}$: CoT-Like Instruction Generation for Complexity-Controllable Image Editing Benchmark
di: Yang, Siwei, et al.
Pubblicazione: (2025)
di: Yang, Siwei, et al.
Pubblicazione: (2025)
SliderEdit: Continuous Image Editing with Fine-Grained Instruction Control
di: Zarei, Arman, et al.
Pubblicazione: (2025)
di: Zarei, Arman, et al.
Pubblicazione: (2025)
Instruction-based Image Editing with Planning, Reasoning, and Generation
di: Ji, Liya, et al.
Pubblicazione: (2026)
di: Ji, Liya, et al.
Pubblicazione: (2026)
LCM-Lookahead for Encoder-based Text-to-Image Personalization
di: Gal, Rinon, et al.
Pubblicazione: (2024)
di: Gal, Rinon, et al.
Pubblicazione: (2024)
Lazy Diffusion Transformer for Interactive Image Editing
di: Nitzan, Yotam, et al.
Pubblicazione: (2024)
di: Nitzan, Yotam, et al.
Pubblicazione: (2024)
Mapping the Mind of an Instruction-based Image Editing using SMILE
di: Dehghani, Zeinab, et al.
Pubblicazione: (2024)
di: Dehghani, Zeinab, et al.
Pubblicazione: (2024)
In-Context Learning with Unpaired Clips for Instruction-based Video Editing
di: Liao, Xinyao, et al.
Pubblicazione: (2025)
di: Liao, Xinyao, et al.
Pubblicazione: (2025)
Untwisting RoPE: Frequency Control for Shared Attention in DiTs
di: Mikaeili, Aryan, et al.
Pubblicazione: (2026)
di: Mikaeili, Aryan, et al.
Pubblicazione: (2026)
MCIE: Multimodal LLM-Driven Complex Instruction Image Editing with Spatial Guidance
di: Bai, Xuehai, et al.
Pubblicazione: (2026)
di: Bai, Xuehai, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Compass Control: Multi Object Orientation Control for Text-to-Image Generation
di: Parihar, Rishubh, et al.
Pubblicazione: (2025) -
Object-level Visual Prompts for Compositional Image Generation
di: Parmar, Gaurav, et al.
Pubblicazione: (2025) -
SeeThrough3D: Occlusion Aware 3D Control in Text-to-Image Generation
di: Agrawal, Vaibhav, et al.
Pubblicazione: (2026) -
PreciseControl: Enhancing Text-To-Image Diffusion Models with Fine-Grained Attribute Control
di: Parihar, Rishubh, et al.
Pubblicazione: (2024) -
Text2Place: Affordance-aware Text Guided Human Placement
di: Parihar, Rishubh, et al.
Pubblicazione: (2024)