Training-Free Image Editing with Visual Context Integration and Concept Alignment
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Song, Rui, Wang, Guo-Hua, Chen, Qing-Guo, Luo, Weihua, Xu, Tongda, Liu, Zhening, Wang, Yan, Lin, Zehong, Zhang, Jun |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MEGA: Memory-Efficient 4D Gaussian Splatting for Dynamic Scenes
par: Zhang, Xinjie, et autres
Publié: (2024)
par: Zhang, Xinjie, et autres
Publié: (2024)
Feed-Forward 3D Gaussian Splatting Compression with Long-Context Modeling
par: Liu, Zhening, et autres
Publié: (2025)
par: Liu, Zhening, et autres
Publié: (2025)
Training-Free Text-Guided Image Editing with Visual Autoregressive Model
par: Wang, Yufei, et autres
Publié: (2025)
par: Wang, Yufei, et autres
Publié: (2025)
Bidirectional Stereo Image Compression with Cross-Dimensional Entropy Model
par: Liu, Zhening, et autres
Publié: (2024)
par: Liu, Zhening, et autres
Publié: (2024)
Training-Free Multi-Concept Image Editing
par: Foteinopoulou, Niki, et autres
Publié: (2026)
par: Foteinopoulou, Niki, et autres
Publié: (2026)
TeEFusion: Blending Text Embeddings to Distill Classifier-Free Guidance
par: Fu, Minghao, et autres
Publié: (2025)
par: Fu, Minghao, et autres
Publié: (2025)
CAMSIC: Content-aware Masked Image Modeling Transformer for Stereo Image Compression
par: Zhang, Xinjie, et autres
Publié: (2024)
par: Zhang, Xinjie, et autres
Publié: (2024)
EVA-Gaussian: 3D Gaussian-based Real-time Human Novel View Synthesis under Diverse Multi-view Camera Settings
par: Hu, Yingdong, et autres
Publié: (2024)
par: Hu, Yingdong, et autres
Publié: (2024)
Dynamics-Aware Gaussian Splatting Streaming Towards Fast On-the-Fly 4D Reconstruction
par: Liu, Zhening, et autres
Publié: (2024)
par: Liu, Zhening, et autres
Publié: (2024)
Real-Time Human Frontal View Synthesis from a Single Image
par: Lin, Fangyu, et autres
Publié: (2026)
par: Lin, Fangyu, et autres
Publié: (2026)
CHATS: Combining Human-Aligned Optimization and Test-Time Sampling for Text-to-Image Generation
par: Fu, Minghao, et autres
Publié: (2025)
par: Fu, Minghao, et autres
Publié: (2025)
RemedyGS: Defend 3D Gaussian Splatting against Computation Cost Attacks
par: Li, Yanping, et autres
Publié: (2025)
par: Li, Yanping, et autres
Publié: (2025)
Evaluating Image Caption via Cycle-consistent Text-to-Image Generation
par: Cui, Tianyu, et autres
Publié: (2025)
par: Cui, Tianyu, et autres
Publié: (2025)
Noise Dimension of GAN: An Image Compression Perspective
par: Zhu, Ziran, et autres
Publié: (2024)
par: Zhu, Ziran, et autres
Publié: (2024)
Mon3tr: Monocular 3D Telepresence with Pre-built Gaussian Avatars as Amortization
par: Lin, Fangyu, et autres
Publié: (2026)
par: Lin, Fangyu, et autres
Publié: (2026)
Optimizing Input of Denoising Score Matching is Biased Towards Higher Score Norm
par: Xu, Tongda
Publié: (2025)
par: Xu, Tongda
Publié: (2025)
Training-Free Vector Quantization via Gaussian VAEs
par: Xu, Tongda, et autres
Publié: (2025)
par: Xu, Tongda, et autres
Publié: (2025)
RAWIC: Bit-Depth Adaptive Lossless Raw Image Compression
par: Zheng, Chunhang, et autres
Publié: (2026)
par: Zheng, Chunhang, et autres
Publié: (2026)
GaussianImage++: Boosted Image Representation and Compression with 2D Gaussian Splatting
par: Li, Tiantian, et autres
Publié: (2025)
par: Li, Tiantian, et autres
Publié: (2025)
Fast Training-free Perceptual Image Compression
par: Zhu, Ziran, et autres
Publié: (2025)
par: Zhu, Ziran, et autres
Publié: (2025)
Diffusion-SDPO: Safeguarded Direct Preference Optimization for Diffusion Models
par: Fu, Minghao, et autres
Publié: (2025)
par: Fu, Minghao, et autres
Publié: (2025)
LoRAShop: Training-Free Multi-Concept Image Generation and Editing with Rectified Flow Transformers
par: Dalva, Yusuf, et autres
Publié: (2025)
par: Dalva, Yusuf, et autres
Publié: (2025)
VoxHammer: Training-Free Precise and Coherent 3D Editing in Native 3D Space
par: Li, Lin, et autres
Publié: (2025)
par: Li, Lin, et autres
Publié: (2025)
GaussianImage: 1000 FPS Image Representation and Compression by 2D Gaussian Splatting
par: Zhang, Xinjie, et autres
Publié: (2024)
par: Zhang, Xinjie, et autres
Publié: (2024)
Re-Align: Structured Reasoning-guided Alignment for In-Context Image Generation and Editing
par: He, Runze, et autres
Publié: (2026)
par: He, Runze, et autres
Publié: (2026)
SenseFlow: Scaling Distribution Matching for Flow-based Text-to-Image Distillation
par: Ge, Xingtong, et autres
Publié: (2025)
par: Ge, Xingtong, et autres
Publié: (2025)
V-Shuffle: Zero-Shot Style Transfer via Value Shuffle
par: Tang, Haojun, et autres
Publié: (2025)
par: Tang, Haojun, et autres
Publié: (2025)
PICD: Versatile Perceptual Image Compression with Diffusion Rendering
par: Xu, Tongda, et autres
Publié: (2025)
par: Xu, Tongda, et autres
Publié: (2025)
GIDE: Unlocking Diffusion LLMs for Precise Training-Free Image Editing
par: Zhu, Zifeng, et autres
Publié: (2026)
par: Zhu, Zifeng, et autres
Publié: (2026)
Reversible Inversion for Training-Free Exemplar-guided Image Editing
par: Li, Yuke, et autres
Publié: (2025)
par: Li, Yuke, et autres
Publié: (2025)
Versatile Recompression-Aware Perceptual Image Super-Resolution
par: He, Mingwei, et autres
Publié: (2025)
par: He, Mingwei, et autres
Publié: (2025)
CAMILA: Context-Aware Masking for Image Editing with Language Alignment
par: Kim, Hyunseung, et autres
Publié: (2025)
par: Kim, Hyunseung, et autres
Publié: (2025)
From Competition to Coopetition: Coopetitive Training-Free Image Editing Based on Text Guidance
par: Shen, Jinhao, et autres
Publié: (2026)
par: Shen, Jinhao, et autres
Publié: (2026)
SpecEdit: Training-Free Acceleration for Diffusion based Image Editing via Semantic Locking
par: Yan, Zhengan, et autres
Publié: (2026)
par: Yan, Zhengan, et autres
Publié: (2026)
FusionEdit: Semantic Fusion and Attention Modulation for Training-Free Image Editing
par: Lai, Yongwen, et autres
Publié: (2026)
par: Lai, Yongwen, et autres
Publié: (2026)
Benchmarking and Enhancing VLM for Compressed Image Understanding
par: Zhang, Zifu, et autres
Publié: (2025)
par: Zhang, Zifu, et autres
Publié: (2025)
Flash-VAED: Plug-and-Play VAE Decoders for Efficient Video Generation
par: Zhu, Lunjie, et autres
Publié: (2026)
par: Zhu, Lunjie, et autres
Publié: (2026)
ContextFlow: Training-Free Video Object Editing via Adaptive Context Enrichment
par: Chen, Yiyang, et autres
Publié: (2025)
par: Chen, Yiyang, et autres
Publié: (2025)
ACE: Anti-Editing Concept Erasure in Text-to-Image Models
par: Wang, Zihao, et autres
Publié: (2025)
par: Wang, Zihao, et autres
Publié: (2025)
Free-Mask: A Novel Paradigm of Integration Between the Segmentation Diffusion Model and Image Editing
par: Gao, Bo, et autres
Publié: (2024)
par: Gao, Bo, et autres
Publié: (2024)
Documents similaires
-
MEGA: Memory-Efficient 4D Gaussian Splatting for Dynamic Scenes
par: Zhang, Xinjie, et autres
Publié: (2024) -
Feed-Forward 3D Gaussian Splatting Compression with Long-Context Modeling
par: Liu, Zhening, et autres
Publié: (2025) -
Training-Free Text-Guided Image Editing with Visual Autoregressive Model
par: Wang, Yufei, et autres
Publié: (2025) -
Bidirectional Stereo Image Compression with Cross-Dimensional Entropy Model
par: Liu, Zhening, et autres
Publié: (2024) -
Training-Free Multi-Concept Image Editing
par: Foteinopoulou, Niki, et autres
Publié: (2026)