Training-Free Image Editing with Visual Context Integration and Concept Alignment
Fuente:
arXiv
Guardado en:
| Autores principales: | Song, Rui, Wang, Guo-Hua, Chen, Qing-Guo, Luo, Weihua, Xu, Tongda, Liu, Zhening, Wang, Yan, Lin, Zehong, Zhang, Jun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MEGA: Memory-Efficient 4D Gaussian Splatting for Dynamic Scenes
por: Zhang, Xinjie, et al.
Publicado: (2024)
por: Zhang, Xinjie, et al.
Publicado: (2024)
Feed-Forward 3D Gaussian Splatting Compression with Long-Context Modeling
por: Liu, Zhening, et al.
Publicado: (2025)
por: Liu, Zhening, et al.
Publicado: (2025)
Training-Free Text-Guided Image Editing with Visual Autoregressive Model
por: Wang, Yufei, et al.
Publicado: (2025)
por: Wang, Yufei, et al.
Publicado: (2025)
Bidirectional Stereo Image Compression with Cross-Dimensional Entropy Model
por: Liu, Zhening, et al.
Publicado: (2024)
por: Liu, Zhening, et al.
Publicado: (2024)
Training-Free Multi-Concept Image Editing
por: Foteinopoulou, Niki, et al.
Publicado: (2026)
por: Foteinopoulou, Niki, et al.
Publicado: (2026)
TeEFusion: Blending Text Embeddings to Distill Classifier-Free Guidance
por: Fu, Minghao, et al.
Publicado: (2025)
por: Fu, Minghao, et al.
Publicado: (2025)
CAMSIC: Content-aware Masked Image Modeling Transformer for Stereo Image Compression
por: Zhang, Xinjie, et al.
Publicado: (2024)
por: Zhang, Xinjie, et al.
Publicado: (2024)
EVA-Gaussian: 3D Gaussian-based Real-time Human Novel View Synthesis under Diverse Multi-view Camera Settings
por: Hu, Yingdong, et al.
Publicado: (2024)
por: Hu, Yingdong, et al.
Publicado: (2024)
Dynamics-Aware Gaussian Splatting Streaming Towards Fast On-the-Fly 4D Reconstruction
por: Liu, Zhening, et al.
Publicado: (2024)
por: Liu, Zhening, et al.
Publicado: (2024)
Real-Time Human Frontal View Synthesis from a Single Image
por: Lin, Fangyu, et al.
Publicado: (2026)
por: Lin, Fangyu, et al.
Publicado: (2026)
CHATS: Combining Human-Aligned Optimization and Test-Time Sampling for Text-to-Image Generation
por: Fu, Minghao, et al.
Publicado: (2025)
por: Fu, Minghao, et al.
Publicado: (2025)
RemedyGS: Defend 3D Gaussian Splatting against Computation Cost Attacks
por: Li, Yanping, et al.
Publicado: (2025)
por: Li, Yanping, et al.
Publicado: (2025)
Evaluating Image Caption via Cycle-consistent Text-to-Image Generation
por: Cui, Tianyu, et al.
Publicado: (2025)
por: Cui, Tianyu, et al.
Publicado: (2025)
Noise Dimension of GAN: An Image Compression Perspective
por: Zhu, Ziran, et al.
Publicado: (2024)
por: Zhu, Ziran, et al.
Publicado: (2024)
Mon3tr: Monocular 3D Telepresence with Pre-built Gaussian Avatars as Amortization
por: Lin, Fangyu, et al.
Publicado: (2026)
por: Lin, Fangyu, et al.
Publicado: (2026)
Optimizing Input of Denoising Score Matching is Biased Towards Higher Score Norm
por: Xu, Tongda
Publicado: (2025)
por: Xu, Tongda
Publicado: (2025)
Training-Free Vector Quantization via Gaussian VAEs
por: Xu, Tongda, et al.
Publicado: (2025)
por: Xu, Tongda, et al.
Publicado: (2025)
RAWIC: Bit-Depth Adaptive Lossless Raw Image Compression
por: Zheng, Chunhang, et al.
Publicado: (2026)
por: Zheng, Chunhang, et al.
Publicado: (2026)
GaussianImage++: Boosted Image Representation and Compression with 2D Gaussian Splatting
por: Li, Tiantian, et al.
Publicado: (2025)
por: Li, Tiantian, et al.
Publicado: (2025)
Fast Training-free Perceptual Image Compression
por: Zhu, Ziran, et al.
Publicado: (2025)
por: Zhu, Ziran, et al.
Publicado: (2025)
Diffusion-SDPO: Safeguarded Direct Preference Optimization for Diffusion Models
por: Fu, Minghao, et al.
Publicado: (2025)
por: Fu, Minghao, et al.
Publicado: (2025)
LoRAShop: Training-Free Multi-Concept Image Generation and Editing with Rectified Flow Transformers
por: Dalva, Yusuf, et al.
Publicado: (2025)
por: Dalva, Yusuf, et al.
Publicado: (2025)
VoxHammer: Training-Free Precise and Coherent 3D Editing in Native 3D Space
por: Li, Lin, et al.
Publicado: (2025)
por: Li, Lin, et al.
Publicado: (2025)
GaussianImage: 1000 FPS Image Representation and Compression by 2D Gaussian Splatting
por: Zhang, Xinjie, et al.
Publicado: (2024)
por: Zhang, Xinjie, et al.
Publicado: (2024)
Re-Align: Structured Reasoning-guided Alignment for In-Context Image Generation and Editing
por: He, Runze, et al.
Publicado: (2026)
por: He, Runze, et al.
Publicado: (2026)
SenseFlow: Scaling Distribution Matching for Flow-based Text-to-Image Distillation
por: Ge, Xingtong, et al.
Publicado: (2025)
por: Ge, Xingtong, et al.
Publicado: (2025)
V-Shuffle: Zero-Shot Style Transfer via Value Shuffle
por: Tang, Haojun, et al.
Publicado: (2025)
por: Tang, Haojun, et al.
Publicado: (2025)
PICD: Versatile Perceptual Image Compression with Diffusion Rendering
por: Xu, Tongda, et al.
Publicado: (2025)
por: Xu, Tongda, et al.
Publicado: (2025)
GIDE: Unlocking Diffusion LLMs for Precise Training-Free Image Editing
por: Zhu, Zifeng, et al.
Publicado: (2026)
por: Zhu, Zifeng, et al.
Publicado: (2026)
Reversible Inversion for Training-Free Exemplar-guided Image Editing
por: Li, Yuke, et al.
Publicado: (2025)
por: Li, Yuke, et al.
Publicado: (2025)
Versatile Recompression-Aware Perceptual Image Super-Resolution
por: He, Mingwei, et al.
Publicado: (2025)
por: He, Mingwei, et al.
Publicado: (2025)
CAMILA: Context-Aware Masking for Image Editing with Language Alignment
por: Kim, Hyunseung, et al.
Publicado: (2025)
por: Kim, Hyunseung, et al.
Publicado: (2025)
From Competition to Coopetition: Coopetitive Training-Free Image Editing Based on Text Guidance
por: Shen, Jinhao, et al.
Publicado: (2026)
por: Shen, Jinhao, et al.
Publicado: (2026)
SpecEdit: Training-Free Acceleration for Diffusion based Image Editing via Semantic Locking
por: Yan, Zhengan, et al.
Publicado: (2026)
por: Yan, Zhengan, et al.
Publicado: (2026)
FusionEdit: Semantic Fusion and Attention Modulation for Training-Free Image Editing
por: Lai, Yongwen, et al.
Publicado: (2026)
por: Lai, Yongwen, et al.
Publicado: (2026)
Benchmarking and Enhancing VLM for Compressed Image Understanding
por: Zhang, Zifu, et al.
Publicado: (2025)
por: Zhang, Zifu, et al.
Publicado: (2025)
Flash-VAED: Plug-and-Play VAE Decoders for Efficient Video Generation
por: Zhu, Lunjie, et al.
Publicado: (2026)
por: Zhu, Lunjie, et al.
Publicado: (2026)
ContextFlow: Training-Free Video Object Editing via Adaptive Context Enrichment
por: Chen, Yiyang, et al.
Publicado: (2025)
por: Chen, Yiyang, et al.
Publicado: (2025)
ACE: Anti-Editing Concept Erasure in Text-to-Image Models
por: Wang, Zihao, et al.
Publicado: (2025)
por: Wang, Zihao, et al.
Publicado: (2025)
Free-Mask: A Novel Paradigm of Integration Between the Segmentation Diffusion Model and Image Editing
por: Gao, Bo, et al.
Publicado: (2024)
por: Gao, Bo, et al.
Publicado: (2024)
Ejemplares similares
-
MEGA: Memory-Efficient 4D Gaussian Splatting for Dynamic Scenes
por: Zhang, Xinjie, et al.
Publicado: (2024) -
Feed-Forward 3D Gaussian Splatting Compression with Long-Context Modeling
por: Liu, Zhening, et al.
Publicado: (2025) -
Training-Free Text-Guided Image Editing with Visual Autoregressive Model
por: Wang, Yufei, et al.
Publicado: (2025) -
Bidirectional Stereo Image Compression with Cross-Dimensional Entropy Model
por: Liu, Zhening, et al.
Publicado: (2024) -
Training-Free Multi-Concept Image Editing
por: Foteinopoulou, Niki, et al.
Publicado: (2026)