Training-Free Text-Guided Image Editing with Visual Autoregressive Model
Fuente:
arXiv
Salvato in:
| Autori principali: | Wang, Yufei, Guo, Lanqing, Li, Zhihao, Huang, Jiaxing, Wang, Pichao, Wen, Bihan, Wang, Jian |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ContextGS: Compact 3D Gaussian Splatting with Anchor Level Context Model
di: Wang, Yufei, et al.
Pubblicazione: (2024)
di: Wang, Yufei, et al.
Pubblicazione: (2024)
Temporal As a Plugin: Unsupervised Video Denoising with Pre-Trained Image Denoisers
di: Fu, Zixuan, et al.
Pubblicazione: (2024)
di: Fu, Zixuan, et al.
Pubblicazione: (2024)
Training-Free Text-Guided Color Editing with Multi-Modal Diffusion Transformer
di: Yin, Zixin, et al.
Pubblicazione: (2025)
di: Yin, Zixin, et al.
Pubblicazione: (2025)
A Survey on Vision Autoregressive Model
di: Jiang, Kai, et al.
Pubblicazione: (2024)
di: Jiang, Kai, et al.
Pubblicazione: (2024)
Improving Flexible Image Tokenizers for Autoregressive Image Generation
di: Fu, Zixuan, et al.
Pubblicazione: (2026)
di: Fu, Zixuan, et al.
Pubblicazione: (2026)
Demystifying the Visual Quality Paradox in Multimodal Large Language Models
di: Xing, Shuo, et al.
Pubblicazione: (2025)
di: Xing, Shuo, et al.
Pubblicazione: (2025)
DP-IQA: Utilizing Diffusion Prior for Blind Image Quality Assessment in the Wild
di: Fu, Honghao, et al.
Pubblicazione: (2024)
di: Fu, Honghao, et al.
Pubblicazione: (2024)
Text Guided Image Editing with Automatic Concept Locating and Forgetting
di: Li, Jia, et al.
Pubblicazione: (2024)
di: Li, Jia, et al.
Pubblicazione: (2024)
AlignVAR: Towards Globally Consistent Visual Autoregression for Image Super-Resolution
di: Liu, Cencen, et al.
Pubblicazione: (2026)
di: Liu, Cencen, et al.
Pubblicazione: (2026)
MedEBench: Diagnosing Reliability in Text-Guided Medical Image Editing
di: Liu, Minghao, et al.
Pubblicazione: (2025)
di: Liu, Minghao, et al.
Pubblicazione: (2025)
Training-Free Reward-Guided Image Editing via Trajectory Optimal Control
di: Chang, Jinho, et al.
Pubblicazione: (2025)
di: Chang, Jinho, et al.
Pubblicazione: (2025)
Token Merging for Training-Free Semantic Binding in Text-to-Image Synthesis
di: Hu, Taihang, et al.
Pubblicazione: (2024)
di: Hu, Taihang, et al.
Pubblicazione: (2024)
Vision Foundation Models as Effective Visual Tokenizers for Autoregressive Image Generation
di: Zheng, Anlin, et al.
Pubblicazione: (2025)
di: Zheng, Anlin, et al.
Pubblicazione: (2025)
Detail++: Training-Free Detail Enhancer for Text-to-Image Diffusion Models
di: Chen, Lifeng, et al.
Pubblicazione: (2025)
di: Chen, Lifeng, et al.
Pubblicazione: (2025)
SINE: SINgle Image Editing with Text-to-Image Diffusion Models
di: Zhang, Zhixing, et al.
Pubblicazione: (2022)
di: Zhang, Zhixing, et al.
Pubblicazione: (2022)
Not All Tokens are Guided Equal: Improving Guidance in Visual Autoregressive Models
di: Nguyen, Ky Dan, et al.
Pubblicazione: (2025)
di: Nguyen, Ky Dan, et al.
Pubblicazione: (2025)
Benchmarking Adversarial Robustness of Image Shadow Removal with Shadow-adaptive Attacks
di: Wang, Chong, et al.
Pubblicazione: (2024)
di: Wang, Chong, et al.
Pubblicazione: (2024)
Coupled Diffusion Sampling for Training-Free Multi-View Image Editing
di: Alzayer, Hadi, et al.
Pubblicazione: (2025)
di: Alzayer, Hadi, et al.
Pubblicazione: (2025)
Rethinking Structure Preservation in Text-Guided Image Editing with Visual Autoregressive Models
di: Xia, Tao, et al.
Pubblicazione: (2026)
di: Xia, Tao, et al.
Pubblicazione: (2026)
Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction
di: Tian, Keyu, et al.
Pubblicazione: (2024)
di: Tian, Keyu, et al.
Pubblicazione: (2024)
Training-Free Watermarking for Autoregressive Image Generation
di: Tong, Yu, et al.
Pubblicazione: (2025)
di: Tong, Yu, et al.
Pubblicazione: (2025)
RAP: Retrieve, Adapt, and Prompt-Fit for Training-Free Few-Shot Medical Image Segmentation
di: Mao, Zhihao, et al.
Pubblicazione: (2026)
di: Mao, Zhihao, et al.
Pubblicazione: (2026)
Controlling Your Image via Simplified Vector Graphics
di: Guo, Lanqing, et al.
Pubblicazione: (2026)
di: Guo, Lanqing, et al.
Pubblicazione: (2026)
CLIPDrag: Combining Text-based and Drag-based Instructions for Image Editing
di: Jiang, Ziqi, et al.
Pubblicazione: (2024)
di: Jiang, Ziqi, et al.
Pubblicazione: (2024)
Scale Where It Matters: Training-Free Localized Scaling for Diffusion Models
di: Ren, Qin, et al.
Pubblicazione: (2025)
di: Ren, Qin, et al.
Pubblicazione: (2025)
Discovering Hidden Visual Concepts Beyond Linguistic Input in Infant Learning
di: Ke, Xueyi, et al.
Pubblicazione: (2025)
di: Ke, Xueyi, et al.
Pubblicazione: (2025)
Beyond Pixels: A Training-Free, Text-to-Text Framework for Remote Sensing Image Retrieval
di: Xiao, J., et al.
Pubblicazione: (2025)
di: Xiao, J., et al.
Pubblicazione: (2025)
Adversarial Error Correction for Visual Autoregressive Generation
di: Bi, Ligong, et al.
Pubblicazione: (2026)
di: Bi, Ligong, et al.
Pubblicazione: (2026)
CannyEdit: Selective Canny Control and Dual-Prompt Guidance for Training-Free Image Editing
di: Xie, Weiyan, et al.
Pubblicazione: (2025)
di: Xie, Weiyan, et al.
Pubblicazione: (2025)
Free$^2$Guide: Training-Free Text-to-Video Alignment using Image LVLM
di: Kim, Jaemin, et al.
Pubblicazione: (2024)
di: Kim, Jaemin, et al.
Pubblicazione: (2024)
ComCLIP: Training-Free Compositional Image and Text Matching
di: Jiang, Kenan, et al.
Pubblicazione: (2022)
di: Jiang, Kenan, et al.
Pubblicazione: (2022)
Probing Visual Planning in Image Editing Models
di: Zhou, Zhimu, et al.
Pubblicazione: (2026)
di: Zhou, Zhimu, et al.
Pubblicazione: (2026)
SoftShadow: Leveraging Soft Masks for Penumbra-Aware Shadow Removal
di: Wang, Xinrui, et al.
Pubblicazione: (2024)
di: Wang, Xinrui, et al.
Pubblicazione: (2024)
SparVAR: Exploring Sparsity in Visual AutoRegressive Modeling for Training-Free Acceleration
di: Li, Zekun, et al.
Pubblicazione: (2026)
di: Li, Zekun, et al.
Pubblicazione: (2026)
Nexus-Gen: Unified Image Understanding, Generation, and Editing via Prefilled Autoregression in Shared Embedding Space
di: Zhang, Hong, et al.
Pubblicazione: (2025)
di: Zhang, Hong, et al.
Pubblicazione: (2025)
Revisiting Non-Autoregressive Transformers for Efficient Image Synthesis
di: Ni, Zanlin, et al.
Pubblicazione: (2024)
di: Ni, Zanlin, et al.
Pubblicazione: (2024)
LaDiC: Are Diffusion Models Really Inferior to Autoregressive Counterparts for Image-to-Text Generation?
di: Wang, Yuchi, et al.
Pubblicazione: (2024)
di: Wang, Yuchi, et al.
Pubblicazione: (2024)
Free-Mask: A Novel Paradigm of Integration Between the Segmentation Diffusion Model and Image Editing
di: Gao, Bo, et al.
Pubblicazione: (2024)
di: Gao, Bo, et al.
Pubblicazione: (2024)
RSVG-ZeroOV: Exploring a Training-Free Framework for Zero-Shot Open-Vocabulary Visual Grounding in Remote Sensing Images
di: Li, Ke, et al.
Pubblicazione: (2025)
di: Li, Ke, et al.
Pubblicazione: (2025)
Layout-Conditioned Autoregressive Text-to-Image Generation via Structured Masking
di: Zheng, Zirui, et al.
Pubblicazione: (2025)
di: Zheng, Zirui, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ContextGS: Compact 3D Gaussian Splatting with Anchor Level Context Model
di: Wang, Yufei, et al.
Pubblicazione: (2024) -
Temporal As a Plugin: Unsupervised Video Denoising with Pre-Trained Image Denoisers
di: Fu, Zixuan, et al.
Pubblicazione: (2024) -
Training-Free Text-Guided Color Editing with Multi-Modal Diffusion Transformer
di: Yin, Zixin, et al.
Pubblicazione: (2025) -
A Survey on Vision Autoregressive Model
di: Jiang, Kai, et al.
Pubblicazione: (2024) -
Improving Flexible Image Tokenizers for Autoregressive Image Generation
di: Fu, Zixuan, et al.
Pubblicazione: (2026)