ControlVAR: Exploring Controllable Visual Autoregressive Modeling
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Xiang, Qiu, Kai, Chen, Hao, Kuen, Jason, Lin, Zhe, Singh, Rita, Raj, Bhiksha |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
ImageFolder: Autoregressive Image Generation with Folded Tokens
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
Robust Latent Matters: Boosting Image Generation with Sampling Error Synthesis
par: Qiu, Kai, et autres
Publié: (2025)
par: Qiu, Kai, et autres
Publié: (2025)
XQ-GAN: An Open-source Image Tokenization Framework for Autoregressive Generation
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
StyleVAR: Controllable Image Style Transfer via Visual Autoregressive Modeling
par: Jing, Liqi, et autres
Publié: (2026)
par: Jing, Liqi, et autres
Publié: (2026)
CSD-VAR: Content-Style Decomposition in Visual Autoregressive Models
par: Nguyen, Quang-Binh, et autres
Publié: (2025)
par: Nguyen, Quang-Binh, et autres
Publié: (2025)
EarthMapper: Visual Autoregressive Models for Controllable Bidirectional Satellite-Map Translation
par: Dong, Zhe, et autres
Publié: (2025)
par: Dong, Zhe, et autres
Publié: (2025)
RestoreVAR: Visual Autoregressive Generation for All-in-One Image Restoration
par: Rajagopalan, Sudarshan, et autres
Publié: (2025)
par: Rajagopalan, Sudarshan, et autres
Publié: (2025)
AlignVAR: Towards Globally Consistent Visual Autoregression for Image Super-Resolution
par: Liu, Cencen, et autres
Publié: (2026)
par: Liu, Cencen, et autres
Publié: (2026)
SparVAR: Exploring Sparsity in Visual AutoRegressive Modeling for Training-Free Acceleration
par: Li, Zekun, et autres
Publié: (2026)
par: Li, Zekun, et autres
Publié: (2026)
Image Tokenizer Needs Post-Training
par: Qiu, Kai, et autres
Publié: (2025)
par: Qiu, Kai, et autres
Publié: (2025)
VerLM: Explaining Face Verification Using Natural Language
par: Hannan, Syed Abdul, et autres
Publié: (2026)
par: Hannan, Syed Abdul, et autres
Publié: (2026)
Slight Corruption in Pre-training Data Makes Better Diffusion Models
par: Chen, Hao, et autres
Publié: (2024)
par: Chen, Hao, et autres
Publié: (2024)
SegGen: Supercharging Segmentation Models with Text2Mask and Mask2Img Synthesis
par: Ye, Hanrong, et autres
Publié: (2023)
par: Ye, Hanrong, et autres
Publié: (2023)
Imprecise Label Learning: A Unified Framework for Learning with Various Imprecise Label Configurations
par: Chen, Hao, et autres
Publié: (2023)
par: Chen, Hao, et autres
Publié: (2023)
RandAR: Decoder-only Autoregressive Visual Generation in Random Orders
par: Pang, Ziqi, et autres
Publié: (2024)
par: Pang, Ziqi, et autres
Publié: (2024)
Completing Visual Objects via Bridging Generation and Segmentation
par: Li, Xiang, et autres
Publié: (2023)
par: Li, Xiang, et autres
Publié: (2023)
High Quality Segmentation for Ultra High-resolution Images
par: Shen, Tiancheng, et autres
Publié: (2021)
par: Shen, Tiancheng, et autres
Publié: (2021)
A Survey on Vision Autoregressive Model
par: Jiang, Kai, et autres
Publié: (2024)
par: Jiang, Kai, et autres
Publié: (2024)
Masked Autoencoders Are Effective Tokenizers for Diffusion Models
par: Chen, Hao, et autres
Publié: (2025)
par: Chen, Hao, et autres
Publié: (2025)
Synergistic Global-space Camera and Human Reconstruction from Videos
par: Zhao, Yizhou, et autres
Publié: (2024)
par: Zhao, Yizhou, et autres
Publié: (2024)
$\text{R}^2$-Bench: Benchmarking the Robustness of Referring Perception Models under Perturbations
par: Li, Xiang, et autres
Publié: (2024)
par: Li, Xiang, et autres
Publié: (2024)
HiTVideo: Hierarchical Tokenizers for Enhancing Text-to-Video Generation with Autoregressive Large Language Models
par: Zhou, Ziqin, et autres
Publié: (2025)
par: Zhou, Ziqin, et autres
Publié: (2025)
LANTERN: Accelerating Visual Autoregressive Models with Relaxed Speculative Decoding
par: Jang, Doohyuk, et autres
Publié: (2024)
par: Jang, Doohyuk, et autres
Publié: (2024)
Omni-Effects: Unified and Spatially-Controllable Visual Effects Generation
par: Mao, Fangyuan, et autres
Publié: (2025)
par: Mao, Fangyuan, et autres
Publié: (2025)
Spanning Tree Autoregressive Visual Generation
par: Lee, Sangkyu, et autres
Publié: (2025)
par: Lee, Sangkyu, et autres
Publié: (2025)
GeoDiffusion: Text-Prompted Geometric Control for Object Detection Data Generation
par: Chen, Kai, et autres
Publié: (2023)
par: Chen, Kai, et autres
Publié: (2023)
FasterVAR: Plug-and-Play Acceleration for Visual Autoregressive Models
par: Li, Senmao, et autres
Publié: (2025)
par: Li, Senmao, et autres
Publié: (2025)
Vision Foundation Models as Effective Visual Tokenizers for Autoregressive Image Generation
par: Zheng, Anlin, et autres
Publié: (2025)
par: Zheng, Anlin, et autres
Publié: (2025)
Not All Tokens are Guided Equal: Improving Guidance in Visual Autoregressive Models
par: Nguyen, Ky Dan, et autres
Publié: (2025)
par: Nguyen, Ky Dan, et autres
Publié: (2025)
Training-Free Text-Guided Image Editing with Visual Autoregressive Model
par: Wang, Yufei, et autres
Publié: (2025)
par: Wang, Yufei, et autres
Publié: (2025)
Adversarial Error Correction for Visual Autoregressive Generation
par: Bi, Ligong, et autres
Publié: (2026)
par: Bi, Ligong, et autres
Publié: (2026)
SoftVQ-VAE: Efficient 1-Dimensional Continuous Tokenizer
par: Chen, Hao, et autres
Publié: (2024)
par: Chen, Hao, et autres
Publié: (2024)
Seg-VAR: Image Segmentation with Visual Autoregressive Modeling
par: Zheng, Rongkun, et autres
Publié: (2025)
par: Zheng, Rongkun, et autres
Publié: (2025)
Control-Augmented Autoregressive Diffusion for Data Assimilation
par: Srivastava, Prakhar, et autres
Publié: (2025)
par: Srivastava, Prakhar, et autres
Publié: (2025)
Visual Autoregressive Modeling: Scalable Image Generation via Next-Scale Prediction
par: Tian, Keyu, et autres
Publié: (2024)
par: Tian, Keyu, et autres
Publié: (2024)
ICAS: Detecting Training Data from Autoregressive Image Generative Models
par: Yu, Hongyao, et autres
Publié: (2025)
par: Yu, Hongyao, et autres
Publié: (2025)
Frame Guidance: Training-Free Guidance for Frame-Level Control in Video Diffusion Models
par: Jang, Sangwon, et autres
Publié: (2025)
par: Jang, Sangwon, et autres
Publié: (2025)
An Embarrassingly Simple Baseline for Imbalanced Semi-Supervised Learning
par: Chen, Hao, et autres
Publié: (2022)
par: Chen, Hao, et autres
Publié: (2022)
Understanding and Mitigating the Label Noise in Pre-training on Downstream Tasks
par: Chen, Hao, et autres
Publié: (2023)
par: Chen, Hao, et autres
Publié: (2023)
FPQVAR: Floating Point Quantization for Visual Autoregressive Model with FPGA Hardware Co-design
par: Wei, Renjie, et autres
Publié: (2025)
par: Wei, Renjie, et autres
Publié: (2025)
Documents similaires
-
ImageFolder: Autoregressive Image Generation with Folded Tokens
par: Li, Xiang, et autres
Publié: (2024) -
Robust Latent Matters: Boosting Image Generation with Sampling Error Synthesis
par: Qiu, Kai, et autres
Publié: (2025) -
XQ-GAN: An Open-source Image Tokenization Framework for Autoregressive Generation
par: Li, Xiang, et autres
Publié: (2024) -
StyleVAR: Controllable Image Style Transfer via Visual Autoregressive Modeling
par: Jing, Liqi, et autres
Publié: (2026) -
CSD-VAR: Content-Style Decomposition in Visual Autoregressive Models
par: Nguyen, Quang-Binh, et autres
Publié: (2025)