DreamVAR: Taming Reinforced Visual Autoregressive Model for High-Fidelity Subject-Driven Image Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Jiang, Xin, Chen, Jingwen, Li, Yehao, Pan, Yingwei, Chen, Kezhou, Li, Zechao, Yao, Ting, Mei, Tao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Visual Autoregressive Modeling for Instruction-Guided Image Editing
di: Mao, Qingyang, et al.
Pubblicazione: (2025)
di: Mao, Qingyang, et al.
Pubblicazione: (2025)
HIRI-ViT: Scaling Vision Transformer with High Resolution Inputs
di: Yao, Ting, et al.
Pubblicazione: (2024)
di: Yao, Ting, et al.
Pubblicazione: (2024)
Improving Text-guided Object Inpainting with Semantic Pre-inpainting
di: Chen, Yifu, et al.
Pubblicazione: (2024)
di: Chen, Yifu, et al.
Pubblicazione: (2024)
Hierarchical Masked Autoregressive Models with Low-Resolution Token Pivots
di: Zheng, Guangting, et al.
Pubblicazione: (2025)
di: Zheng, Guangting, et al.
Pubblicazione: (2025)
Improving Virtual Try-On with Garment-focused Diffusion Models
di: Wan, Siqi, et al.
Pubblicazione: (2024)
di: Wan, Siqi, et al.
Pubblicazione: (2024)
Incorporating Visual Correspondence into Diffusion Model for Virtual Try-On
di: Wan, Siqi, et al.
Pubblicazione: (2025)
di: Wan, Siqi, et al.
Pubblicazione: (2025)
Unleashing Text-to-Image Diffusion Prior for Zero-Shot Image Captioning
di: Luo, Jianjie, et al.
Pubblicazione: (2024)
di: Luo, Jianjie, et al.
Pubblicazione: (2024)
DreamJourney: Perpetual View Generation with Video Diffusion Models
di: Pan, Bo, et al.
Pubblicazione: (2025)
di: Pan, Bo, et al.
Pubblicazione: (2025)
FreeInpaint: Tuning-free Prompt Alignment and Visual Rationality Enhancement in Image Inpainting
di: Gong, Chao, et al.
Pubblicazione: (2025)
di: Gong, Chao, et al.
Pubblicazione: (2025)
SD-DiT: Unleashing the Power of Self-supervised Discrimination in Diffusion Transformer
di: Zhu, Rui, et al.
Pubblicazione: (2024)
di: Zhu, Rui, et al.
Pubblicazione: (2024)
Boosting Diffusion Models with Moving Average Sampling in Frequency Domain
di: Qian, Yurui, et al.
Pubblicazione: (2024)
di: Qian, Yurui, et al.
Pubblicazione: (2024)
DreamMesh: Jointly Manipulating and Texturing Triangle Meshes for Text-to-3D Generation
di: Yang, Haibo, et al.
Pubblicazione: (2024)
di: Yang, Haibo, et al.
Pubblicazione: (2024)
VP3D: Unleashing 2D Visual Prompt for Text-to-3D Generation
di: Chen, Yang, et al.
Pubblicazione: (2024)
di: Chen, Yang, et al.
Pubblicazione: (2024)
HiDream-I1: A High-Efficient Image Generative Foundation Model with Sparse Diffusion Transformer
di: Cai, Qi, et al.
Pubblicazione: (2025)
di: Cai, Qi, et al.
Pubblicazione: (2025)
Seg-VAR: Image Segmentation with Visual Autoregressive Modeling
di: Zheng, Rongkun, et al.
Pubblicazione: (2025)
di: Zheng, Rongkun, et al.
Pubblicazione: (2025)
Creatively Upscaling Images with Global-Regional Priors
di: Qian, Yurui, et al.
Pubblicazione: (2025)
di: Qian, Yurui, et al.
Pubblicazione: (2025)
HiDream-O1-Image: A Natively Unified Image Generative Foundation Model with Pixel-level Unified Transformer
di: Cai, Qi, et al.
Pubblicazione: (2026)
di: Cai, Qi, et al.
Pubblicazione: (2026)
CPC-VAR:Continual Personalized and Compositional Generation in Visual Autoregressive Models
di: Li, Junhao, et al.
Pubblicazione: (2026)
di: Li, Junhao, et al.
Pubblicazione: (2026)
ControlVAR: Exploring Controllable Visual Autoregressive Modeling
di: Li, Xiang, et al.
Pubblicazione: (2024)
di: Li, Xiang, et al.
Pubblicazione: (2024)
Safe-VAR: Safe Visual Autoregressive Model for Text-to-Image Generative Watermarking
di: Wang, Ziyi, et al.
Pubblicazione: (2025)
di: Wang, Ziyi, et al.
Pubblicazione: (2025)
AlignVAR: Towards Globally Consistent Visual Autoregression for Image Super-Resolution
di: Liu, Cencen, et al.
Pubblicazione: (2026)
di: Liu, Cencen, et al.
Pubblicazione: (2026)
MultiCrafter: High-Fidelity Multi-Subject Generation via Disentangled Attention and Identity-Aware Preference Alignment
di: Wu, Tao, et al.
Pubblicazione: (2025)
di: Wu, Tao, et al.
Pubblicazione: (2025)
Hi3D: Pursuing High-Resolution Image-to-3D Generation with Video Diffusion Models
di: Yang, Haibo, et al.
Pubblicazione: (2024)
di: Yang, Haibo, et al.
Pubblicazione: (2024)
FastVAR: Linear Visual Autoregressive Modeling via Cached Token Pruning
di: Guo, Hang, et al.
Pubblicazione: (2025)
di: Guo, Hang, et al.
Pubblicazione: (2025)
StyleVAR: Controllable Image Style Transfer via Visual Autoregressive Modeling
di: Jing, Liqi, et al.
Pubblicazione: (2026)
di: Jing, Liqi, et al.
Pubblicazione: (2026)
Rethinking Vision Transformer for Large-Scale Fine-Grained Image Retrieval
di: Jiang, Xin, et al.
Pubblicazione: (2025)
di: Jiang, Xin, et al.
Pubblicazione: (2025)
TRIP: Temporal Residual Learning with Image Noise Prior for Image-to-Video Diffusion Models
di: Zhang, Zhongwei, et al.
Pubblicazione: (2024)
di: Zhang, Zhongwei, et al.
Pubblicazione: (2024)
RestoreVAR: Visual Autoregressive Generation for All-in-One Image Restoration
di: Rajagopalan, Sudarshan, et al.
Pubblicazione: (2025)
di: Rajagopalan, Sudarshan, et al.
Pubblicazione: (2025)
DIVE: Taming DINO for Subject-Driven Video Editing
di: Huang, Yi, et al.
Pubblicazione: (2024)
di: Huang, Yi, et al.
Pubblicazione: (2024)
FasterVAR: Plug-and-Play Acceleration for Visual Autoregressive Models
di: Li, Senmao, et al.
Pubblicazione: (2025)
di: Li, Senmao, et al.
Pubblicazione: (2025)
StepVAR: Structure-Texture Guided Pruning for Visual Autoregressive Models
di: Liu, Keli, et al.
Pubblicazione: (2026)
di: Liu, Keli, et al.
Pubblicazione: (2026)
MotionPro: A Precise Motion Controller for Image-to-Video Generation
di: Zhang, Zhongwei, et al.
Pubblicazione: (2025)
di: Zhang, Zhongwei, et al.
Pubblicazione: (2025)
Prompt Refinement with Image Pivot for Text-to-Image Generation
di: Zhan, Jingtao, et al.
Pubblicazione: (2024)
di: Zhan, Jingtao, et al.
Pubblicazione: (2024)
FlexVAR: Flexible Visual Autoregressive Modeling without Residual Prediction
di: Jiao, Siyu, et al.
Pubblicazione: (2025)
di: Jiao, Siyu, et al.
Pubblicazione: (2025)
ActVAR: Activating Mixtures of Weights and Tokens for Efficient Visual Autoregressive Generation
di: Zhang, Kaixin, et al.
Pubblicazione: (2025)
di: Zhang, Kaixin, et al.
Pubblicazione: (2025)
3DreamBooth: High-Fidelity 3D Subject-Driven Video Generation Model
di: Ko, Hyun-kyu, et al.
Pubblicazione: (2026)
di: Ko, Hyun-kyu, et al.
Pubblicazione: (2026)
ToProVAR: Efficient Visual Autoregressive Modeling via Tri-Dimensional Entropy-Aware Semantic Analysis and Sparsity Optimization
di: Chen, Jiayu, et al.
Pubblicazione: (2026)
di: Chen, Jiayu, et al.
Pubblicazione: (2026)
HSI-VAR: Rethinking Hyperspectral Restoration through Spatial-Spectral Visual Autoregression
di: Wang, Xiangming, et al.
Pubblicazione: (2026)
di: Wang, Xiangming, et al.
Pubblicazione: (2026)
Proxy-Tuning: Tailoring Multimodal Autoregressive Models for Subject-Driven Image Generation
di: Wu, Yi, et al.
Pubblicazione: (2025)
di: Wu, Yi, et al.
Pubblicazione: (2025)
VAR RL Done Right: Tackling Asynchronous Policy Conflicts in Visual Autoregressive Generation
di: Sun, Shikun, et al.
Pubblicazione: (2026)
di: Sun, Shikun, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Visual Autoregressive Modeling for Instruction-Guided Image Editing
di: Mao, Qingyang, et al.
Pubblicazione: (2025) -
HIRI-ViT: Scaling Vision Transformer with High Resolution Inputs
di: Yao, Ting, et al.
Pubblicazione: (2024) -
Improving Text-guided Object Inpainting with Semantic Pre-inpainting
di: Chen, Yifu, et al.
Pubblicazione: (2024) -
Hierarchical Masked Autoregressive Models with Low-Resolution Token Pivots
di: Zheng, Guangting, et al.
Pubblicazione: (2025) -
Improving Virtual Try-On with Garment-focused Diffusion Models
di: Wan, Siqi, et al.
Pubblicazione: (2024)