Marrying Autoregressive Transformer and Diffusion with Multi-Reference Autoregression
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhen, Dingcheng, Qiao, Qian, Zheng, Xu, Yu, Tan, Wu, Kangxi, Zhang, Ziwei, Liu, Siyuan, Yin, Shunshun, Tao, Ming |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Teller: Real-Time Streaming Audio-Driven Portrait Animation with Autoregressive Motion Generation
di: Zhen, Dingcheng, et al.
Pubblicazione: (2025)
di: Zhen, Dingcheng, et al.
Pubblicazione: (2025)
RAP: Real-time Audio-driven Portrait Animation with Video Diffusion Transformer
di: Du, Fangyu, et al.
Pubblicazione: (2025)
di: Du, Fangyu, et al.
Pubblicazione: (2025)
SoulX-LiveAct: Towards Hour-Scale Real-Time Human Animation with Neighbor Forcing and ConvKV Memory
di: Zhen, Dingcheng, et al.
Pubblicazione: (2026)
di: Zhen, Dingcheng, et al.
Pubblicazione: (2026)
Autoregressive Distillation of Diffusion Transformers
di: Kim, Yeongmin, et al.
Pubblicazione: (2025)
di: Kim, Yeongmin, et al.
Pubblicazione: (2025)
AMS-KV: Adaptive KV Caching in Multi-Scale Visual Autoregressive Transformers
di: Xu, Boxun, et al.
Pubblicazione: (2025)
di: Xu, Boxun, et al.
Pubblicazione: (2025)
FREE: Uncertainty-Aware Autoregression for Parallel Diffusion Transformers
di: Wen, Xinwan, et al.
Pubblicazione: (2025)
di: Wen, Xinwan, et al.
Pubblicazione: (2025)
ACDiT: Interpolating Autoregressive Conditional Modeling and Diffusion Transformer
di: Hu, Jinyi, et al.
Pubblicazione: (2024)
di: Hu, Jinyi, et al.
Pubblicazione: (2024)
MonoFormer: One Transformer for Both Diffusion and Autoregression
di: Zhao, Chuyang, et al.
Pubblicazione: (2024)
di: Zhao, Chuyang, et al.
Pubblicazione: (2024)
D-AR: Diffusion via Autoregressive Models
di: Gao, Ziteng, et al.
Pubblicazione: (2025)
di: Gao, Ziteng, et al.
Pubblicazione: (2025)
Controllable Skin Synthesis via Lesion-Focused Vector Autoregression Model
di: Sun, Jiajun, et al.
Pubblicazione: (2025)
di: Sun, Jiajun, et al.
Pubblicazione: (2025)
Progressive Autoregressive Video Diffusion Models
di: Xie, Desai, et al.
Pubblicazione: (2024)
di: Xie, Desai, et al.
Pubblicazione: (2024)
DiSA: Diffusion Step Annealing in Autoregressive Image Generation
di: Zhao, Qinyu, et al.
Pubblicazione: (2025)
di: Zhao, Qinyu, et al.
Pubblicazione: (2025)
SoulX-FlashTalk: Real-Time Infinite Streaming of Audio-Driven Avatars via Self-Correcting Bidirectional Distillation
di: Shen, Le, et al.
Pubblicazione: (2025)
di: Shen, Le, et al.
Pubblicazione: (2025)
Epona: Autoregressive Diffusion World Model for Autonomous Driving
di: Zhang, Kaiwen, et al.
Pubblicazione: (2025)
di: Zhang, Kaiwen, et al.
Pubblicazione: (2025)
Generative Pre-trained Autoregressive Diffusion Transformer
di: Zhang, Yuan, et al.
Pubblicazione: (2025)
di: Zhang, Yuan, et al.
Pubblicazione: (2025)
MSC: Multi-Scale Spatio-Temporal Causal Attention for Autoregressive Video Diffusion
di: Xu, Xunnong, et al.
Pubblicazione: (2024)
di: Xu, Xunnong, et al.
Pubblicazione: (2024)
Infinite Gaze Generation for Videos with Autoregressive Diffusion
di: Kang, Jenna, et al.
Pubblicazione: (2026)
di: Kang, Jenna, et al.
Pubblicazione: (2026)
ARLON: Boosting Diffusion Transformers with Autoregressive Models for Long Video Generation
di: Li, Zongyi, et al.
Pubblicazione: (2024)
di: Li, Zongyi, et al.
Pubblicazione: (2024)
LongStream: Long-Sequence Streaming Autoregressive Visual Geometry
di: Cheng, Chong, et al.
Pubblicazione: (2026)
di: Cheng, Chong, et al.
Pubblicazione: (2026)
Causal Motion Diffusion Models for Autoregressive Motion Generation
di: Yu, Qing, et al.
Pubblicazione: (2026)
di: Yu, Qing, et al.
Pubblicazione: (2026)
UniT: Unified Geometry Learning with Group Autoregressive Transformer
di: Wang, Haotian, et al.
Pubblicazione: (2026)
di: Wang, Haotian, et al.
Pubblicazione: (2026)
AssetFormer: Modular 3D Assets Generation with Autoregressive Transformer
di: Zhu, Lingting, et al.
Pubblicazione: (2026)
di: Zhu, Lingting, et al.
Pubblicazione: (2026)
From Slow Bidirectional to Fast Autoregressive Video Diffusion Models
di: Yin, Tianwei, et al.
Pubblicazione: (2024)
di: Yin, Tianwei, et al.
Pubblicazione: (2024)
Parameterized Diffusion Optimization enabled Autoregressive Ordinal Regression for Diabetic Retinopathy Grading
di: Yu, Qinkai, et al.
Pubblicazione: (2025)
di: Yu, Qinkai, et al.
Pubblicazione: (2025)
DiffusionVL: Translating Any Autoregressive Models into Diffusion Vision Language Models
di: Zeng, Lunbin, et al.
Pubblicazione: (2025)
di: Zeng, Lunbin, et al.
Pubblicazione: (2025)
AR-MOT: Autoregressive Multi-object Tracking
di: Jia, Lianjie, et al.
Pubblicazione: (2026)
di: Jia, Lianjie, et al.
Pubblicazione: (2026)
Proxy-Tuning: Tailoring Multimodal Autoregressive Models for Subject-Driven Image Generation
di: Wu, Yi, et al.
Pubblicazione: (2025)
di: Wu, Yi, et al.
Pubblicazione: (2025)
DiT as Real-Time Rerenderer: Streaming Video Stylization with Autoregressive Diffusion Transformer
di: Lyu, Hengye, et al.
Pubblicazione: (2026)
di: Lyu, Hengye, et al.
Pubblicazione: (2026)
HorizonDrive: Self-Corrective Autoregressive World Model for Long-horizon Driving Simulation
di: Zhang, Conglang, et al.
Pubblicazione: (2026)
di: Zhang, Conglang, et al.
Pubblicazione: (2026)
ARGaze: Autoregressive Transformers for Online Egocentric Gaze Estimation
di: Li, Jia, et al.
Pubblicazione: (2026)
di: Li, Jia, et al.
Pubblicazione: (2026)
MADFormer: Mixed Autoregressive and Diffusion Transformers for Continuous Image Generation
di: Chen, Junhao, et al.
Pubblicazione: (2025)
di: Chen, Junhao, et al.
Pubblicazione: (2025)
Efficient Conditional Generation on Scale-based Visual Autoregressive Models
di: Liu, Jiaqi, et al.
Pubblicazione: (2025)
di: Liu, Jiaqi, et al.
Pubblicazione: (2025)
Rolling Forcing: Autoregressive Long Video Diffusion in Real Time
di: Liu, Kunhao, et al.
Pubblicazione: (2025)
di: Liu, Kunhao, et al.
Pubblicazione: (2025)
Efficient Autoregressive Video Diffusion with Dummy Head
di: Guo, Hang, et al.
Pubblicazione: (2026)
di: Guo, Hang, et al.
Pubblicazione: (2026)
Selftok: Discrete Visual Tokens of Autoregression, by Diffusion, and for Reasoning
di: Wang, Bohan, et al.
Pubblicazione: (2025)
di: Wang, Bohan, et al.
Pubblicazione: (2025)
LaVieID: Local Autoregressive Diffusion Transformers for Identity-Preserving Video Creation
di: Song, Wenhui, et al.
Pubblicazione: (2025)
di: Song, Wenhui, et al.
Pubblicazione: (2025)
Unified Autoregressive Visual Generation and Understanding with Continuous Tokens
di: Fan, Lijie, et al.
Pubblicazione: (2025)
di: Fan, Lijie, et al.
Pubblicazione: (2025)
MarDini: Masked Autoregressive Diffusion for Video Generation at Scale
di: Liu, Haozhe, et al.
Pubblicazione: (2024)
di: Liu, Haozhe, et al.
Pubblicazione: (2024)
CPC-VAR:Continual Personalized and Compositional Generation in Visual Autoregressive Models
di: Li, Junhao, et al.
Pubblicazione: (2026)
di: Li, Junhao, et al.
Pubblicazione: (2026)
Customize Your Visual Autoregressive Recipe with Set Autoregressive Modeling
di: Liu, Wenze, et al.
Pubblicazione: (2024)
di: Liu, Wenze, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Teller: Real-Time Streaming Audio-Driven Portrait Animation with Autoregressive Motion Generation
di: Zhen, Dingcheng, et al.
Pubblicazione: (2025) -
RAP: Real-time Audio-driven Portrait Animation with Video Diffusion Transformer
di: Du, Fangyu, et al.
Pubblicazione: (2025) -
SoulX-LiveAct: Towards Hour-Scale Real-Time Human Animation with Neighbor Forcing and ConvKV Memory
di: Zhen, Dingcheng, et al.
Pubblicazione: (2026) -
Autoregressive Distillation of Diffusion Transformers
di: Kim, Yeongmin, et al.
Pubblicazione: (2025) -
AMS-KV: Adaptive KV Caching in Multi-Scale Visual Autoregressive Transformers
di: Xu, Boxun, et al.
Pubblicazione: (2025)