Adaptive Begin-of-Video Tokens for Autoregressive Video Diffusion Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Cheng, Tianle, Zhang, Zeyan, Gao, Kaifeng, Xiao, Jun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
ViD-GPT: Introducing GPT-style Autoregressive Generation in Video Diffusion Models
por: Gao, Kaifeng, et al.
Publicado: (2024)
por: Gao, Kaifeng, et al.
Publicado: (2024)
Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing
por: Gao, Kaifeng, et al.
Publicado: (2024)
por: Gao, Kaifeng, et al.
Publicado: (2024)
EVATok: Adaptive Length Video Tokenization for Efficient Visual Autoregressive Generation
por: Xiong, Tianwei, et al.
Publicado: (2026)
por: Xiong, Tianwei, et al.
Publicado: (2026)
DiCoDe: Diffusion-Compressed Deep Tokens for Autoregressive Video Generation with Language Models
por: Li, Yizhuo, et al.
Publicado: (2024)
por: Li, Yizhuo, et al.
Publicado: (2024)
VideoMAR: Autoregressive Video Generatio with Continuous Tokens
por: Yu, Hu, et al.
Publicado: (2025)
por: Yu, Hu, et al.
Publicado: (2025)
From Slow Bidirectional to Fast Autoregressive Video Diffusion Models
por: Yin, Tianwei, et al.
Publicado: (2024)
por: Yin, Tianwei, et al.
Publicado: (2024)
Q-ARVD: Quantizing Autoregressive Video Diffusion Models
por: Tang, Siao, et al.
Publicado: (2026)
por: Tang, Siao, et al.
Publicado: (2026)
Progressive Autoregressive Video Diffusion Models
por: Xie, Desai, et al.
Publicado: (2024)
por: Xie, Desai, et al.
Publicado: (2024)
Knot Forcing: Taming Autoregressive Video Diffusion Models for Real-time Infinite Interactive Portrait Animation
por: Xiao, Steven, et al.
Publicado: (2025)
por: Xiao, Steven, et al.
Publicado: (2025)
Forcing-KV: Hybrid KV Cache Compression for Efficient Autoregressive Video Diffusion Models
por: Ji, Yicheng, et al.
Publicado: (2026)
por: Ji, Yicheng, et al.
Publicado: (2026)
Efficient Autoregressive Video Diffusion with Dummy Head
por: Guo, Hang, et al.
Publicado: (2026)
por: Guo, Hang, et al.
Publicado: (2026)
Infinite Gaze Generation for Videos with Autoregressive Diffusion
por: Kang, Jenna, et al.
Publicado: (2026)
por: Kang, Jenna, et al.
Publicado: (2026)
Real-Time Motion-Controllable Autoregressive Video Diffusion
por: Zhao, Kesen, et al.
Publicado: (2025)
por: Zhao, Kesen, et al.
Publicado: (2025)
Generalized Visual Relation Detection with Diffusion Models
por: Gao, Kaifeng, et al.
Publicado: (2025)
por: Gao, Kaifeng, et al.
Publicado: (2025)
FastSTAR: Spatiotemporal Token Pruning for Efficient Autoregressive Video Synthesis
por: Yune, Sungwoong, et al.
Publicado: (2026)
por: Yune, Sungwoong, et al.
Publicado: (2026)
ARLON: Boosting Diffusion Transformers with Autoregressive Models for Long Video Generation
por: Li, Zongyi, et al.
Publicado: (2024)
por: Li, Zongyi, et al.
Publicado: (2024)
ALTo: Adaptive-Length Tokenizer for Autoregressive Mask Generation
por: Wang, Lingfeng, et al.
Publicado: (2025)
por: Wang, Lingfeng, et al.
Publicado: (2025)
Autoregressive Universal Video Segmentation Model
por: Heo, Miran, et al.
Publicado: (2025)
por: Heo, Miran, et al.
Publicado: (2025)
VideoMAP: Toward Scalable Mamba-based Video Autoregressive Pretraining
por: Liu, Yunze, et al.
Publicado: (2025)
por: Liu, Yunze, et al.
Publicado: (2025)
Causal Forcing++: Scalable Few-Step Autoregressive Diffusion Distillation for Real-Time Interactive Video Generation
por: Zhao, Min, et al.
Publicado: (2026)
por: Zhao, Min, et al.
Publicado: (2026)
TokenTrim: Inference-Time Token Pruning for Autoregressive Long Video Generation
por: Shaulov, Ariel, et al.
Publicado: (2026)
por: Shaulov, Ariel, et al.
Publicado: (2026)
Past- and Future-Informed KV Cache Policy with Salience Estimation in Autoregressive Video Diffusion
por: Chen, Hanmo, et al.
Publicado: (2026)
por: Chen, Hanmo, et al.
Publicado: (2026)
Adaptive 1D Video Diffusion Autoencoder
por: Teng, Yao, et al.
Publicado: (2026)
por: Teng, Yao, et al.
Publicado: (2026)
Fractal Autoregressive Depth Estimation with Continuous Token Diffusion
por: Zhang, Jinchang, et al.
Publicado: (2026)
por: Zhang, Jinchang, et al.
Publicado: (2026)
Rolling Forcing: Autoregressive Long Video Diffusion in Real Time
por: Liu, Kunhao, et al.
Publicado: (2025)
por: Liu, Kunhao, et al.
Publicado: (2025)
Selftok: Discrete Visual Tokens of Autoregression, by Diffusion, and for Reasoning
por: Wang, Bohan, et al.
Publicado: (2025)
por: Wang, Bohan, et al.
Publicado: (2025)
DartControl: A Diffusion-Based Autoregressive Motion Model for Real-Time Text-Driven Motion Control
por: Zhao, Kaifeng, et al.
Publicado: (2024)
por: Zhao, Kaifeng, et al.
Publicado: (2024)
LARP: Tokenizing Videos with a Learned Autoregressive Generative Prior
por: Wang, Hanyu, et al.
Publicado: (2024)
por: Wang, Hanyu, et al.
Publicado: (2024)
LaVieID: Local Autoregressive Diffusion Transformers for Identity-Preserving Video Creation
por: Song, Wenhui, et al.
Publicado: (2025)
por: Song, Wenhui, et al.
Publicado: (2025)
DiT as Real-Time Rerenderer: Streaming Video Stylization with Autoregressive Diffusion Transformer
por: Lyu, Hengye, et al.
Publicado: (2026)
por: Lyu, Hengye, et al.
Publicado: (2026)
Pathwise Test-Time Correction for Autoregressive Long Video Generation
por: Xiang, Xunzhi, et al.
Publicado: (2026)
por: Xiang, Xunzhi, et al.
Publicado: (2026)
End-to-End Training for Autoregressive Video Diffusion via Self-Resampling
por: Guo, Yuwei, et al.
Publicado: (2025)
por: Guo, Yuwei, et al.
Publicado: (2025)
Light Forcing: Accelerating Autoregressive Video Diffusion via Sparse Attention
por: Lv, Chengtao, et al.
Publicado: (2026)
por: Lv, Chengtao, et al.
Publicado: (2026)
Astraea: A Token-wise Acceleration Framework for Video Diffusion Transformers
por: Liu, Haosong, et al.
Publicado: (2025)
por: Liu, Haosong, et al.
Publicado: (2025)
Divot: Diffusion Powers Video Tokenizer for Comprehension and Generation
por: Ge, Yuying, et al.
Publicado: (2024)
por: Ge, Yuying, et al.
Publicado: (2024)
Foveated Diffusion: Efficient Spatially Adaptive Image and Video Generation
por: Chao, Brian, et al.
Publicado: (2026)
por: Chao, Brian, et al.
Publicado: (2026)
Video In-context Learning: Autoregressive Transformers are Zero-Shot Video Imitators
por: Zhang, Wentao, et al.
Publicado: (2024)
por: Zhang, Wentao, et al.
Publicado: (2024)
Efficient Autoregressive Shape Generation via Octree-Based Adaptive Tokenization
por: Deng, Kangle, et al.
Publicado: (2025)
por: Deng, Kangle, et al.
Publicado: (2025)
SuperVoxelGPT: Adaptive and Ordered 3D Tokenization for Autoregressive Shape Generation
por: Li, Yuan, et al.
Publicado: (2026)
por: Li, Yuan, et al.
Publicado: (2026)
360DVD: Controllable Panorama Video Generation with 360-Degree Video Diffusion Model
por: Wang, Qian, et al.
Publicado: (2024)
por: Wang, Qian, et al.
Publicado: (2024)
Ejemplares similares
-
ViD-GPT: Introducing GPT-style Autoregressive Generation in Video Diffusion Models
por: Gao, Kaifeng, et al.
Publicado: (2024) -
Ca2-VDM: Efficient Autoregressive Video Diffusion Model with Causal Generation and Cache Sharing
por: Gao, Kaifeng, et al.
Publicado: (2024) -
EVATok: Adaptive Length Video Tokenization for Efficient Visual Autoregressive Generation
por: Xiong, Tianwei, et al.
Publicado: (2026) -
DiCoDe: Diffusion-Compressed Deep Tokens for Autoregressive Video Generation with Language Models
por: Li, Yizhuo, et al.
Publicado: (2024) -
VideoMAR: Autoregressive Video Generatio with Continuous Tokens
por: Yu, Hu, et al.
Publicado: (2025)