Grounded Forcing: Bridging Time-Independent Semantics and Proximal Dynamics in Autoregressive Video Synthesis
Fuente:
arXiv
Guardado en:
| Autores principales: | Chen, Jintao, Bai, Chengyu, Hu, Junjun, Xue, Xinda, Xu, Mu |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
AstraNav-World: World Model for Foresight Control and Consistency
por: Chen, Jintao, et al.
Publicado: (2025)
por: Chen, Jintao, et al.
Publicado: (2025)
Rolling Forcing: Autoregressive Long Video Diffusion in Real Time
por: Liu, Kunhao, et al.
Publicado: (2025)
por: Liu, Kunhao, et al.
Publicado: (2025)
Speculative Decoding for Autoregressive Video Generation
por: Hu, Yuezhou, et al.
Publicado: (2026)
por: Hu, Yuezhou, et al.
Publicado: (2026)
BridgeIV: Bridging Customized Image and Video Generation through Test-Time Autoregressive Identity Propagation
por: Hu, Panwen, et al.
Publicado: (2025)
por: Hu, Panwen, et al.
Publicado: (2025)
Reward-Forcing: Autoregressive Video Generation with Reward Feedback
por: Zhang, Jingran, et al.
Publicado: (2026)
por: Zhang, Jingran, et al.
Publicado: (2026)
Context Forcing: Consistent Autoregressive Video Generation with Long Context
por: Chen, Shuo, et al.
Publicado: (2026)
por: Chen, Shuo, et al.
Publicado: (2026)
Taming Teacher Forcing for Masked Autoregressive Video Generation
por: Zhou, Deyu, et al.
Publicado: (2025)
por: Zhou, Deyu, et al.
Publicado: (2025)
Weakly-Supervised Affordance Grounding Guided by Part-Level Semantic Priors
por: Xu, Peiran, et al.
Publicado: (2025)
por: Xu, Peiran, et al.
Publicado: (2025)
Future Forcing: Future-aware Training-free KV Cache Policy for Autoregressive Video Generation
por: Luo, Jiayi, et al.
Publicado: (2026)
por: Luo, Jiayi, et al.
Publicado: (2026)
Self Forcing: Bridging the Train-Test Gap in Autoregressive Video Diffusion
por: Huang, Xun, et al.
Publicado: (2025)
por: Huang, Xun, et al.
Publicado: (2025)
Causal Forcing++: Scalable Few-Step Autoregressive Diffusion Distillation for Real-Time Interactive Video Generation
por: Zhao, Min, et al.
Publicado: (2026)
por: Zhao, Min, et al.
Publicado: (2026)
UniEdit-I: Training-free Image Editing for Unified VLM via Iterative Understanding, Editing and Verifying
por: Bai, Chengyu, et al.
Publicado: (2025)
por: Bai, Chengyu, et al.
Publicado: (2025)
SGANet: Semantic and Geometric Alignment for Multimodal Multi-view Anomaly Detection
por: Bai, Letian, et al.
Publicado: (2026)
por: Bai, Letian, et al.
Publicado: (2026)
Bridging Time and Space: Decoupled Spatio-Temporal Alignment for Video Grounding
por: Tu, Xuezhen, et al.
Publicado: (2026)
por: Tu, Xuezhen, et al.
Publicado: (2026)
Light Forcing: Accelerating Autoregressive Video Diffusion via Sparse Attention
por: Lv, Chengtao, et al.
Publicado: (2026)
por: Lv, Chengtao, et al.
Publicado: (2026)
Semantic Context Matters: Improving Conditioning for Autoregressive Models
por: Jin, Dongyang, et al.
Publicado: (2025)
por: Jin, Dongyang, et al.
Publicado: (2025)
TimeExpert: An Expert-Guided Video LLM for Video Temporal Grounding
por: Yang, Zuhao, et al.
Publicado: (2025)
por: Yang, Zuhao, et al.
Publicado: (2025)
Rethinking Autoregressive Models for Lossless Image Compression via Hierarchical Parallelism and Progressive Adaptation
por: Li, Daxin, et al.
Publicado: (2025)
por: Li, Daxin, et al.
Publicado: (2025)
Delta Forcing: Trust Region Steering for Interactive Autoregressive Video Generation
por: Wu, Yuheng, et al.
Publicado: (2026)
por: Wu, Yuheng, et al.
Publicado: (2026)
Learning from Next-Frame Prediction: Autoregressive Video Modeling Encodes Effective Representations
por: Li, Jinghan, et al.
Publicado: (2025)
por: Li, Jinghan, et al.
Publicado: (2025)
SnAG: Scalable and Accurate Video Grounding
por: Mu, Fangzhou, et al.
Publicado: (2024)
por: Mu, Fangzhou, et al.
Publicado: (2024)
Forcing-KV: Hybrid KV Cache Compression for Efficient Autoregressive Video Diffusion Models
por: Ji, Yicheng, et al.
Publicado: (2026)
por: Ji, Yicheng, et al.
Publicado: (2026)
FastInit: Fast Noise Initialization for Temporally Consistent Video Generation
por: Bai, Chengyu, et al.
Publicado: (2025)
por: Bai, Chengyu, et al.
Publicado: (2025)
Controllable Longer Image Animation with Diffusion Models
por: Wang, Qiang, et al.
Publicado: (2024)
por: Wang, Qiang, et al.
Publicado: (2024)
Motion Forcing: A Decoupled Framework for Robust Video Generation in Motion Dynamics
por: Xu, Tianshuo, et al.
Publicado: (2026)
por: Xu, Tianshuo, et al.
Publicado: (2026)
KVPO: ODE-Native GRPO for Autoregressive Video Alignment via KV Semantic Exploration
por: Zhang, Ruicheng, et al.
Publicado: (2026)
por: Zhang, Ruicheng, et al.
Publicado: (2026)
Real-Time Motion-Controllable Autoregressive Video Diffusion
por: Zhao, Kesen, et al.
Publicado: (2025)
por: Zhao, Kesen, et al.
Publicado: (2025)
Encapsulated Composition of Text-to-Image and Text-to-Video Models for High-Quality Video Synthesis
por: Su, Tongtong, et al.
Publicado: (2025)
por: Su, Tongtong, et al.
Publicado: (2025)
One-Forcing: Towards Stable One-Step Autoregressive Video Generation
por: Feng, Jiaqi, et al.
Publicado: (2026)
por: Feng, Jiaqi, et al.
Publicado: (2026)
Head Forcing: Long Autoregressive Video Generation via Head Heterogeneity
por: Tian, Jiahao, et al.
Publicado: (2026)
por: Tian, Jiahao, et al.
Publicado: (2026)
SwimBird: Eliciting Switchable Reasoning Mode in Hybrid Autoregressive MLLMs
por: Tong, Jintao, et al.
Publicado: (2026)
por: Tong, Jintao, et al.
Publicado: (2026)
Knot Forcing: Taming Autoregressive Video Diffusion Models for Real-time Infinite Interactive Portrait Animation
por: Xiao, Steven, et al.
Publicado: (2025)
por: Xiao, Steven, et al.
Publicado: (2025)
FastSTAR: Spatiotemporal Token Pruning for Efficient Autoregressive Video Synthesis
por: Yune, Sungwoong, et al.
Publicado: (2026)
por: Yune, Sungwoong, et al.
Publicado: (2026)
Pathwise Test-Time Correction for Autoregressive Long Video Generation
por: Xiang, Xunzhi, et al.
Publicado: (2026)
por: Xiang, Xunzhi, et al.
Publicado: (2026)
DiT as Real-Time Rerenderer: Streaming Video Stylization with Autoregressive Diffusion Transformer
por: Lyu, Hengye, et al.
Publicado: (2026)
por: Lyu, Hengye, et al.
Publicado: (2026)
StreamKV: Streaming Video Question-Answering with Segment-based KV Cache Retrieval and Compression
por: Chen, Yilong, et al.
Publicado: (2025)
por: Chen, Yilong, et al.
Publicado: (2025)
Past- and Future-Informed KV Cache Policy with Salience Estimation in Autoregressive Video Diffusion
por: Chen, Hanmo, et al.
Publicado: (2026)
por: Chen, Hanmo, et al.
Publicado: (2026)
Capturing Rich Behavior Representations: A Dynamic Action Semantic-Aware Graph Transformer for Video Captioning
por: Liu, Caihua, et al.
Publicado: (2025)
por: Liu, Caihua, et al.
Publicado: (2025)
Rolling Sink: Bridging Limited-Horizon Training and Open-Ended Testing in Autoregressive Video Diffusion
por: Li, Haodong, et al.
Publicado: (2026)
por: Li, Haodong, et al.
Publicado: (2026)
CausalCine: Real-Time Autoregressive Generation for Multi-Shot Video Narratives
por: Meng, Yihao, et al.
Publicado: (2026)
por: Meng, Yihao, et al.
Publicado: (2026)
Ejemplares similares
-
AstraNav-World: World Model for Foresight Control and Consistency
por: Chen, Jintao, et al.
Publicado: (2025) -
Rolling Forcing: Autoregressive Long Video Diffusion in Real Time
por: Liu, Kunhao, et al.
Publicado: (2025) -
Speculative Decoding for Autoregressive Video Generation
por: Hu, Yuezhou, et al.
Publicado: (2026) -
BridgeIV: Bridging Customized Image and Video Generation through Test-Time Autoregressive Identity Propagation
por: Hu, Panwen, et al.
Publicado: (2025) -
Reward-Forcing: Autoregressive Video Generation with Reward Feedback
por: Zhang, Jingran, et al.
Publicado: (2026)