Autoregression-free video prediction using diffusion model for mitigating error propagation
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ko, Woonho, Park, Jin Bok, Chun, Il Yong |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
SToRM: Supervised Token Reduction for Multi-modal LLMs toward efficient end-to-end autonomous driving
par: Kim, Seo Hyun, et autres
Publié: (2026)
par: Kim, Seo Hyun, et autres
Publié: (2026)
Bias mitigation in graph diffusion models
par: Yu, Meng, et autres
Publié: (2026)
par: Yu, Meng, et autres
Publié: (2026)
MVOC: a training-free multiple video object composition method with diffusion models
par: Wang, Wei, et autres
Publié: (2024)
par: Wang, Wei, et autres
Publié: (2024)
Towards motion from video diffusion models
par: Janson, Paul, et autres
Publié: (2024)
par: Janson, Paul, et autres
Publié: (2024)
MAMS: Model-Agnostic Module Selection Framework for Video Captioning
par: Lee, Sangho, et autres
Publié: (2025)
par: Lee, Sangho, et autres
Publié: (2025)
Invertible generative models for inverse problems: mitigating representation error and dataset bias
par: Asim, Muhammad, et autres
Publié: (2019)
par: Asim, Muhammad, et autres
Publié: (2019)
MoTDiff: High-resolution Motion Trajectory estimation from a single blurred image using Diffusion models
par: Choi, Wontae, et autres
Publié: (2025)
par: Choi, Wontae, et autres
Publié: (2025)
DiTraj: training-free trajectory control for video diffusion transformer
par: Lei, Cheng, et autres
Publié: (2025)
par: Lei, Cheng, et autres
Publié: (2025)
Improving Neural Radiance Field using Near-Surface Sampling with Point Cloud Generation
par: Yoo, Hye Bin, et autres
Publié: (2023)
par: Yoo, Hye Bin, et autres
Publié: (2023)
LaB-CL: Localized and Balanced Contrastive Learning for improving parking slot detection
par: Jeong, U Jin, et autres
Publié: (2024)
par: Jeong, U Jin, et autres
Publié: (2024)
Training-free image inversion for one-step diffusion models
par: Wu, Tao, et autres
Publié: (2026)
par: Wu, Tao, et autres
Publié: (2026)
Partial train and isolate, mitigate backdoor attack
par: Li, Yong, et autres
Publié: (2024)
par: Li, Yong, et autres
Publié: (2024)
AI killed the video star. Audio-driven diffusion model for expressive talking head generation
par: Chopin, Baptiste, et autres
Publié: (2025)
par: Chopin, Baptiste, et autres
Publié: (2025)
Equilibrium contrastive learning for imbalanced image classification
par: Roh, Sumin, et autres
Publié: (2026)
par: Roh, Sumin, et autres
Publié: (2026)
Do text-free diffusion models learn discriminative visual representations?
par: Mukhopadhyay, Soumik, et autres
Publié: (2023)
par: Mukhopadhyay, Soumik, et autres
Publié: (2023)
Action-conditioned video data improves predictability
par: Sarkar, Meenakshi, et autres
Publié: (2024)
par: Sarkar, Meenakshi, et autres
Publié: (2024)
ETC: training-free diffusion models acceleration with Error-aware Trend Consistency
par: Xie, Jiajian, et autres
Publié: (2025)
par: Xie, Jiajian, et autres
Publié: (2025)
Grouped Speculative Decoding for Autoregressive Image Generation
par: So, Junhyuk, et autres
Publié: (2025)
par: So, Junhyuk, et autres
Publié: (2025)
Don't Pause! Every prediction matters in a streaming video
par: Chatterjee, Dibyadip, et autres
Publié: (2026)
par: Chatterjee, Dibyadip, et autres
Publié: (2026)
Train Short, Inference Long: Training-free Horizon Extension for Autoregressive Video Generation
par: Li, Jia, et autres
Publié: (2026)
par: Li, Jia, et autres
Publié: (2026)
NCAP: Scene Text Image Super-Resolution with Non-CAtegorical Prior
par: Park, Dongwoo, et autres
Publié: (2025)
par: Park, Dongwoo, et autres
Publié: (2025)
Bringing CLIP to the Clinic: Dynamic Soft Labels and Negation-Aware Learning for Medical Analysis
par: Ko, Hanbin, et autres
Publié: (2025)
par: Ko, Hanbin, et autres
Publié: (2025)
Label-free prediction of fluorescence markers in bovine satellite cells using deep learning
par: Sinha, Sania, et autres
Publié: (2024)
par: Sinha, Sania, et autres
Publié: (2024)
SMGDiff: Soccer Motion Generation using diffusion probabilistic models
par: Yang, Hongdi, et autres
Publié: (2024)
par: Yang, Hongdi, et autres
Publié: (2024)
Future Forcing: Future-aware Training-free KV Cache Policy for Autoregressive Video Generation
par: Luo, Jiayi, et autres
Publié: (2026)
par: Luo, Jiayi, et autres
Publié: (2026)
Perceive, Understand and Restore: Real-World Image Super-Resolution with Autoregressive Multimodal Generative Models
par: Wei, Hongyang, et autres
Publié: (2025)
par: Wei, Hongyang, et autres
Publié: (2025)
Next-Scale Autoregressive Models for Text-to-Motion Generation
par: Zheng, Zhiwei, et autres
Publié: (2026)
par: Zheng, Zhiwei, et autres
Publié: (2026)
MARRS: Masked Autoregressive Unit-based Reaction Synthesis
par: Wang, Yabiao, et autres
Publié: (2025)
par: Wang, Yabiao, et autres
Publié: (2025)
Exploiting temporal information to detect conversational groups in videos and predict the next speaker
par: Tosato, Lucrezia, et autres
Publié: (2024)
par: Tosato, Lucrezia, et autres
Publié: (2024)
Hybrid-TTA: Continual Test-time Adaptation via Dynamic Domain Shift Detection
par: Park, Hyewon, et autres
Publié: (2024)
par: Park, Hyewon, et autres
Publié: (2024)
HCF: Hierarchical Cascade Framework for Distributed Multi-Stage Image Compression
par: Cai, Junhao, et autres
Publié: (2025)
par: Cai, Junhao, et autres
Publié: (2025)
Learning dissection trajectories from expert surgical videos via imitation learning with equivariant diffusion
par: Wang, Hongyu, et autres
Publié: (2025)
par: Wang, Hongyu, et autres
Publié: (2025)
MoSa: Motion Generation with Scalable Autoregressive Modeling
par: Liu, Mengyuan, et autres
Publié: (2025)
par: Liu, Mengyuan, et autres
Publié: (2025)
Designing streetscapes from street-view imagery using diffusion models
par: Chen, Yuzhou, et autres
Publié: (2026)
par: Chen, Yuzhou, et autres
Publié: (2026)
Speculative Coupled Decoding for Training-Free Lossless Acceleration of Autoregressive Visual Generation
par: So, Junhyuk, et autres
Publié: (2025)
par: So, Junhyuk, et autres
Publié: (2025)
Autoregressive Sign Language Production: A Gloss-Free Approach with Discrete Representations
par: Hwang, Eui Jun, et autres
Publié: (2023)
par: Hwang, Eui Jun, et autres
Publié: (2023)
CAR: Controllable Autoregressive Modeling for Visual Generation
par: Yao, Ziyu, et autres
Publié: (2024)
par: Yao, Ziyu, et autres
Publié: (2024)
A Training-Free Style-aligned Image Generation with Scale-wise Autoregressive Model
par: Park, Jihun, et autres
Publié: (2025)
par: Park, Jihun, et autres
Publié: (2025)
DiverseVAR: Balancing Diversity and Quality of Next-Scale Visual Autoregressive Models
par: Park, Mingue, et autres
Publié: (2025)
par: Park, Mingue, et autres
Publié: (2025)
Marrying Autoregressive Transformer and Diffusion with Multi-Reference Autoregression
par: Zhen, Dingcheng, et autres
Publié: (2025)
par: Zhen, Dingcheng, et autres
Publié: (2025)
Documents similaires
-
SToRM: Supervised Token Reduction for Multi-modal LLMs toward efficient end-to-end autonomous driving
par: Kim, Seo Hyun, et autres
Publié: (2026) -
Bias mitigation in graph diffusion models
par: Yu, Meng, et autres
Publié: (2026) -
MVOC: a training-free multiple video object composition method with diffusion models
par: Wang, Wei, et autres
Publié: (2024) -
Towards motion from video diffusion models
par: Janson, Paul, et autres
Publié: (2024) -
MAMS: Model-Agnostic Module Selection Framework for Video Captioning
par: Lee, Sangho, et autres
Publié: (2025)