Flow caching for autoregressive video generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Ma, Yuexiao, Zheng, Xuzhe, Xu, Jing, Xu, Xiwei, Ling, Feng, Zheng, Xiawu, Kuang, Huafeng, Li, Huixia, Wang, Xing, Xiao, Xuefeng, Chao, Fei, Ji, Rongrong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
HASTE: Training-Free Video Diffusion Acceleration via Head-Wise Adaptive Sparse Attention
di: Zheng, Xuzhe, et al.
Pubblicazione: (2026)
di: Zheng, Xuzhe, et al.
Pubblicazione: (2026)
Polybasic Speculative Decoding Through a Theoretical Perspective
di: Wang, Ruilin, et al.
Pubblicazione: (2025)
di: Wang, Ruilin, et al.
Pubblicazione: (2025)
AffineQuant: Affine Transformation Quantization for Large Language Models
di: Ma, Yuexiao, et al.
Pubblicazione: (2024)
di: Ma, Yuexiao, et al.
Pubblicazione: (2024)
Motion-Aware Caching for Efficient Autoregressive Video Generation
di: Xu, Jing, et al.
Pubblicazione: (2026)
di: Xu, Jing, et al.
Pubblicazione: (2026)
A2RBench: An Automatic Paradigm for Formally Verifiable Abstract Reasoning Benchmark Generation
di: Ma, Qingchuan, et al.
Pubblicazione: (2026)
di: Ma, Qingchuan, et al.
Pubblicazione: (2026)
ALGOGEN: Tool-Generated Verifiable Traces for Reliable Algorithm Visualization
di: Liao, Kunpeng, et al.
Pubblicazione: (2026)
di: Liao, Kunpeng, et al.
Pubblicazione: (2026)
OMPQ: Orthogonal Mixed Precision Quantization
di: Ma, Yuexiao, et al.
Pubblicazione: (2021)
di: Ma, Yuexiao, et al.
Pubblicazione: (2021)
Towards Efficient Automatic Self-Pruning of Large Language Models
di: Huang, Weizhong, et al.
Pubblicazione: (2025)
di: Huang, Weizhong, et al.
Pubblicazione: (2025)
Determining Layer-wise Sparsity for Large Language Models Through a Theoretical Perspective
di: Huang, Weizhong, et al.
Pubblicazione: (2025)
di: Huang, Weizhong, et al.
Pubblicazione: (2025)
Training-Free Multimodal Large Language Model Orchestration
di: Xie, Tianyu, et al.
Pubblicazione: (2025)
di: Xie, Tianyu, et al.
Pubblicazione: (2025)
Benchmarking Abstract and Reasoning Abilities Through A Theoretical Perspective
di: Ma, Qingchuan, et al.
Pubblicazione: (2025)
di: Ma, Qingchuan, et al.
Pubblicazione: (2025)
An Information Theory-inspired Strategy for Automatic Network Pruning
di: Zheng, Xiawu, et al.
Pubblicazione: (2021)
di: Zheng, Xiawu, et al.
Pubblicazione: (2021)
Uncovering the Over-smoothing Challenge in Image Super-Resolution: Entropy-based Quantification and Contrastive Optimization
di: Xu, Tianshuo, et al.
Pubblicazione: (2022)
di: Xu, Tianshuo, et al.
Pubblicazione: (2022)
MCP-Zero: Active Tool Discovery for Autonomous LLM Agents
di: Fei, Xiang, et al.
Pubblicazione: (2025)
di: Fei, Xiang, et al.
Pubblicazione: (2025)
An experimental study of KV cache reuse strategies in chunk-level caching systems
di: Cestola, Samuel, et al.
Pubblicazione: (2026)
di: Cestola, Samuel, et al.
Pubblicazione: (2026)
EBFT: Effective and Block-Wise Fine-Tuning for Sparse LLMs
di: Guo, Song, et al.
Pubblicazione: (2024)
di: Guo, Song, et al.
Pubblicazione: (2024)
Event-Anchored Frame Selection for Effective Long-Video Understanding
di: Chen, Wang, et al.
Pubblicazione: (2026)
di: Chen, Wang, et al.
Pubblicazione: (2026)
Multi-branch Collaborative Learning Network for 3D Visual Grounding
di: Qian, Zhipeng, et al.
Pubblicazione: (2024)
di: Qian, Zhipeng, et al.
Pubblicazione: (2024)
Dynamic Low-Rank Sparse Adaptation for Large Language Models
di: Huang, Weizhong, et al.
Pubblicazione: (2025)
di: Huang, Weizhong, et al.
Pubblicazione: (2025)
SocialOmni: Benchmarking Audio-Visual Social Interactivity in Omni Models
di: Xie, Tianyu, et al.
Pubblicazione: (2026)
di: Xie, Tianyu, et al.
Pubblicazione: (2026)
Hyper-Bagel: A Unified Acceleration Framework for Multimodal Understanding and Generation
di: Lu, Yanzuo, et al.
Pubblicazione: (2025)
di: Lu, Yanzuo, et al.
Pubblicazione: (2025)
SpecEyes: Accelerating Agentic Multimodal LLMs via Speculative Perception and Planning
di: Huang, Haoyu, et al.
Pubblicazione: (2026)
di: Huang, Haoyu, et al.
Pubblicazione: (2026)
Feast Your Eyes: Mixture-of-Resolution Adaptation for Multimodal Large Language Models
di: Luo, Gen, et al.
Pubblicazione: (2024)
di: Luo, Gen, et al.
Pubblicazione: (2024)
Depth-Guided Semi-Supervised Instance Segmentation
di: Chen, Xin, et al.
Pubblicazione: (2024)
di: Chen, Xin, et al.
Pubblicazione: (2024)
Rethinking 3D Dense Caption and Visual Grounding in A Unified Framework through Prompt-based Localization
di: Luo, Yongdong, et al.
Pubblicazione: (2024)
di: Luo, Yongdong, et al.
Pubblicazione: (2024)
VEGA: Learning Interleaved Image-Text Comprehension in Vision-Language Large Models
di: Zhou, Chenyu, et al.
Pubblicazione: (2024)
di: Zhou, Chenyu, et al.
Pubblicazione: (2024)
StealthDiffusion: Towards Evading Diffusion Forensic Detection through Diffusion Model
di: Zhou, Ziyin, et al.
Pubblicazione: (2024)
di: Zhou, Ziyin, et al.
Pubblicazione: (2024)
3D representation in 512-Byte:Variational tokenizer is the key for autoregressive 3D generation
di: Zhang, Jinzhi, et al.
Pubblicazione: (2024)
di: Zhang, Jinzhi, et al.
Pubblicazione: (2024)
Video-RAG: Visually-aligned Retrieval-Augmented Long Video Comprehension
di: Luo, Yongdong, et al.
Pubblicazione: (2024)
di: Luo, Yongdong, et al.
Pubblicazione: (2024)
Growth of finitely generated subgroups of the topological full groups of inverse semigroups of bounded type
di: Kuang, Zheng
Pubblicazione: (2024)
di: Kuang, Zheng
Pubblicazione: (2024)
New optimal trade-off point for coded caching systems with limited cache size
di: Ma, Yinbin, et al.
Pubblicazione: (2023)
di: Ma, Yinbin, et al.
Pubblicazione: (2023)
Q-DeepSight: Incentivizing Thinking with Images for Image Quality Assessment and Refinement
di: Li, Xudong, et al.
Pubblicazione: (2026)
di: Li, Xudong, et al.
Pubblicazione: (2026)
Unified-Width Adaptive Dynamic Network for All-In-One Image Restoration
di: Xu, Yimin, et al.
Pubblicazione: (2024)
di: Xu, Yimin, et al.
Pubblicazione: (2024)
Zooming from Context to Cue: Hierarchical Preference Optimization for Multi-Image MLLMs
di: Li, Xudong, et al.
Pubblicazione: (2025)
di: Li, Xudong, et al.
Pubblicazione: (2025)
UI-AGILE: Advancing GUI Agents with Effective Reinforcement Learning and Precise Inference-Time Grounding
di: Lian, Shuquan, et al.
Pubblicazione: (2025)
di: Lian, Shuquan, et al.
Pubblicazione: (2025)
Instance Brownian Bridge as Texts for Open-vocabulary Video Instance Segmentation
di: Cheng, Zesen, et al.
Pubblicazione: (2024)
di: Cheng, Zesen, et al.
Pubblicazione: (2024)
Few-Shot Image Quality Assessment via Adaptation of Vision-Language Models
di: Li, Xudong, et al.
Pubblicazione: (2024)
di: Li, Xudong, et al.
Pubblicazione: (2024)
ControlNet++: Improving Conditional Controls with Efficient Consistency Feedback
di: Li, Ming, et al.
Pubblicazione: (2024)
di: Li, Ming, et al.
Pubblicazione: (2024)
Machine Learning Assisted Design of mmWave Wireless Transceiver Circuits
di: Zhao, Xuzhe
Pubblicazione: (2024)
di: Zhao, Xuzhe
Pubblicazione: (2024)
Spiking Graph Predictive Coding for Reliable OOD Generalization
di: Ren, Jing, et al.
Pubblicazione: (2026)
di: Ren, Jing, et al.
Pubblicazione: (2026)
Documenti analoghi
-
HASTE: Training-Free Video Diffusion Acceleration via Head-Wise Adaptive Sparse Attention
di: Zheng, Xuzhe, et al.
Pubblicazione: (2026) -
Polybasic Speculative Decoding Through a Theoretical Perspective
di: Wang, Ruilin, et al.
Pubblicazione: (2025) -
AffineQuant: Affine Transformation Quantization for Large Language Models
di: Ma, Yuexiao, et al.
Pubblicazione: (2024) -
Motion-Aware Caching for Efficient Autoregressive Video Generation
di: Xu, Jing, et al.
Pubblicazione: (2026) -
A2RBench: An Automatic Paradigm for Formally Verifiable Abstract Reasoning Benchmark Generation
di: Ma, Qingchuan, et al.
Pubblicazione: (2026)