MonarchRT: Efficient Attention for Real-Time Video Generation
Fuente:
arXiv
Salvato in:
| Autori principali: | Agarwal, Krish, Chen, Zhuoming, Luo, Cheng, Chen, Yongqi, Zheng, Haizhong, Huang, Xun, Rudra, Atri, Chen, Beidi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DiffVC-RT: Towards Practical Real-Time Diffusion-based Perceptual Neural Video Compression
di: Ma, Wenzhuo, et al.
Pubblicazione: (2026)
di: Ma, Wenzhuo, et al.
Pubblicazione: (2026)
RAPTOR: Real-Time High-Resolution UAV Video Prediction with Efficient Video Attention
di: Chen, Zhan, et al.
Pubblicazione: (2025)
di: Chen, Zhan, et al.
Pubblicazione: (2025)
Fast Video Generation with Sliding Tile Attention
di: Zhang, Peiyuan, et al.
Pubblicazione: (2025)
di: Zhang, Peiyuan, et al.
Pubblicazione: (2025)
Input-Aware Sparse Attention for Real-Time Co-Speech Video Generation
di: Lu, Beijia, et al.
Pubblicazione: (2025)
di: Lu, Beijia, et al.
Pubblicazione: (2025)
Kinetics: Rethinking Test-Time Scaling Laws
di: Sadhukhan, Ranajoy, et al.
Pubblicazione: (2025)
di: Sadhukhan, Ranajoy, et al.
Pubblicazione: (2025)
CAT Pruning: Cluster-Aware Token Pruning For Text-to-Image Diffusion Models
di: Cheng, Xinle, et al.
Pubblicazione: (2025)
di: Cheng, Xinle, et al.
Pubblicazione: (2025)
Jackpot: Optimal Budgeted Rejection Sampling for Extreme Actor-Policy Mismatch Reinforcement Learning
di: Chen, Zhuoming, et al.
Pubblicazione: (2026)
di: Chen, Zhuoming, et al.
Pubblicazione: (2026)
MagicTime: Time-lapse Video Generation Models as Metamorphic Simulators
di: Yuan, Shenghai, et al.
Pubblicazione: (2024)
di: Yuan, Shenghai, et al.
Pubblicazione: (2024)
VSA: Faster Video Diffusion with Trainable Sparse Attention
di: Zhang, Peiyuan, et al.
Pubblicazione: (2025)
di: Zhang, Peiyuan, et al.
Pubblicazione: (2025)
NGP-RT: Fusing Multi-Level Hash Features with Lightweight Attention for Real-Time Novel View Synthesis
di: Hu, Yubin, et al.
Pubblicazione: (2024)
di: Hu, Yubin, et al.
Pubblicazione: (2024)
Interspatial Attention for Efficient 4D Human Video Generation
di: Shao, Ruizhi, et al.
Pubblicazione: (2025)
di: Shao, Ruizhi, et al.
Pubblicazione: (2025)
RealCam: Real-Time Novel-View Video Generation with Interactive Camera Control
di: Xu, Youcan, et al.
Pubblicazione: (2026)
di: Xu, Youcan, et al.
Pubblicazione: (2026)
StreamingEffect: Real-Time Human-Centric Video Effect Generation
di: Song, Yiren, et al.
Pubblicazione: (2026)
di: Song, Yiren, et al.
Pubblicazione: (2026)
RT-DETRv4: Painlessly Furthering Real-Time Object Detection with Vision Foundation Models
di: Liao, Zijun, et al.
Pubblicazione: (2025)
di: Liao, Zijun, et al.
Pubblicazione: (2025)
ThermoStereoRT: Thermal Stereo Matching in Real Time via Knowledge Distillation and Attention-based Refinement
di: Hu, Anning, et al.
Pubblicazione: (2025)
di: Hu, Anning, et al.
Pubblicazione: (2025)
MotionStream: Real-Time Video Generation with Interactive Motion Controls
di: Shin, Joonghyuk, et al.
Pubblicazione: (2025)
di: Shin, Joonghyuk, et al.
Pubblicazione: (2025)
Automating Catheterization Labs with Real-Time Perception
di: Yang, Fan, et al.
Pubblicazione: (2024)
di: Yang, Fan, et al.
Pubblicazione: (2024)
RT-DETRv2: Improved Baseline with Bag-of-Freebies for Real-Time Detection Transformer
di: Lv, Wenyu, et al.
Pubblicazione: (2024)
di: Lv, Wenyu, et al.
Pubblicazione: (2024)
REACT++: Efficient Cross-Attention for Real-Time Scene Graph Generation
di: Neau, Maëlic, et al.
Pubblicazione: (2026)
di: Neau, Maëlic, et al.
Pubblicazione: (2026)
Real-Time Video Generation with Pyramid Attention Broadcast
di: Zhao, Xuanlei, et al.
Pubblicazione: (2024)
di: Zhao, Xuanlei, et al.
Pubblicazione: (2024)
Helios: Real Real-Time Long Video Generation Model
di: Yuan, Shenghai, et al.
Pubblicazione: (2026)
di: Yuan, Shenghai, et al.
Pubblicazione: (2026)
On the Surprising Effectiveness of Attention Transfer for Vision Transformers
di: Li, Alexander C., et al.
Pubblicazione: (2024)
di: Li, Alexander C., et al.
Pubblicazione: (2024)
Attention Sparsity is Input-Stable: Training-Free Sparse Attention for Video Generation via Offline Sparsity Profiling and Online QK Co-Clustering
di: Luo, Jiayi, et al.
Pubblicazione: (2026)
di: Luo, Jiayi, et al.
Pubblicazione: (2026)
Real-Time 3D Occupancy Prediction via Geometric-Semantic Disentanglement
di: He, Yulin, et al.
Pubblicazione: (2024)
di: He, Yulin, et al.
Pubblicazione: (2024)
Rectified SpaAttn: Revisiting Attention Sparsity for Efficient Video Generation
di: Liu, Xuewen, et al.
Pubblicazione: (2025)
di: Liu, Xuewen, et al.
Pubblicazione: (2025)
VMonarch: Efficient Video Diffusion Transformers with Structured Attention
di: Liang, Cheng, et al.
Pubblicazione: (2026)
di: Liang, Cheng, et al.
Pubblicazione: (2026)
BEVANet: Bilateral Efficient Visual Attention Network for Real-Time Semantic Segmentation
di: Huang, Ping-Mao, et al.
Pubblicazione: (2025)
di: Huang, Ping-Mao, et al.
Pubblicazione: (2025)
ChronoMagic-Bench: A Benchmark for Metamorphic Evaluation of Text-to-Time-lapse Video Generation
di: Yuan, Shenghai, et al.
Pubblicazione: (2024)
di: Yuan, Shenghai, et al.
Pubblicazione: (2024)
MoST: Efficient Monarch Sparse Tuning for 3D Representation Learning
di: Han, Xu, et al.
Pubblicazione: (2025)
di: Han, Xu, et al.
Pubblicazione: (2025)
RT-LA-VocE: Real-Time Low-SNR Audio-Visual Speech Enhancement
di: Chen, Honglie, et al.
Pubblicazione: (2024)
di: Chen, Honglie, et al.
Pubblicazione: (2024)
RT-Focuser: A Real-Time Lightweight Model for Edge-side Image Deblurring
di: Wu, Zhuoyu, et al.
Pubblicazione: (2025)
di: Wu, Zhuoyu, et al.
Pubblicazione: (2025)
RealWonder: Real-Time Physical Action-Conditioned Video Generation
di: Liu, Wei, et al.
Pubblicazione: (2026)
di: Liu, Wei, et al.
Pubblicazione: (2026)
MixRT: Mixed Neural Representations For Real-Time NeRF Rendering
di: Li, Chaojian, et al.
Pubblicazione: (2023)
di: Li, Chaojian, et al.
Pubblicazione: (2023)
Prompt Relay: Inference-Time Temporal Control for Multi-Event Video Generation
di: Chen, Gordon, et al.
Pubblicazione: (2026)
di: Chen, Gordon, et al.
Pubblicazione: (2026)
CausalCine: Real-Time Autoregressive Generation for Multi-Shot Video Narratives
di: Meng, Yihao, et al.
Pubblicazione: (2026)
di: Meng, Yihao, et al.
Pubblicazione: (2026)
Cerberus: Real-Time Video Anomaly Detection via Cascaded Vision-Language Models
di: Zheng, Yue, et al.
Pubblicazione: (2025)
di: Zheng, Yue, et al.
Pubblicazione: (2025)
RTGen: Real-Time Generative Detection Transformer
di: Ruan, Chi, et al.
Pubblicazione: (2025)
di: Ruan, Chi, et al.
Pubblicazione: (2025)
LongLive: Real-time Interactive Long Video Generation
di: Yang, Shuai, et al.
Pubblicazione: (2025)
di: Yang, Shuai, et al.
Pubblicazione: (2025)
Generative Recall, Dense Reranking: Learning Multi-View Semantic IDs for Efficient Text-to-Video Retrieval
di: Zhao, Zecheng, et al.
Pubblicazione: (2026)
di: Zhao, Zecheng, et al.
Pubblicazione: (2026)
VRAG: Learning World Models for Interactive Video Generation
di: Chen, Taiye, et al.
Pubblicazione: (2025)
di: Chen, Taiye, et al.
Pubblicazione: (2025)
Documenti analoghi
-
DiffVC-RT: Towards Practical Real-Time Diffusion-based Perceptual Neural Video Compression
di: Ma, Wenzhuo, et al.
Pubblicazione: (2026) -
RAPTOR: Real-Time High-Resolution UAV Video Prediction with Efficient Video Attention
di: Chen, Zhan, et al.
Pubblicazione: (2025) -
Fast Video Generation with Sliding Tile Attention
di: Zhang, Peiyuan, et al.
Pubblicazione: (2025) -
Input-Aware Sparse Attention for Real-Time Co-Speech Video Generation
di: Lu, Beijia, et al.
Pubblicazione: (2025) -
Kinetics: Rethinking Test-Time Scaling Laws
di: Sadhukhan, Ranajoy, et al.
Pubblicazione: (2025)