Enregistré dans:
| Auteurs principaux: | Chen, Siqi, Hong, Ke, Zhao, Tianchen, Xie, Ruiqi, Zhu, Zhenhua, Zhang, Xudong, Wang, Yu |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2511.23113 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
PAROAttention: Pattern-Aware ReOrdering for Efficient Sparse and Quantized Attention in Visual Generation Models
par: Zhao, Tianchen, et autres
Publié: (2025)
par: Zhao, Tianchen, et autres
Publié: (2025)
LiteVAR: Compressing Visual Autoregressive Modelling with Efficient Attention and Quantization
par: Xie, Rui, et autres
Publié: (2024)
par: Xie, Rui, et autres
Publié: (2024)
SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer
par: Wan, Jiaxu, et autres
Publié: (2024)
par: Wan, Jiaxu, et autres
Publié: (2024)
LRQ-DiT: Log-Rotation Post-Training Quantization of Diffusion Transformers for Image and Video Generation
par: Yang, Lianwei, et autres
Publié: (2025)
par: Yang, Lianwei, et autres
Publié: (2025)
SALAD: Achieve High-Sparsity Attention via Efficient Linear Attention Tuning for Video Diffusion Transformer
par: Fang, Tongcheng, et autres
Publié: (2026)
par: Fang, Tongcheng, et autres
Publié: (2026)
Accelerating Text-to-Video Generation with Calibrated Sparse Attention
par: Yehezkel, Shai, et autres
Publié: (2026)
par: Yehezkel, Shai, et autres
Publié: (2026)
APB-V: Accelerating Long-Video Understanding via Sequence-Parallelism-aware Approximate Attention
par: Huang, Yuxiang, et autres
Publié: (2026)
par: Huang, Yuxiang, et autres
Publié: (2026)
VecAttention: Vector-wise Sparse Attention for Accelerating Long Context Inference
par: Liu, Anmin, et autres
Publié: (2026)
par: Liu, Anmin, et autres
Publié: (2026)
Sparse VideoGen2: Accelerate Video Generation with Sparse Attention via Semantic-Aware Permutation
par: Yang, Shuo, et autres
Publié: (2025)
par: Yang, Shuo, et autres
Publié: (2025)
SFPNet: Sparse Focal Point Network for Semantic Segmentation on General LiDAR Point Clouds
par: Wang, Yanbo, et autres
Publié: (2024)
par: Wang, Yanbo, et autres
Publié: (2024)
OSP-Next: Efficient High-Quality Video Generation with Sparse Sequence Parallelism, HiF8 Quantization, and Reinforcement Learning
par: Ge, Yunyang, et autres
Publié: (2026)
par: Ge, Yunyang, et autres
Publié: (2026)
Sparse-vDiT: Unleashing the Power of Sparse Attention to Accelerate Video Diffusion Transformers
par: Chen, Pengtao, et autres
Publié: (2025)
par: Chen, Pengtao, et autres
Publié: (2025)
SpargeAttention: Accurate and Training-free Sparse Attention Accelerating Any Model Inference
par: Zhang, Jintao, et autres
Publié: (2025)
par: Zhang, Jintao, et autres
Publié: (2025)
TokBench: Evaluating Your Visual Tokenizer before Visual Generation
par: Wu, Junfeng, et autres
Publié: (2025)
par: Wu, Junfeng, et autres
Publié: (2025)
DiTFastAttn: Attention Compression for Diffusion Transformer Models
par: Yuan, Zhihang, et autres
Publié: (2024)
par: Yuan, Zhihang, et autres
Publié: (2024)
Sparse Forcing: Native Trainable Sparse Attention for Real-time Autoregressive Diffusion Video Generation
par: Xu, Boxun, et autres
Publié: (2026)
par: Xu, Boxun, et autres
Publié: (2026)
Visual Grounding with Attention-Driven Constraint Balancing
par: Kang, Weitai, et autres
Publié: (2024)
par: Kang, Weitai, et autres
Publié: (2024)
FlashEval: Towards Fast and Accurate Evaluation of Text-to-image Diffusion Generative Models
par: Zhao, Lin, et autres
Publié: (2024)
par: Zhao, Lin, et autres
Publié: (2024)
Re-ttention: Ultra Sparse Visual Generation via Attention Statistical Reshape
par: Chen, Ruichen, et autres
Publié: (2025)
par: Chen, Ruichen, et autres
Publié: (2025)
Efficient Bilinear Attention-based Fusion for Medical Visual Question Answering
par: Zhang, Zhilin, et autres
Publié: (2024)
par: Zhang, Zhilin, et autres
Publié: (2024)
Parallelized Autoregressive Visual Generation
par: Wang, Yuqing, et autres
Publié: (2024)
par: Wang, Yuqing, et autres
Publié: (2024)
ParallelVLM: Lossless Video-LLM Acceleration with Visual Alignment Aware Parallel Speculative Decoding
par: Kong, Quan, et autres
Publié: (2026)
par: Kong, Quan, et autres
Publié: (2026)
Parallel Sequence Modeling via Generalized Spatial Propagation Network
par: Wang, Hongjun, et autres
Publié: (2025)
par: Wang, Hongjun, et autres
Publié: (2025)
Learning Sequence Descriptor based on Spatio-Temporal Attention for Visual Place Recognition
par: Zhao, Junqiao, et autres
Publié: (2023)
par: Zhao, Junqiao, et autres
Publié: (2023)
GSPN-2: Efficient Parallel Sequence Modeling
par: Wang, Hongjun, et autres
Publié: (2025)
par: Wang, Hongjun, et autres
Publié: (2025)
Light Forcing: Accelerating Autoregressive Video Diffusion via Sparse Attention
par: Lv, Chengtao, et autres
Publié: (2026)
par: Lv, Chengtao, et autres
Publié: (2026)
Generalizable Engagement Estimation in Conversation via Domain Prompting and Parallel Attention
par: Yu, Yangche, et autres
Publié: (2025)
par: Yu, Yangche, et autres
Publié: (2025)
Conceptual Codebook Learning for Vision-Language Models
par: Zhang, Yi, et autres
Publié: (2024)
par: Zhang, Yi, et autres
Publié: (2024)
CrossLMM: Decoupling Long Video Sequences from LMMs via Dual Cross-Attention Mechanisms
par: Yan, Shilin, et autres
Publié: (2025)
par: Yan, Shilin, et autres
Publié: (2025)
ViG: Linear-complexity Visual Sequence Learning with Gated Linear Attention
par: Liao, Bencheng, et autres
Publié: (2024)
par: Liao, Bencheng, et autres
Publié: (2024)
Generalized Visual Relation Detection with Diffusion Models
par: Gao, Kaifeng, et autres
Publié: (2025)
par: Gao, Kaifeng, et autres
Publié: (2025)
Scaling Parallel Sequence Models to Foundation-Scale Vision Encoders
par: Jiang, Yitong, et autres
Publié: (2026)
par: Jiang, Yitong, et autres
Publié: (2026)
Latent Beam Diffusion Models for Generating Visual Sequences
par: Fernandes, Guilherme, et autres
Publié: (2025)
par: Fernandes, Guilherme, et autres
Publié: (2025)
Adaptive Visual Autoregressive Acceleration via Dual-Linkage Entropy Analysis
par: Zhang, Yu, et autres
Publié: (2026)
par: Zhang, Yu, et autres
Publié: (2026)
Input-Aware Sparse Attention for Real-Time Co-Speech Video Generation
par: Lu, Beijia, et autres
Publié: (2025)
par: Lu, Beijia, et autres
Publié: (2025)
OTPL-VIO: Robust Visual-Inertial Odometry with Optimal Transport Line Association and Adaptive Uncertainty
par: Chen, Zikun, et autres
Publié: (2026)
par: Chen, Zikun, et autres
Publié: (2026)
SerialGen: Personalized Image Generation by First Standardization Then Personalization
par: Xie, Cong, et autres
Publié: (2024)
par: Xie, Cong, et autres
Publié: (2024)
Text4Seg++: Advancing Image Segmentation via Generative Language Modeling
par: Lan, Mengcheng, et autres
Publié: (2025)
par: Lan, Mengcheng, et autres
Publié: (2025)
MuVi: Video-to-Music Generation with Semantic Alignment and Rhythmic Synchronization
par: Li, Ruiqi, et autres
Publié: (2024)
par: Li, Ruiqi, et autres
Publié: (2024)
DualCoT-VLA: Visual-Linguistic Chain of Thought via Parallel Reasoning for Vision-Language-Action Models
par: Zhong, Zhide, et autres
Publié: (2026)
par: Zhong, Zhide, et autres
Publié: (2026)
Documents similaires
-
PAROAttention: Pattern-Aware ReOrdering for Efficient Sparse and Quantized Attention in Visual Generation Models
par: Zhao, Tianchen, et autres
Publié: (2025) -
LiteVAR: Compressing Visual Autoregressive Modelling with Efficient Attention and Quantization
par: Xie, Rui, et autres
Publié: (2024) -
SP$^2$T: Sparse Proxy Attention for Dual-stream Point Transformer
par: Wan, Jiaxu, et autres
Publié: (2024) -
LRQ-DiT: Log-Rotation Post-Training Quantization of Diffusion Transformers for Image and Video Generation
par: Yang, Lianwei, et autres
Publié: (2025) -
SALAD: Achieve High-Sparsity Attention via Efficient Linear Attention Tuning for Video Diffusion Transformer
par: Fang, Tongcheng, et autres
Publié: (2026)