Token Pruning for In-Context Generation in Diffusion Transformers
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Lin, Junqing, Zheng, Xingyu, Cheng, Pei, Fu, Bin, Sun, Jingwei, Sun, Guangzhong |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
GreedyPrune: Retenting Critical Visual Token Set for Large Vision Language Models
von: Pei, Ruiguang, et al.
Veröffentlicht: (2025)
von: Pei, Ruiguang, et al.
Veröffentlicht: (2025)
TP-Spikformer: Token Pruned Spiking Transformer
von: Wei, Wenjie, et al.
Veröffentlicht: (2026)
von: Wei, Wenjie, et al.
Veröffentlicht: (2026)
CAT Pruning: Cluster-Aware Token Pruning For Text-to-Image Diffusion Models
von: Cheng, Xinle, et al.
Veröffentlicht: (2025)
von: Cheng, Xinle, et al.
Veröffentlicht: (2025)
Context-Aware Token Pruning and Discriminative Selective Attention for Transformer Tracking
von: Kugarajeevan, Janani, et al.
Veröffentlicht: (2025)
von: Kugarajeevan, Janani, et al.
Veröffentlicht: (2025)
CoReDiT: Spatial Coherence-Guided Token Pruning and Reconstruction for Efficient Diffusion Transformers
von: Li, Zhuojin, et al.
Veröffentlicht: (2026)
von: Li, Zhuojin, et al.
Veröffentlicht: (2026)
Rényi Entropy: A New Token Pruning Metric for Vision Transformers
von: Su, Wei-Yuan, et al.
Veröffentlicht: (2026)
von: Su, Wei-Yuan, et al.
Veröffentlicht: (2026)
TrimTokenator-LC: Towards Adaptive Visual Token Pruning for Large Multimodal Models with Long Contexts
von: Zhang, Hao, et al.
Veröffentlicht: (2025)
von: Zhang, Hao, et al.
Veröffentlicht: (2025)
IVC-Prune: Revealing the Implicit Visual Coordinates in LVLMs for Vision Token Pruning
von: Sun, Zhichao, et al.
Veröffentlicht: (2026)
von: Sun, Zhichao, et al.
Veröffentlicht: (2026)
PPT: Token Pruning and Pooling for Efficient Vision Transformers
von: Wu, Xinjian, et al.
Veröffentlicht: (2023)
von: Wu, Xinjian, et al.
Veröffentlicht: (2023)
Transformer RGBT Tracking with Spatio-Temporal Multimodal Tokens
von: Sun, Dengdi, et al.
Veröffentlicht: (2024)
von: Sun, Dengdi, et al.
Veröffentlicht: (2024)
HiPrune: Hierarchical Attention for Efficient Token Pruning in Vision-Language Models
von: Liu, Jizhihui, et al.
Veröffentlicht: (2025)
von: Liu, Jizhihui, et al.
Veröffentlicht: (2025)
Attention Debiasing for Token Pruning in Vision Language Models
von: Zhao, Kai, et al.
Veröffentlicht: (2025)
von: Zhao, Kai, et al.
Veröffentlicht: (2025)
Pyramid Token Pruning for High-Resolution Large Vision-Language Models via Region, Token, and Instruction-Guided Importance
von: Liang, Yuxuan, et al.
Veröffentlicht: (2025)
von: Liang, Yuxuan, et al.
Veröffentlicht: (2025)
CATP: Contextually Adaptive Token Pruning for Efficient and Enhanced Multimodal In-Context Learning
von: Li, Yanshu, et al.
Veröffentlicht: (2025)
von: Li, Yanshu, et al.
Veröffentlicht: (2025)
Efficient Token Pruning for LLaDA-V
von: Wan, Zhewen, et al.
Veröffentlicht: (2026)
von: Wan, Zhewen, et al.
Veröffentlicht: (2026)
DiffSparse: Accelerating Diffusion Transformers with Learned Token Sparsity
von: Zhu, Haowei, et al.
Veröffentlicht: (2026)
von: Zhu, Haowei, et al.
Veröffentlicht: (2026)
TrimTokenator: Towards Adaptive Visual Token Pruning for Large Multimodal Models
von: Zhang, Hao, et al.
Veröffentlicht: (2025)
von: Zhang, Hao, et al.
Veröffentlicht: (2025)
Latent Feature and Attention Dual Erasure Attack against Multi-View Diffusion Models for 3D Assets Protection
von: Sun, Jingwei, et al.
Veröffentlicht: (2024)
von: Sun, Jingwei, et al.
Veröffentlicht: (2024)
Astraea: A Token-wise Acceleration Framework for Video Diffusion Transformers
von: Liu, Haosong, et al.
Veröffentlicht: (2025)
von: Liu, Haosong, et al.
Veröffentlicht: (2025)
Training Noise Token Pruning
von: Rao, Mingxing, et al.
Veröffentlicht: (2024)
von: Rao, Mingxing, et al.
Veröffentlicht: (2024)
PaceVGGT: Pre-Alternating-Attention Token Pruning for Visual Geometry Transformers
von: Li, Haotang, et al.
Veröffentlicht: (2026)
von: Li, Haotang, et al.
Veröffentlicht: (2026)
GTPT: Group-based Token Pruning Transformer for Efficient Human Pose Estimation
von: Wang, Haonan, et al.
Veröffentlicht: (2024)
von: Wang, Haonan, et al.
Veröffentlicht: (2024)
Grounding-Aware Token Pruning: Recovering from Drastic Performance Drops in Visual Grounding Caused by Pruning
von: Chien, Tzu-Chun, et al.
Veröffentlicht: (2025)
von: Chien, Tzu-Chun, et al.
Veröffentlicht: (2025)
VisPCO: Visual Token Pruning Configuration Optimization via Budget-Aware Pareto-Frontier Learning for Vision-Language Models
von: Ji, Huawei, et al.
Veröffentlicht: (2026)
von: Ji, Huawei, et al.
Veröffentlicht: (2026)
Pluggable Pruning with Contiguous Layer Distillation for Diffusion Transformers
von: Ma, Jian, et al.
Veröffentlicht: (2025)
von: Ma, Jian, et al.
Veröffentlicht: (2025)
Geometric Image Editing via Effects-Sensitive In-Context Inpainting with Diffusion Transformers
von: Zhang, Shuo, et al.
Veröffentlicht: (2026)
von: Zhang, Shuo, et al.
Veröffentlicht: (2026)
ZeroSense:How Vision matters in Long Context Compression
von: Gao, Yonghan, et al.
Veröffentlicht: (2026)
von: Gao, Yonghan, et al.
Veröffentlicht: (2026)
OmniPSD: Layered PSD Generation with Diffusion Transformer
von: Liu, Cheng, et al.
Veröffentlicht: (2025)
von: Liu, Cheng, et al.
Veröffentlicht: (2025)
CATP: Confidence-Aware Token Pruning for Camouflaged Object Detection
von: Gao, Yuhan, et al.
Veröffentlicht: (2026)
von: Gao, Yuhan, et al.
Veröffentlicht: (2026)
Towards Joint Quantization and Token Pruning of Vision-Language Models
von: Li, Xinqing, et al.
Veröffentlicht: (2026)
von: Li, Xinqing, et al.
Veröffentlicht: (2026)
HEART-VIT: Hessian-Guided Efficient Dynamic Attention and Token Pruning in Vision Transformer
von: Uddin, Mohammad Helal, et al.
Veröffentlicht: (2025)
von: Uddin, Mohammad Helal, et al.
Veröffentlicht: (2025)
MADTP: Multimodal Alignment-Guided Dynamic Token Pruning for Accelerating Vision-Language Transformer
von: Cao, Jianjian, et al.
Veröffentlicht: (2024)
von: Cao, Jianjian, et al.
Veröffentlicht: (2024)
Reinforcement Learning-based Token Pruning in Vision Transformers: A Markov Game Approach
von: Lu, Chenglong, et al.
Veröffentlicht: (2025)
von: Lu, Chenglong, et al.
Veröffentlicht: (2025)
Geometry-Guided 3D Visual Token Pruning for Video-Language Models
von: Li, Han, et al.
Veröffentlicht: (2026)
von: Li, Han, et al.
Veröffentlicht: (2026)
RS-Prune: Training-Free Data Pruning at High Ratios for Efficient Remote Sensing Diffusion Foundation Models
von: Wei, Fan, et al.
Veröffentlicht: (2025)
von: Wei, Fan, et al.
Veröffentlicht: (2025)
Human4DiT: 360-degree Human Video Generation with 4D Diffusion Transformer
von: Shao, Ruizhi, et al.
Veröffentlicht: (2024)
von: Shao, Ruizhi, et al.
Veröffentlicht: (2024)
ELLA: Equip Diffusion Models with LLM for Enhanced Semantic Alignment
von: Hu, Xiwei, et al.
Veröffentlicht: (2024)
von: Hu, Xiwei, et al.
Veröffentlicht: (2024)
Prune Redundancy, Preserve Essence: Vision Token Compression in VLMs via Synergistic Importance-Diversity
von: Fang, Zhengyao, et al.
Veröffentlicht: (2026)
von: Fang, Zhengyao, et al.
Veröffentlicht: (2026)
Text-driven Human Motion Generation with Motion Masked Diffusion Model
von: Chen, Xingyu
Veröffentlicht: (2024)
von: Chen, Xingyu
Veröffentlicht: (2024)
ATD: Improved Transformer with Adaptive Token Dictionary for Image Restoration
von: Zhang, Leheng, et al.
Veröffentlicht: (2026)
von: Zhang, Leheng, et al.
Veröffentlicht: (2026)
Ähnliche Einträge
-
GreedyPrune: Retenting Critical Visual Token Set for Large Vision Language Models
von: Pei, Ruiguang, et al.
Veröffentlicht: (2025) -
TP-Spikformer: Token Pruned Spiking Transformer
von: Wei, Wenjie, et al.
Veröffentlicht: (2026) -
CAT Pruning: Cluster-Aware Token Pruning For Text-to-Image Diffusion Models
von: Cheng, Xinle, et al.
Veröffentlicht: (2025) -
Context-Aware Token Pruning and Discriminative Selective Attention for Transformer Tracking
von: Kugarajeevan, Janani, et al.
Veröffentlicht: (2025) -
CoReDiT: Spatial Coherence-Guided Token Pruning and Reconstruction for Efficient Diffusion Transformers
von: Li, Zhuojin, et al.
Veröffentlicht: (2026)