The Model Knows Which Tokens Matter: Automatic Token Selection via Noise Gating
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | He, Landi, Yang, Xiaoyu, Xu, Lijian |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2026
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Beyond Surrogate Gradients: Fully Differentiable Token Pruning for Vision-Language Models
von: He, Landi, et al.
Veröffentlicht: (2026)
von: He, Landi, et al.
Veröffentlicht: (2026)
TC-SSA: Token Compression via Semantic Slot Aggregation for Gigapixel Pathology Reasoning
von: Chen, Zhuo, et al.
Veröffentlicht: (2026)
von: Chen, Zhuo, et al.
Veröffentlicht: (2026)
Fewer Tokens, Greater Scaling: Self-Adaptive Visual Bases for Efficient and Expansive Representation Learning
von: Young, Shawn, et al.
Veröffentlicht: (2025)
von: Young, Shawn, et al.
Veröffentlicht: (2025)
TEASER: Token Enhanced Spatial Modeling for Expressions Reconstruction
von: Liu, Yunfei, et al.
Veröffentlicht: (2025)
von: Liu, Yunfei, et al.
Veröffentlicht: (2025)
Training Noise Token Pruning
von: Rao, Mingxing, et al.
Veröffentlicht: (2024)
von: Rao, Mingxing, et al.
Veröffentlicht: (2024)
Image Tokens Matter: Mitigating Hallucination in Discrete Tokenizer-based Large Vision-Language Models via Latent Editing
von: Wang, Weixing, et al.
Veröffentlicht: (2025)
von: Wang, Weixing, et al.
Veröffentlicht: (2025)
Zero-Shot Video Translation via Token Warping
von: Zhu, Haiming, et al.
Veröffentlicht: (2024)
von: Zhu, Haiming, et al.
Veröffentlicht: (2024)
The First to Know: How Token Distributions Reveal Hidden Knowledge in Large Vision-Language Models?
von: Zhao, Qinyu, et al.
Veröffentlicht: (2024)
von: Zhao, Qinyu, et al.
Veröffentlicht: (2024)
TrimTokenator: Towards Adaptive Visual Token Pruning for Large Multimodal Models
von: Zhang, Hao, et al.
Veröffentlicht: (2025)
von: Zhang, Hao, et al.
Veröffentlicht: (2025)
TokenAR: Multiple Subject Generation via Autoregressive Token-level enhancement
von: Sun, Haiyue, et al.
Veröffentlicht: (2025)
von: Sun, Haiyue, et al.
Veröffentlicht: (2025)
Recolour What Matters: Region-Aware Colour Editing via Token-Level Diffusion
von: Yang, Yuqi, et al.
Veröffentlicht: (2026)
von: Yang, Yuqi, et al.
Veröffentlicht: (2026)
OptiPrune: Boosting Prompt-Image Consistency with Attention-Guided Noise and Dynamic Token Selection
von: Lu, Ziji
Veröffentlicht: (2025)
von: Lu, Ziji
Veröffentlicht: (2025)
Stop Looking for Important Tokens in Multimodal Language Models: Duplication Matters More
von: Wen, Zichen, et al.
Veröffentlicht: (2025)
von: Wen, Zichen, et al.
Veröffentlicht: (2025)
ToDRE: Effective Visual Token Pruning via Token Diversity and Task Relevance
von: Li, Duo, et al.
Veröffentlicht: (2025)
von: Li, Duo, et al.
Veröffentlicht: (2025)
Enhancing Visual Grounding and Generalization: A Multi-Task Cycle Training Approach for Vision-Language Models
von: Yang, Xiaoyu, et al.
Veröffentlicht: (2023)
von: Yang, Xiaoyu, et al.
Veröffentlicht: (2023)
FPAN: Mitigating Replication in Diffusion Models through the Fine-Grained Probabilistic Addition of Noise to Token Embeddings
von: Xu, Jingqi, et al.
Veröffentlicht: (2025)
von: Xu, Jingqi, et al.
Veröffentlicht: (2025)
FlexSelect: Flexible Token Selection for Efficient Long Video Understanding
von: Zhang, Yunzhu, et al.
Veröffentlicht: (2025)
von: Zhang, Yunzhu, et al.
Veröffentlicht: (2025)
Pyramid Token Pruning for High-Resolution Large Vision-Language Models via Region, Token, and Instruction-Guided Importance
von: Liang, Yuxuan, et al.
Veröffentlicht: (2025)
von: Liang, Yuxuan, et al.
Veröffentlicht: (2025)
TokensGen: Harnessing Condensed Tokens for Long Video Generation
von: Ouyang, Wenqi, et al.
Veröffentlicht: (2025)
von: Ouyang, Wenqi, et al.
Veröffentlicht: (2025)
A Frame is Worth One Token: Efficient Generative World Modeling with Delta Tokens
von: Kerssies, Tommie, et al.
Veröffentlicht: (2026)
von: Kerssies, Tommie, et al.
Veröffentlicht: (2026)
Model Already Knows the Best Noise: Bayesian Active Noise Selection via Attention in Video Diffusion Model
von: Kim, Kwanyoung, et al.
Veröffentlicht: (2025)
von: Kim, Kwanyoung, et al.
Veröffentlicht: (2025)
Beyond Next-Token Alignment: Distilling Multimodal Large Language Models via Token Interactions
von: Chen, Lin, et al.
Veröffentlicht: (2026)
von: Chen, Lin, et al.
Veröffentlicht: (2026)
FlashVLM: Text-Guided Visual Token Selection for Large Multimodal Models
von: Cai, Kaitong, et al.
Veröffentlicht: (2025)
von: Cai, Kaitong, et al.
Veröffentlicht: (2025)
Unified Pix Token And Word Token Generative Language Model
von: Leung, Haun, et al.
Veröffentlicht: (2026)
von: Leung, Haun, et al.
Veröffentlicht: (2026)
When Token Pruning is Worse than Random: Understanding Visual Token Information in VLLMs
von: Wang, Yahong, et al.
Veröffentlicht: (2025)
von: Wang, Yahong, et al.
Veröffentlicht: (2025)
Homogeneous Tokenizer Matters: Homogeneous Visual Tokenizer for Remote Sensing Image Understanding
von: Shao, Run, et al.
Veröffentlicht: (2024)
von: Shao, Run, et al.
Veröffentlicht: (2024)
TokenSeg: Efficient 3D Medical Image Segmentation via Hierarchical Visual Token Compression
von: Zeng, Sen, et al.
Veröffentlicht: (2026)
von: Zeng, Sen, et al.
Veröffentlicht: (2026)
Purge-Gate: Backpropagation-Free Test-Time Adaptation for Point Clouds Classification via Token Purging
von: Yazdanpanah, Moslem, et al.
Veröffentlicht: (2025)
von: Yazdanpanah, Moslem, et al.
Veröffentlicht: (2025)
TokenCarve: Information-Preserving Visual Token Compression in Multimodal Large Language Models
von: Tan, Xudong, et al.
Veröffentlicht: (2025)
von: Tan, Xudong, et al.
Veröffentlicht: (2025)
RedVTP: Training-Free Acceleration of Diffusion Vision-Language Models Inference via Masked Token-Guided Visual Token Pruning
von: Xu, Jingqi, et al.
Veröffentlicht: (2025)
von: Xu, Jingqi, et al.
Veröffentlicht: (2025)
WeMMU: Enhanced Bridging of Vision-Language Models and Diffusion Models via Noisy Query Tokens
von: Yang, Jian, et al.
Veröffentlicht: (2025)
von: Yang, Jian, et al.
Veröffentlicht: (2025)
MergeTok: Unified Continuous and Discrete Visual Tokenization via Token Merging
von: Zhang, Luyuan, et al.
Veröffentlicht: (2026)
von: Zhang, Luyuan, et al.
Veröffentlicht: (2026)
Tokenize Anything via Prompting
von: Pan, Ting, et al.
Veröffentlicht: (2023)
von: Pan, Ting, et al.
Veröffentlicht: (2023)
OmniSelect: Dynamic Modality-Aware Token Compression for Efficient Omni-modal Large Language Models
von: Yang, Morunliu, et al.
Veröffentlicht: (2026)
von: Yang, Morunliu, et al.
Veröffentlicht: (2026)
Know Your Attention Maps: Class-specific Token Masking for Weakly Supervised Semantic Segmentation
von: Hanna, Joelle, et al.
Veröffentlicht: (2025)
von: Hanna, Joelle, et al.
Veröffentlicht: (2025)
TokenCLIP: Token-wise Prompt Learning for Zero-shot Anomaly Detection
von: Zhou, Qihang, et al.
Veröffentlicht: (2025)
von: Zhou, Qihang, et al.
Veröffentlicht: (2025)
Magic Tokens: Select Diverse Tokens for Multi-modal Object Re-Identification
von: Zhang, Pingping, et al.
Veröffentlicht: (2024)
von: Zhang, Pingping, et al.
Veröffentlicht: (2024)
TokenPure: Watermark Removal through Tokenized Appearance and Structural Guidance
von: Yang, Pei, et al.
Veröffentlicht: (2025)
von: Yang, Pei, et al.
Veröffentlicht: (2025)
TokenMotion: Motion-Guided Vision Transformer for Video Camouflaged Object Detection Via Learnable Token Selection
von: Yu, Zifan, et al.
Veröffentlicht: (2023)
von: Yu, Zifan, et al.
Veröffentlicht: (2023)
PanoLlama: Generating Endless and Coherent Panoramas with Next-Token-Prediction LLMs
von: Zhou, Teng, et al.
Veröffentlicht: (2024)
von: Zhou, Teng, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Beyond Surrogate Gradients: Fully Differentiable Token Pruning for Vision-Language Models
von: He, Landi, et al.
Veröffentlicht: (2026) -
TC-SSA: Token Compression via Semantic Slot Aggregation for Gigapixel Pathology Reasoning
von: Chen, Zhuo, et al.
Veröffentlicht: (2026) -
Fewer Tokens, Greater Scaling: Self-Adaptive Visual Bases for Efficient and Expansive Representation Learning
von: Young, Shawn, et al.
Veröffentlicht: (2025) -
TEASER: Token Enhanced Spatial Modeling for Expressions Reconstruction
von: Liu, Yunfei, et al.
Veröffentlicht: (2025) -
Training Noise Token Pruning
von: Rao, Mingxing, et al.
Veröffentlicht: (2024)