Salvato in:
| Autori principali: | Tong, Enwei, Bai, Yuanchao, Zhu, Yao, Jiang, Junjun, Liu, Xianming |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2602.05809 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Semantic Ensemble Loss and Latent Refinement for High-Fidelity Neural Image Compression
di: Li, Daxin, et al.
Pubblicazione: (2024)
di: Li, Daxin, et al.
Pubblicazione: (2024)
GroupedMixer: An Entropy Model with Group-wise Token-Mixers for Learned Image Compression
di: Li, Daxin, et al.
Pubblicazione: (2024)
di: Li, Daxin, et al.
Pubblicazione: (2024)
Rethinking Autoregressive Models for Lossless Image Compression via Hierarchical Parallelism and Progressive Adaptation
di: Li, Daxin, et al.
Pubblicazione: (2025)
di: Li, Daxin, et al.
Pubblicazione: (2025)
PVContext: Hybrid Context Model for Point Cloud Compression
di: Zhang, Guoqing, et al.
Pubblicazione: (2024)
di: Zhang, Guoqing, et al.
Pubblicazione: (2024)
CALLIC: Content Adaptive Learning for Lossless Image Compression
di: Li, Daxin, et al.
Pubblicazione: (2024)
di: Li, Daxin, et al.
Pubblicazione: (2024)
Learning Lossless Compression for High Bit-Depth Volumetric Medical Image
di: Wang, Kai, et al.
Pubblicazione: (2024)
di: Wang, Kai, et al.
Pubblicazione: (2024)
IVC-Prune: Revealing the Implicit Visual Coordinates in LVLMs for Vision Token Pruning
di: Sun, Zhichao, et al.
Pubblicazione: (2026)
di: Sun, Zhichao, et al.
Pubblicazione: (2026)
VRS-UIE: Value-Driven Reordering Scanning for Underwater Image Enhancement
di: Jiang, Kui, et al.
Pubblicazione: (2025)
di: Jiang, Kui, et al.
Pubblicazione: (2025)
PruneVid: Visual Token Pruning for Efficient Video Large Language Models
di: Huang, Xiaohu, et al.
Pubblicazione: (2024)
di: Huang, Xiaohu, et al.
Pubblicazione: (2024)
Transforming Image Super-Resolution: A ConvFormer-based Efficient Approach
di: Wu, Gang, et al.
Pubblicazione: (2024)
di: Wu, Gang, et al.
Pubblicazione: (2024)
Learning from History: Task-agnostic Model Contrastive Learning for Image Restoration
di: Wu, Gang, et al.
Pubblicazione: (2023)
di: Wu, Gang, et al.
Pubblicazione: (2023)
Boosting All-in-One Image Restoration via Self-Improved Privilege Learning
di: Wu, Gang, et al.
Pubblicazione: (2025)
di: Wu, Gang, et al.
Pubblicazione: (2025)
GridPrune: From "Where to Look" to "What to Select" in Visual Token Pruning for MLLMs
di: Duan, Yuxiang, et al.
Pubblicazione: (2025)
di: Duan, Yuxiang, et al.
Pubblicazione: (2025)
Spatial Annealing for Efficient Few-shot Neural Rendering
di: Xiao, Yuru, et al.
Pubblicazione: (2024)
di: Xiao, Yuru, et al.
Pubblicazione: (2024)
UTPTrack: Towards Simple and Unified Token Pruning for Visual Tracking
di: Wu, Hao, et al.
Pubblicazione: (2026)
di: Wu, Hao, et al.
Pubblicazione: (2026)
UDPNet: Unleashing Depth-based Priors for Robust Image Dehazing
di: Zuo, Zengyuan, et al.
Pubblicazione: (2026)
di: Zuo, Zengyuan, et al.
Pubblicazione: (2026)
Image Deblurring by Exploring In-depth Properties of Transformer
di: Liang, Pengwei, et al.
Pubblicazione: (2023)
di: Liang, Pengwei, et al.
Pubblicazione: (2023)
LLV-FSR: Exploiting Large Language-Vision Prior for Face Super-resolution
di: Wang, Chenyang, et al.
Pubblicazione: (2024)
di: Wang, Chenyang, et al.
Pubblicazione: (2024)
Factorized Visual Tokenization and Generation
di: Bai, Zechen, et al.
Pubblicazione: (2024)
di: Bai, Zechen, et al.
Pubblicazione: (2024)
Fully $1\times1$ Convolutional Network for Lightweight Image Super-Resolution
di: Wu, Gang, et al.
Pubblicazione: (2023)
di: Wu, Gang, et al.
Pubblicazione: (2023)
FocusLLaVA: A Coarse-to-Fine Approach for Efficient and Effective Visual Token Compression
di: Zhu, Yuke, et al.
Pubblicazione: (2024)
di: Zhu, Yuke, et al.
Pubblicazione: (2024)
HAWK: Head Importance-Aware Visual Token Pruning in Multimodal Models
di: Zhu, Qihui, et al.
Pubblicazione: (2026)
di: Zhu, Qihui, et al.
Pubblicazione: (2026)
IDPruner: Harmonizing Importance and Diversity in Visual Token Pruning for MLLMs
di: Tan, Yifan, et al.
Pubblicazione: (2026)
di: Tan, Yifan, et al.
Pubblicazione: (2026)
StreamingAssistant: Efficient Visual Token Pruning for Accelerating Online Video Understanding
di: Jin, Xinqi, et al.
Pubblicazione: (2025)
di: Jin, Xinqi, et al.
Pubblicazione: (2025)
Bridging the Semantic-Action Gap in Visual Token Pruning for Efficient VLA Inference
di: Liu, Ziyan, et al.
Pubblicazione: (2025)
di: Liu, Ziyan, et al.
Pubblicazione: (2025)
DSwinIR: Rethinking Window-based Attention for Image Restoration
di: Wu, Gang, et al.
Pubblicazione: (2025)
di: Wu, Gang, et al.
Pubblicazione: (2025)
COB-GS: Clear Object Boundaries in 3DGS Segmentation Based on Boundary-Adaptive Gaussian Splitting
di: Zhang, Jiaxin, et al.
Pubblicazione: (2025)
di: Zhang, Jiaxin, et al.
Pubblicazione: (2025)
Beyond Degradation Redundancy: Contrastive Prompt Learning for All-in-One Image Restoration
di: Wu, Gang, et al.
Pubblicazione: (2025)
di: Wu, Gang, et al.
Pubblicazione: (2025)
When Token Pruning is Worse than Random: Understanding Visual Token Information in VLLMs
di: Wang, Yahong, et al.
Pubblicazione: (2025)
di: Wang, Yahong, et al.
Pubblicazione: (2025)
CROP: Contextual Region-Oriented Visual Token Pruning
di: Guo, Jiawei, et al.
Pubblicazione: (2025)
di: Guo, Jiawei, et al.
Pubblicazione: (2025)
HM-Talker: Hybrid Motion Modeling for High-Fidelity Talking Head Synthesis
di: Liu, Shiyu, et al.
Pubblicazione: (2025)
di: Liu, Shiyu, et al.
Pubblicazione: (2025)
Improving Domain Generalization in Self-supervised Monocular Depth Estimation via Stabilized Adversarial Training
di: Yao, Yuanqi, et al.
Pubblicazione: (2024)
di: Yao, Yuanqi, et al.
Pubblicazione: (2024)
Exploiting Self-Supervised Constraints in Image Super-Resolution
di: Wu, Gang, et al.
Pubblicazione: (2024)
di: Wu, Gang, et al.
Pubblicazione: (2024)
OTPrune: Distribution-Aligned Visual Token Pruning via Optimal Transport
di: Chen, Xiwen, et al.
Pubblicazione: (2026)
di: Chen, Xiwen, et al.
Pubblicazione: (2026)
Pear: Pruning and Sharing Adapters in Visual Parameter-Efficient Fine-Tuning
di: Zhong, Yibo, et al.
Pubblicazione: (2024)
di: Zhong, Yibo, et al.
Pubblicazione: (2024)
Refining CLIP's Spatial Awareness: A Visual-Centric Perspective
di: Qiu, Congpei, et al.
Pubblicazione: (2025)
di: Qiu, Congpei, et al.
Pubblicazione: (2025)
EntropyPrune: Matrix Entropy Guided Visual Token Pruning for Multimodal Large Language Models
di: Wang, Yahong, et al.
Pubblicazione: (2026)
di: Wang, Yahong, et al.
Pubblicazione: (2026)
TrimTokenator: Towards Adaptive Visual Token Pruning for Large Multimodal Models
di: Zhang, Hao, et al.
Pubblicazione: (2025)
di: Zhang, Hao, et al.
Pubblicazione: (2025)
FUSE: Label-Free Image-Event Joint Monocular Depth Estimation via Frequency-Decoupled Alignment and Degradation-Robust Fusion
di: Sun, Pihai, et al.
Pubblicazione: (2025)
di: Sun, Pihai, et al.
Pubblicazione: (2025)
SDGE: Stereo Guided Depth Estimation for 360$^\circ$ Camera Sets
di: Xu, Jialei, et al.
Pubblicazione: (2024)
di: Xu, Jialei, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Semantic Ensemble Loss and Latent Refinement for High-Fidelity Neural Image Compression
di: Li, Daxin, et al.
Pubblicazione: (2024) -
GroupedMixer: An Entropy Model with Group-wise Token-Mixers for Learned Image Compression
di: Li, Daxin, et al.
Pubblicazione: (2024) -
Rethinking Autoregressive Models for Lossless Image Compression via Hierarchical Parallelism and Progressive Adaptation
di: Li, Daxin, et al.
Pubblicazione: (2025) -
PVContext: Hybrid Context Model for Point Cloud Compression
di: Zhang, Guoqing, et al.
Pubblicazione: (2024) -
CALLIC: Content Adaptive Learning for Lossless Image Compression
di: Li, Daxin, et al.
Pubblicazione: (2024)