ARTA: Adaptive Mixed-Resolution Token Allocation for Efficient Dense Feature Extraction
Fuente:
arXiv
Saved in:
| Main Authors: | Hagerman, David, Naeem, Roman, Brorsson, Erik, Kahl, Fredrik, Svensson, Lennart |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
RefTr: Recurrent Refinement of Confluent Trajectories for 3D Vascular Tree Centerlines
by: Naeem, Roman, et al.
Published: (2025)
by: Naeem, Roman, et al.
Published: (2025)
Trexplorer Super: Topologically Correct Centerline Tree Tracking of Tubular Objects in CT Volumes
by: Naeem, Roman, et al.
Published: (2025)
by: Naeem, Roman, et al.
Published: (2025)
SwInception -- Local Attention Meets Convolutions
by: Hagerman, David, et al.
Published: (2026)
by: Hagerman, David, et al.
Published: (2026)
ECAP: Extensive Cut-and-Paste Augmentation for Unsupervised Domain Adaptive Semantic Segmentation
by: Brorsson, Erik, et al.
Published: (2024)
by: Brorsson, Erik, et al.
Published: (2024)
ProSub: Probabilistic Open-Set Semi-Supervised Learning with Subspace-Based Out-of-Distribution Detection
by: Wallin, Erik, et al.
Published: (2024)
by: Wallin, Erik, et al.
Published: (2024)
MVUDA: Unsupervised Domain Adaptation for Multi-view Pedestrian Detection
by: Brorsson, Erik, et al.
Published: (2024)
by: Brorsson, Erik, et al.
Published: (2024)
MuM: Multi-View Masked Image Modeling for 3D Vision
by: Nordström, David, et al.
Published: (2025)
by: Nordström, David, et al.
Published: (2025)
Octic Vision Transformers: Quicker ViTs Through Equivariance
by: Nordström, David, et al.
Published: (2025)
by: Nordström, David, et al.
Published: (2025)
WAVECLIP: Wavelet Tokenization for Adaptive-Resolution CLIP
by: Kimhi, Moshe, et al.
Published: (2025)
by: Kimhi, Moshe, et al.
Published: (2025)
Discovering Pathology Rationale and Token Allocation for Efficient Multimodal Pathology Reasoning
by: Xu, Zhe, et al.
Published: (2025)
by: Xu, Zhe, et al.
Published: (2025)
3D-Consistent Multi-View Editing by Correspondence Guidance
by: Bengtson, Josef, et al.
Published: (2025)
by: Bengtson, Josef, et al.
Published: (2025)
Addressing degeneracies in latent interpolation for diffusion models
by: Landolsi, Erik, et al.
Published: (2025)
by: Landolsi, Erik, et al.
Published: (2025)
Spatio-Temporal Token Pruning for Efficient High-Resolution GUI Agents
by: Xu, Zhou, et al.
Published: (2026)
by: Xu, Zhou, et al.
Published: (2026)
OccamToken: Efficient VLM Inference with Training-Free and Budget-Adaptive Token Pruning
by: Li, Geng, et al.
Published: (2026)
by: Li, Geng, et al.
Published: (2026)
Adaptive Length Image Tokenization via Recurrent Allocation
by: Duggal, Shivam, et al.
Published: (2024)
by: Duggal, Shivam, et al.
Published: (2024)
SigLIP 2: Multilingual Vision-Language Encoders with Improved Semantic Understanding, Localization, and Dense Features
by: Tschannen, Michael, et al.
Published: (2025)
by: Tschannen, Michael, et al.
Published: (2025)
SDTN and TRN: Adaptive Spectral-Spatial Feature Extraction for Hyperspectral Image Classification
by: Ye, Fuyin, et al.
Published: (2025)
by: Ye, Fuyin, et al.
Published: (2025)
Global Semantic-Guided Sub-image Feature Weight Allocation in High-Resolution Large Vision-Language Models
by: Liang, Yuxuan, et al.
Published: (2025)
by: Liang, Yuxuan, et al.
Published: (2025)
Efficient and Comprehensive Feature Extraction in Large Vision-Language Model for Pathology Analysis
by: Zhang, Shengxuming, et al.
Published: (2024)
by: Zhang, Shengxuming, et al.
Published: (2024)
Optimizing Gene-Based Testing for Antibiotic Resistance Prediction
by: Hagerman, David, et al.
Published: (2025)
by: Hagerman, David, et al.
Published: (2025)
Energy-Driven Adaptive Visual Token Pruning for Efficient Vision-Language Models
by: He, Jialuo, et al.
Published: (2026)
by: He, Jialuo, et al.
Published: (2026)
HiRED: Attention-Guided Token Dropping for Efficient Inference of High-Resolution Vision-Language Models
by: Arif, Kazi Hasan Ibn, et al.
Published: (2024)
by: Arif, Kazi Hasan Ibn, et al.
Published: (2024)
Adversarially-Refined VQ-GAN with Dense Motion Tokenization for Spatio-Temporal Heatmaps
by: Maldonado, Gabriel, et al.
Published: (2025)
by: Maldonado, Gabriel, et al.
Published: (2025)
Frequency-aware Feature Fusion for Dense Image Prediction
by: Chen, Linwei, et al.
Published: (2024)
by: Chen, Linwei, et al.
Published: (2024)
AdaTok: Adaptive Token Compression with Object-Aware Representations for Efficient Multimodal LLMs
by: Zhang, Xinliang, et al.
Published: (2025)
by: Zhang, Xinliang, et al.
Published: (2025)
QTSeg: A Query Token-Based Dual-Mix Attention Framework with Multi-Level Feature Distribution for Medical Image Segmentation
by: Tran, Phuong-Nam, et al.
Published: (2024)
by: Tran, Phuong-Nam, et al.
Published: (2024)
Segformer++: Efficient Token-Merging Strategies for High-Resolution Semantic Segmentation
by: Kienzle, Daniel, et al.
Published: (2024)
by: Kienzle, Daniel, et al.
Published: (2024)
ToDo: Token Downsampling for Efficient Generation of High-Resolution Images
by: Smith, Ethan, et al.
Published: (2024)
by: Smith, Ethan, et al.
Published: (2024)
CAFlow: Adaptive-Depth Single-Step Flow Matching for Efficient Histopathology Super-Resolution
by: Yoshai, Elad, et al.
Published: (2026)
by: Yoshai, Elad, et al.
Published: (2026)
Adaptive Channel Allocation for Robust Differentiable Architecture Search
by: Li, Chao, et al.
Published: (2022)
by: Li, Chao, et al.
Published: (2022)
Efficient3D: A Unified Framework for Adaptive and Debiased Token Reduction in 3D MLLMs
by: Lin, Yuhui, et al.
Published: (2026)
by: Lin, Yuhui, et al.
Published: (2026)
Are Semi-Dense Detector-Free Methods Good at Matching Local Features?
by: Vilain, Matthieu, et al.
Published: (2024)
by: Vilain, Matthieu, et al.
Published: (2024)
AdaptToken: Entropy-based Adaptive Token Selection for MLLM Long Video Understanding
by: Qi, Haozhe, et al.
Published: (2026)
by: Qi, Haozhe, et al.
Published: (2026)
Random Token Fusion for Multi-View Medical Diagnosis
by: Guo, Jingyu, et al.
Published: (2024)
by: Guo, Jingyu, et al.
Published: (2024)
ResAdapt: Adaptive Resolution for Efficient Multimodal Reasoning
by: Liao, Huanxuan, et al.
Published: (2026)
by: Liao, Huanxuan, et al.
Published: (2026)
Deepfake Detection Via Facial Feature Extraction and Modeling
by: Carter, Benjamin, et al.
Published: (2025)
by: Carter, Benjamin, et al.
Published: (2025)
Fixed-length Dense Descriptor for Efficient Fingerprint Matching
by: Pan, Zhiyu, et al.
Published: (2023)
by: Pan, Zhiyu, et al.
Published: (2023)
Where Do Tokens Go? Understanding Pruning Behaviors in STEP at High Resolutions
by: Szczepanski, Michal, et al.
Published: (2025)
by: Szczepanski, Michal, et al.
Published: (2025)
MixRI: Mixing Features of Reference Images for Novel Object Pose Estimation
by: Liu, Xinhang, et al.
Published: (2026)
by: Liu, Xinhang, et al.
Published: (2026)
Enhanced Cascade Prostate Cancer Classifier in mp-MRI Utilizing Recall Feedback Adaptive Loss and Prior Knowledge-Based Feature Extraction
by: Luo, Kun, et al.
Published: (2024)
by: Luo, Kun, et al.
Published: (2024)
Similar Items
-
RefTr: Recurrent Refinement of Confluent Trajectories for 3D Vascular Tree Centerlines
by: Naeem, Roman, et al.
Published: (2025) -
Trexplorer Super: Topologically Correct Centerline Tree Tracking of Tubular Objects in CT Volumes
by: Naeem, Roman, et al.
Published: (2025) -
SwInception -- Local Attention Meets Convolutions
by: Hagerman, David, et al.
Published: (2026) -
ECAP: Extensive Cut-and-Paste Augmentation for Unsupervised Domain Adaptive Semantic Segmentation
by: Brorsson, Erik, et al.
Published: (2024) -
ProSub: Probabilistic Open-Set Semi-Supervised Learning with Subspace-Based Out-of-Distribution Detection
by: Wallin, Erik, et al.
Published: (2024)