TokenSeg: Efficient 3D Medical Image Segmentation via Hierarchical Visual Token Compression
Fuente:
arXiv
Guardado en:
| Autores principales: | Zeng, Sen, Zhou, Hong, Zhu, Zheng, Liu, Yang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
VQ-Seg: Vector-Quantized Token Perturbation for Semi-Supervised Medical Image Segmentation
por: Yang, Sicheng, et al.
Publicado: (2026)
por: Yang, Sicheng, et al.
Publicado: (2026)
SegMoTE: Token-Level Mixture of Experts for Medical Image Segmentation
por: Lu, Yujie, et al.
Publicado: (2026)
por: Lu, Yujie, et al.
Publicado: (2026)
TCSAFormer: Efficient Vision Transformer with Token Compression and Sparse Attention for Medical Image Segmentation
por: Xia, Zunhui, et al.
Publicado: (2025)
por: Xia, Zunhui, et al.
Publicado: (2025)
SegFormer3D: an Efficient Transformer for 3D Medical Image Segmentation
por: Perera, Shehan, et al.
Publicado: (2024)
por: Perera, Shehan, et al.
Publicado: (2024)
Enhancing 3D Transformer Segmentation Model for Medical Image with Token-level Representation Learning
por: Hu, Xinrong, et al.
Publicado: (2024)
por: Hu, Xinrong, et al.
Publicado: (2024)
SegDINO: An Efficient Design for Medical and Natural Image Segmentation with DINO-V3
por: Yang, Sicheng, et al.
Publicado: (2025)
por: Yang, Sicheng, et al.
Publicado: (2025)
SegMamba: Long-range Sequential Modeling Mamba For 3D Medical Image Segmentation
por: Xing, Zhaohu, et al.
Publicado: (2024)
por: Xing, Zhaohu, et al.
Publicado: (2024)
Medical Referring Image Segmentation via Next-Token Mask Prediction
por: Chen, Xinyu, et al.
Publicado: (2025)
por: Chen, Xinyu, et al.
Publicado: (2025)
VisionSelector: End-to-End Learnable Visual Token Compression for Efficient Multimodal LLMs
por: Zhu, Jiaying, et al.
Publicado: (2025)
por: Zhu, Jiaying, et al.
Publicado: (2025)
Compression Tells Intelligence: Visual Coding, Visual Token Technology, and the Unification
por: Jin, Xin, et al.
Publicado: (2026)
por: Jin, Xin, et al.
Publicado: (2026)
Prompt-based Dynamic Token Pruning for Efficient Segmentation of Medical Images
por: Dutta, Pallabi, et al.
Publicado: (2025)
por: Dutta, Pallabi, et al.
Publicado: (2025)
TokenCarve: Information-Preserving Visual Token Compression in Multimodal Large Language Models
por: Tan, Xudong, et al.
Publicado: (2025)
por: Tan, Xudong, et al.
Publicado: (2025)
FocusLLaVA: A Coarse-to-Fine Approach for Efficient and Effective Visual Token Compression
por: Zhu, Yuke, et al.
Publicado: (2024)
por: Zhu, Yuke, et al.
Publicado: (2024)
SegStitch: Multidimensional Transformer for Robust and Efficient Medical Imaging Segmentation
por: Tan, Shengbo, et al.
Publicado: (2024)
por: Tan, Shengbo, et al.
Publicado: (2024)
One Token to Seg Them All: Language Instructed Reasoning Segmentation in Videos
por: Bai, Zechen, et al.
Publicado: (2024)
por: Bai, Zechen, et al.
Publicado: (2024)
SegResMamba: An Efficient Architecture for 3D Medical Image Segmentation
por: Das, Badhan Kumar, et al.
Publicado: (2025)
por: Das, Badhan Kumar, et al.
Publicado: (2025)
Accelerating Streaming Video Large Language Models via Hierarchical Token Compression
por: Wang, Yiyu, et al.
Publicado: (2025)
por: Wang, Yiyu, et al.
Publicado: (2025)
MedPruner: Training-Free Hierarchical Token Pruning for Efficient 3D Medical Image Understanding in Vision-Language Models
por: Liu, Shengyuan, et al.
Publicado: (2026)
por: Liu, Shengyuan, et al.
Publicado: (2026)
BiSegMamba: Efficient Bidirectional Tri-Oriented Mamba for 3D Medical Image Segmentation
por: Zada, Bakht, et al.
Publicado: (2026)
por: Zada, Bakht, et al.
Publicado: (2026)
TM-UNet: Token-Memory Enhanced Sequential Modeling for Efficient Medical Image Segmentation
por: Jiao, Yaxuan, et al.
Publicado: (2025)
por: Jiao, Yaxuan, et al.
Publicado: (2025)
HCC-3D: Hierarchical Compensatory Compression for 98% 3D Token Reduction in Vision-Language Models
por: Zhang, Liheng, et al.
Publicado: (2025)
por: Zhang, Liheng, et al.
Publicado: (2025)
ResTok: Learning Hierarchical Residuals in 1D Visual Tokenizers for Autoregressive Image Generation
por: Zhang, Xu, et al.
Publicado: (2026)
por: Zhang, Xu, et al.
Publicado: (2026)
LaCo: Efficient Layer-wise Compression of Visual Tokens for Multimodal Large Language Models
por: Liu, Juntao, et al.
Publicado: (2025)
por: Liu, Juntao, et al.
Publicado: (2025)
Seg-VAR: Image Segmentation with Visual Autoregressive Modeling
por: Zheng, Rongkun, et al.
Publicado: (2025)
por: Zheng, Rongkun, et al.
Publicado: (2025)
Decoupled Seg Tokens Make Stronger Reasoning Video Segmenter and Grounder
por: Jisheng, Dang, et al.
Publicado: (2025)
por: Jisheng, Dang, et al.
Publicado: (2025)
Contribution-aware Token Compression for Efficient Video Understanding via Reinforcement Learning
por: Ma, Yinchao, et al.
Publicado: (2026)
por: Ma, Yinchao, et al.
Publicado: (2026)
MambaMIM: Pre-training Mamba with State Space Token Interpolation and its Application to Medical Image Segmentation
por: Tang, Fenghe, et al.
Publicado: (2024)
por: Tang, Fenghe, et al.
Publicado: (2024)
Efficient Multi-modal Large Language Models via Visual Token Grouping
por: Huang, Minbin, et al.
Publicado: (2024)
por: Huang, Minbin, et al.
Publicado: (2024)
Aligning Text, Images, and 3D Structure Token-by-Token
por: Sahoo, Aadarsh, et al.
Publicado: (2025)
por: Sahoo, Aadarsh, et al.
Publicado: (2025)
Top-Down Compression: Revisit Efficient Vision Token Projection for Visual Instruction Tuning
por: li, Bonan, et al.
Publicado: (2025)
por: li, Bonan, et al.
Publicado: (2025)
InstructSeg: Unifying Instructed Visual Segmentation with Multi-modal Large Language Models
por: Wei, Cong, et al.
Publicado: (2024)
por: Wei, Cong, et al.
Publicado: (2024)
QG-VTC: Question-Guided Visual Token Compression in MLLMs for Efficient VQA
por: Li, Shuai, et al.
Publicado: (2025)
por: Li, Shuai, et al.
Publicado: (2025)
PVC: Progressive Visual Token Compression for Unified Image and Video Processing in Large Vision-Language Models
por: Yang, Chenyu, et al.
Publicado: (2024)
por: Yang, Chenyu, et al.
Publicado: (2024)
Better Tokens for Better 3D: Advancing Vision-Language Modeling in 3D Medical Imaging
por: Hamamci, Ibrahim Ethem, et al.
Publicado: (2025)
por: Hamamci, Ibrahim Ethem, et al.
Publicado: (2025)
MedUniSeg: 2D and 3D Medical Image Segmentation via a Prompt-driven Universal Model
por: Ye, Yiwen, et al.
Publicado: (2024)
por: Ye, Yiwen, et al.
Publicado: (2024)
MARC: Memory-Augmented RL Token Compression for Efficient Video Understanding
por: Wu, Peiran, et al.
Publicado: (2025)
por: Wu, Peiran, et al.
Publicado: (2025)
TokenPacker: Efficient Visual Projector for Multimodal LLM
por: Li, Wentong, et al.
Publicado: (2024)
por: Li, Wentong, et al.
Publicado: (2024)
SimTxtSeg: Weakly-Supervised Medical Image Segmentation with Simple Text Cues
por: Xie, Yuxin, et al.
Publicado: (2024)
por: Xie, Yuxin, et al.
Publicado: (2024)
VASparse: Towards Efficient Visual Hallucination Mitigation via Visual-Aware Token Sparsification
por: Zhuang, Xianwei, et al.
Publicado: (2025)
por: Zhuang, Xianwei, et al.
Publicado: (2025)
An Efficient Token Compression Framework for Visual Object Tracking
por: Wu, Weijing, et al.
Publicado: (2026)
por: Wu, Weijing, et al.
Publicado: (2026)
Ejemplares similares
-
VQ-Seg: Vector-Quantized Token Perturbation for Semi-Supervised Medical Image Segmentation
por: Yang, Sicheng, et al.
Publicado: (2026) -
SegMoTE: Token-Level Mixture of Experts for Medical Image Segmentation
por: Lu, Yujie, et al.
Publicado: (2026) -
TCSAFormer: Efficient Vision Transformer with Token Compression and Sparse Attention for Medical Image Segmentation
por: Xia, Zunhui, et al.
Publicado: (2025) -
SegFormer3D: an Efficient Transformer for 3D Medical Image Segmentation
por: Perera, Shehan, et al.
Publicado: (2024) -
Enhancing 3D Transformer Segmentation Model for Medical Image with Token-level Representation Learning
por: Hu, Xinrong, et al.
Publicado: (2024)