Partial Ring Scan: Revisiting Scan Order in Vision State Space Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Hsieh, Yi-Kuan, Hsieh, Jun-Wei, li, Xin, Chang, Ming-Ching, Tseng, Yu-Chee |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Block-based Symmetric Pruning and Fusion for Efficient Vision Transformers
di: Hsieh, Yi-Kuan, et al.
Pubblicazione: (2025)
di: Hsieh, Yi-Kuan, et al.
Pubblicazione: (2025)
ShadowMamba: State-Space Model with Boundary-Region Selective Scan for Shadow Removal
di: Zhu, Xiujin, et al.
Pubblicazione: (2024)
di: Zhu, Xiujin, et al.
Pubblicazione: (2024)
DAMamba: Vision State Space Model with Dynamic Adaptive Scan
di: Li, Tanzhe, et al.
Pubblicazione: (2025)
di: Li, Tanzhe, et al.
Pubblicazione: (2025)
Scalable Visual State Space Model with Fractal Scanning
di: Tang, Lv, et al.
Pubblicazione: (2024)
di: Tang, Lv, et al.
Pubblicazione: (2024)
LocalMamba: Visual State Space Model with Windowed Selective Scan
di: Huang, Tao, et al.
Pubblicazione: (2024)
di: Huang, Tao, et al.
Pubblicazione: (2024)
Selective State Space Memory for Large Vision-Language Models
di: Ng, Chee, et al.
Pubblicazione: (2024)
di: Ng, Chee, et al.
Pubblicazione: (2024)
BadScan: An Architectural Backdoor Attack on Visual State Space Models
di: Deshmukh, Om Suhas, et al.
Pubblicazione: (2024)
di: Deshmukh, Om Suhas, et al.
Pubblicazione: (2024)
SMILEtrack: SiMIlarity LEarning for Occlusion-Aware Multiple Object Tracking
di: Wang, Yu-Hsiang, et al.
Pubblicazione: (2022)
di: Wang, Yu-Hsiang, et al.
Pubblicazione: (2022)
ScanFormer: Referring Expression Comprehension by Iteratively Scanning
di: Su, Wei, et al.
Pubblicazione: (2024)
di: Su, Wei, et al.
Pubblicazione: (2024)
Vision Transformer with Sparse Scan Prior
di: Zhang, Yuguang, et al.
Pubblicazione: (2024)
di: Zhang, Yuguang, et al.
Pubblicazione: (2024)
Interactive State Space Model with Cross-Modal Local Scanning for Depth Super-Resolution
di: Wu, Chen, et al.
Pubblicazione: (2026)
di: Wu, Chen, et al.
Pubblicazione: (2026)
QuadMamba: Learning Quadtree-based Selective Scan for Visual State Space Model
di: Xie, Fei, et al.
Pubblicazione: (2024)
di: Xie, Fei, et al.
Pubblicazione: (2024)
MambaVSR: Content-Aware Scanning State Space Model for Video Super-Resolution
di: He, Linfeng, et al.
Pubblicazione: (2025)
di: He, Linfeng, et al.
Pubblicazione: (2025)
Burst Image Super-Resolution via Multi-Cross Attention Encoding and Multi-Scan State-Space Decoding
di: Huang, Tengda, et al.
Pubblicazione: (2025)
di: Huang, Tengda, et al.
Pubblicazione: (2025)
HAMSA: Scanning-Free Vision State Space Models via SpectralPulseNet
di: Patro, Badri N., et al.
Pubblicazione: (2026)
di: Patro, Badri N., et al.
Pubblicazione: (2026)
Colonoscopy Coverage Revisited: Identifying Scanning Gaps in Real-Time
di: Leifman, G., et al.
Pubblicazione: (2023)
di: Leifman, G., et al.
Pubblicazione: (2023)
MFil-Mamba: Multi-Filter Scanning for Spatial Redundancy-Aware Visual State Space Models
di: Khadka, Puskal, et al.
Pubblicazione: (2026)
di: Khadka, Puskal, et al.
Pubblicazione: (2026)
ELSA: Exact Linear-Scan Attention for Fast and Memory-Light Vision Transformers
di: Hsu, Chih-Chung, et al.
Pubblicazione: (2026)
di: Hsu, Chih-Chung, et al.
Pubblicazione: (2026)
Color Spike Data Generation via Bio-inspired Neuron-like Encoding with an Artificial Photoreceptor Layer
di: Ching-Teng, Hsieh, et al.
Pubblicazione: (2025)
di: Ching-Teng, Hsieh, et al.
Pubblicazione: (2025)
The Hard Positive Truth about Vision-Language Compositionality
di: Kamath, Amita, et al.
Pubblicazione: (2024)
di: Kamath, Amita, et al.
Pubblicazione: (2024)
AtrousMamaba: An Atrous-Window Scanning Visual State Space Model for Remote Sensing Change Detection
di: Wang, Tao, et al.
Pubblicazione: (2025)
di: Wang, Tao, et al.
Pubblicazione: (2025)
TinyFormer: Preserving Tiny Objects in YOLO-DETR Hybrid Real-time Detectors
di: Hsieh, Jun-Wei, et al.
Pubblicazione: (2026)
di: Hsieh, Jun-Wei, et al.
Pubblicazione: (2026)
Handheld Video Document Scanning: A Robust On-Device Model for Multi-Page Document Scanning
di: Wigington, Curtis
Pubblicazione: (2024)
di: Wigington, Curtis
Pubblicazione: (2024)
ScanEdit: Hierarchically-Guided Functional 3D Scan Editing
di: Boudjoghra, Mohamed el amine, et al.
Pubblicazione: (2025)
di: Boudjoghra, Mohamed el amine, et al.
Pubblicazione: (2025)
ScanTalk: 3D Talking Heads from Unregistered Scans
di: Nocentini, Federico, et al.
Pubblicazione: (2024)
di: Nocentini, Federico, et al.
Pubblicazione: (2024)
Beyond Global Scanning: Adaptive Visual State Space Modeling for Salient Object Detection in Optical Remote Sensing Images
di: Ren, Mengyu, et al.
Pubblicazione: (2025)
di: Ren, Mengyu, et al.
Pubblicazione: (2025)
MP-PolarMask: A Faster and Finer Instance Segmentation for Concave Images
di: Wang, Ke-Lei, et al.
Pubblicazione: (2024)
di: Wang, Ke-Lei, et al.
Pubblicazione: (2024)
EAMamba: Efficient All-Around Vision State Space Model for Image Restoration
di: Lin, Yu-Cheng, et al.
Pubblicazione: (2025)
di: Lin, Yu-Cheng, et al.
Pubblicazione: (2025)
From Scan to Action: Leveraging Realistic Scans for Embodied Scene Understanding
di: Halacheva, Anna-Maria, et al.
Pubblicazione: (2025)
di: Halacheva, Anna-Maria, et al.
Pubblicazione: (2025)
Efficient Vision Mamba for MRI Super-Resolution via Hybrid Selective Scanning
di: Safari, Mojtaba, et al.
Pubblicazione: (2025)
di: Safari, Mojtaba, et al.
Pubblicazione: (2025)
VMambaMorph: a Multi-Modality Deformable Image Registration Framework based on Visual State Space Model with Cross-Scan Module
di: Wang, Ziyang, et al.
Pubblicazione: (2024)
di: Wang, Ziyang, et al.
Pubblicazione: (2024)
Top-Down Compression: Revisit Efficient Vision Token Projection for Visual Instruction Tuning
di: li, Bonan, et al.
Pubblicazione: (2025)
di: li, Bonan, et al.
Pubblicazione: (2025)
One CT Unified Model Training Framework to Rule All Scanning Protocols
di: Xu, Fengzhi, et al.
Pubblicazione: (2026)
di: Xu, Fengzhi, et al.
Pubblicazione: (2026)
DeepScan: A Training-Free Framework for Visually Grounded Reasoning in Large Vision-Language Models
di: Li, Yangfu, et al.
Pubblicazione: (2026)
di: Li, Yangfu, et al.
Pubblicazione: (2026)
ZonUI-3B: A Lightweight Vision-Language Model for Cross-Resolution GUI Grounding
di: Hsieh, ZongHan, et al.
Pubblicazione: (2025)
di: Hsieh, ZongHan, et al.
Pubblicazione: (2025)
Silhouette-to-Contour Registration: Aligning Intraoral Scan Models with Cephalometric Radiographs
di: Miao, Yiyi, et al.
Pubblicazione: (2025)
di: Miao, Yiyi, et al.
Pubblicazione: (2025)
MicroViTv2: Beyond the FLOPS for Edge Energy-Friendly Vision Transformers
di: Setyawan, Novendra, et al.
Pubblicazione: (2026)
di: Setyawan, Novendra, et al.
Pubblicazione: (2026)
MicroViT: A Vision Transformer with Low Complexity Self Attention for Edge Device
di: Setyawan, Novendra, et al.
Pubblicazione: (2025)
di: Setyawan, Novendra, et al.
Pubblicazione: (2025)
On Vision Transformers for Classification Tasks in Side-Scan Sonar Imagery
di: Sheffield, BW, et al.
Pubblicazione: (2024)
di: Sheffield, BW, et al.
Pubblicazione: (2024)
Neural Network-Based Tracking and 3D Reconstruction of Baseball Pitch Trajectories from Single-View 2D Video
di: Hsieh, Jhen
Pubblicazione: (2024)
di: Hsieh, Jhen
Pubblicazione: (2024)
Documenti analoghi
-
Block-based Symmetric Pruning and Fusion for Efficient Vision Transformers
di: Hsieh, Yi-Kuan, et al.
Pubblicazione: (2025) -
ShadowMamba: State-Space Model with Boundary-Region Selective Scan for Shadow Removal
di: Zhu, Xiujin, et al.
Pubblicazione: (2024) -
DAMamba: Vision State Space Model with Dynamic Adaptive Scan
di: Li, Tanzhe, et al.
Pubblicazione: (2025) -
Scalable Visual State Space Model with Fractal Scanning
di: Tang, Lv, et al.
Pubblicazione: (2024) -
LocalMamba: Visual State Space Model with Windowed Selective Scan
di: Huang, Tao, et al.
Pubblicazione: (2024)