SPAR: Single-Pass Any-Resolution ViT for Open-vocabulary Segmentation
Fuente:
arXiv
Salvato in:
| Autori principali: | Kombol, Naomi, Martinović, Ivan, Šegvić, Siniša, Tolias, Giorgos |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
A Survey on Training-free Open-Vocabulary Semantic Segmentation
di: Kombol, Naomi, et al.
Pubblicazione: (2025)
di: Kombol, Naomi, et al.
Pubblicazione: (2025)
What Holds Back Open-Vocabulary Segmentation?
di: Šarić, Josip, et al.
Pubblicazione: (2025)
di: Šarić, Josip, et al.
Pubblicazione: (2025)
MC-PanDA: Mask Confidence for Panoptic Domain Adaptation
di: Martinović, Ivan, et al.
Pubblicazione: (2024)
di: Martinović, Ivan, et al.
Pubblicazione: (2024)
Hybrid Open-set Segmentation with Synthetic Negative Data
di: Grcić, Matej, et al.
Pubblicazione: (2023)
di: Grcić, Matej, et al.
Pubblicazione: (2023)
DEARLi: Decoupled Enhancement of Recognition and Localization for Semi-supervised Panoptic Segmentation
di: Martinović, Ivan, et al.
Pubblicazione: (2025)
di: Martinović, Ivan, et al.
Pubblicazione: (2025)
LPOSS: Label Propagation Over Patches and Pixels for Open-vocabulary Semantic Segmentation
di: Stojnić, Vladan, et al.
Pubblicazione: (2025)
di: Stojnić, Vladan, et al.
Pubblicazione: (2025)
Dense outlier detection and open-set recognition based on training with noisy negative images
di: Bevandić, Petra, et al.
Pubblicazione: (2021)
di: Bevandić, Petra, et al.
Pubblicazione: (2021)
Sequential keypoint density estimator: an overlooked baseline of skeleton-based video anomaly detection
di: Delić, Anja, et al.
Pubblicazione: (2025)
di: Delić, Anja, et al.
Pubblicazione: (2025)
Dynamic loss balancing and sequential enhancement for road-safety assessment and traffic scene classification
di: Kačan, Marin, et al.
Pubblicazione: (2022)
di: Kačan, Marin, et al.
Pubblicazione: (2022)
Retrieve and Segment: Are a Few Examples Enough to Bridge the Supervision Gap in Open-Vocabulary Segmentation?
di: Aravanis, Tilemachos, et al.
Pubblicazione: (2026)
di: Aravanis, Tilemachos, et al.
Pubblicazione: (2026)
Outlier detection by ensembling uncertainty with negative objectness
di: Delić, Anja, et al.
Pubblicazione: (2024)
di: Delić, Anja, et al.
Pubblicazione: (2024)
Weakly supervised training of universal visual concepts for multi-domain semantic segmentation
di: Bevandić, Petra, et al.
Pubblicazione: (2022)
di: Bevandić, Petra, et al.
Pubblicazione: (2022)
Crafting Distribution Shifts for Validation and Training in Single Source Domain Generalization
di: Efthymiadis, Nikos, et al.
Pubblicazione: (2024)
di: Efthymiadis, Nikos, et al.
Pubblicazione: (2024)
Your ViT is Secretly an Image Segmentation Model
di: Kerssies, Tommie, et al.
Pubblicazione: (2025)
di: Kerssies, Tommie, et al.
Pubblicazione: (2025)
Vanilla ViT for Automotive Point Cloud Semantic Segmentation
di: Puy, Gilles, et al.
Pubblicazione: (2026)
di: Puy, Gilles, et al.
Pubblicazione: (2026)
Applying ViT in Generalized Few-shot Semantic Segmentation
di: Geng, Liyuan, et al.
Pubblicazione: (2024)
di: Geng, Liyuan, et al.
Pubblicazione: (2024)
ViTAR: Vision Transformer with Any Resolution
di: Fan, Qihang, et al.
Pubblicazione: (2024)
di: Fan, Qihang, et al.
Pubblicazione: (2024)
HIRI-ViT: Scaling Vision Transformer with High Resolution Inputs
di: Yao, Ting, et al.
Pubblicazione: (2024)
di: Yao, Ting, et al.
Pubblicazione: (2024)
OpenVIS: Open-vocabulary Video Instance Segmentation
di: Guo, Pinxue, et al.
Pubblicazione: (2023)
di: Guo, Pinxue, et al.
Pubblicazione: (2023)
Deeper Inside Deep ViT
di: Hong, Sungrae
Pubblicazione: (2025)
di: Hong, Sungrae
Pubblicazione: (2025)
I&S-ViT: An Inclusive & Stable Method for Pushing the Limit of Post-Training ViTs Quantization
di: Zhong, Yunshan, et al.
Pubblicazione: (2023)
di: Zhong, Yunshan, et al.
Pubblicazione: (2023)
ELViS: Efficient Visual Similarity from Local Descriptors that Generalizes Across Domains
di: Suma, Pavel, et al.
Pubblicazione: (2026)
di: Suma, Pavel, et al.
Pubblicazione: (2026)
AMES: Asymmetric and Memory-Efficient Similarity Estimation for Instance-level Retrieval
di: Suma, Pavel, et al.
Pubblicazione: (2024)
di: Suma, Pavel, et al.
Pubblicazione: (2024)
RepViT: Revisiting Mobile CNN From ViT Perspective
di: Wang, Ao, et al.
Pubblicazione: (2023)
di: Wang, Ao, et al.
Pubblicazione: (2023)
Weakly Supervised 3D Open-vocabulary Segmentation
di: Liu, Kunhao, et al.
Pubblicazione: (2023)
di: Liu, Kunhao, et al.
Pubblicazione: (2023)
PosSAM: Panoptic Open-vocabulary Segment Anything
di: VS, Vibashan, et al.
Pubblicazione: (2024)
di: VS, Vibashan, et al.
Pubblicazione: (2024)
Quantile-based Maximum Likelihood Training for Outlier Detection
di: Taghikhah, Masoud, et al.
Pubblicazione: (2023)
di: Taghikhah, Masoud, et al.
Pubblicazione: (2023)
VidEoMT: Your ViT is Secretly Also a Video Segmentation Model
di: Norouzi, Narges, et al.
Pubblicazione: (2026)
di: Norouzi, Narges, et al.
Pubblicazione: (2026)
SegDebias: Test-Time Bias Mitigation for ViT-Based CLIP via Segmentation
di: Wu, Fangyu, et al.
Pubblicazione: (2025)
di: Wu, Fangyu, et al.
Pubblicazione: (2025)
Modulating CNN Features with Pre-Trained ViT Representations for Open-Vocabulary Object Detection
di: Gao, Xiangyu, et al.
Pubblicazione: (2025)
di: Gao, Xiangyu, et al.
Pubblicazione: (2025)
OSR-ViT: A Simple and Modular Framework for Open-Set Object Detection and Discovery
di: Inkawhich, Matthew, et al.
Pubblicazione: (2024)
di: Inkawhich, Matthew, et al.
Pubblicazione: (2024)
ViT-5: Vision Transformers for The Mid-2020s
di: Wang, Feng, et al.
Pubblicazione: (2026)
di: Wang, Feng, et al.
Pubblicazione: (2026)
Rethinking Random Masking in Self-Distillation on ViT
di: Seong, Jihyeon, et al.
Pubblicazione: (2025)
di: Seong, Jihyeon, et al.
Pubblicazione: (2025)
YOLO-Former: YOLO Shakes Hand With ViT
di: Khoramdel, Javad, et al.
Pubblicazione: (2024)
di: Khoramdel, Javad, et al.
Pubblicazione: (2024)
IGLOSS: Image Generation for Lidar Open-vocabulary Semantic Segmentation
di: Samet, Nermin, et al.
Pubblicazione: (2026)
di: Samet, Nermin, et al.
Pubblicazione: (2026)
STRAP-ViT: Segregated Tokens with Randomized -- Transformations for Defense against Adversarial Patches in ViTs
di: Chattopadhyay, Nandish, et al.
Pubblicazione: (2026)
di: Chattopadhyay, Nandish, et al.
Pubblicazione: (2026)
Instance-Level Generation for Representation Learning
di: Wu, Yankun, et al.
Pubblicazione: (2025)
di: Wu, Yankun, et al.
Pubblicazione: (2025)
DeNAS-ViT: Data Efficient NAS-Optimized Vision Transformer for Ultrasound Image Segmentation
di: Chen, Renqi, et al.
Pubblicazione: (2024)
di: Chen, Renqi, et al.
Pubblicazione: (2024)
ViTCAE: ViT-based Class-conditioned Autoencoder
di: Jebraeeli, Vahid, et al.
Pubblicazione: (2025)
di: Jebraeeli, Vahid, et al.
Pubblicazione: (2025)
Open-RGBT: Open-vocabulary RGB-T Zero-shot Semantic Segmentation in Open-world Environments
di: Yu, Meng, et al.
Pubblicazione: (2024)
di: Yu, Meng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
A Survey on Training-free Open-Vocabulary Semantic Segmentation
di: Kombol, Naomi, et al.
Pubblicazione: (2025) -
What Holds Back Open-Vocabulary Segmentation?
di: Šarić, Josip, et al.
Pubblicazione: (2025) -
MC-PanDA: Mask Confidence for Panoptic Domain Adaptation
di: Martinović, Ivan, et al.
Pubblicazione: (2024) -
Hybrid Open-set Segmentation with Synthetic Negative Data
di: Grcić, Matej, et al.
Pubblicazione: (2023) -
DEARLi: Decoupled Enhancement of Recognition and Localization for Semi-supervised Panoptic Segmentation
di: Martinović, Ivan, et al.
Pubblicazione: (2025)