SegDebias: Test-Time Bias Mitigation for ViT-Based CLIP via Segmentation
Fuente:
arXiv
Salvato in:
| Autori principali: | Wu, Fangyu, Cai, Yujun |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ViT$^3$: Unlocking Test-Time Training in Vision
di: Han, Dongchen, et al.
Pubblicazione: (2025)
di: Han, Dongchen, et al.
Pubblicazione: (2025)
Your ViT is Secretly an Image Segmentation Model
di: Kerssies, Tommie, et al.
Pubblicazione: (2025)
di: Kerssies, Tommie, et al.
Pubblicazione: (2025)
Vanilla ViT for Automotive Point Cloud Semantic Segmentation
di: Puy, Gilles, et al.
Pubblicazione: (2026)
di: Puy, Gilles, et al.
Pubblicazione: (2026)
Applying ViT in Generalized Few-shot Semantic Segmentation
di: Geng, Liyuan, et al.
Pubblicazione: (2024)
di: Geng, Liyuan, et al.
Pubblicazione: (2024)
Test-Time Adaptation for Height Completion via Self-Supervised ViT Features and Monocular Foundation Models
di: Rafaeli, Osher, et al.
Pubblicazione: (2026)
di: Rafaeli, Osher, et al.
Pubblicazione: (2026)
Deeper Inside Deep ViT
di: Hong, Sungrae
Pubblicazione: (2025)
di: Hong, Sungrae
Pubblicazione: (2025)
SPAR: Single-Pass Any-Resolution ViT for Open-vocabulary Segmentation
di: Kombol, Naomi, et al.
Pubblicazione: (2026)
di: Kombol, Naomi, et al.
Pubblicazione: (2026)
I&S-ViT: An Inclusive & Stable Method for Pushing the Limit of Post-Training ViTs Quantization
di: Zhong, Yunshan, et al.
Pubblicazione: (2023)
di: Zhong, Yunshan, et al.
Pubblicazione: (2023)
Few-Shot Class-Incremental Model Attribution Using Learnable Representation From CLIP-ViT Features
di: Lee, Hanbyul, et al.
Pubblicazione: (2025)
di: Lee, Hanbyul, et al.
Pubblicazione: (2025)
DeNAS-ViT: Data Efficient NAS-Optimized Vision Transformer for Ultrasound Image Segmentation
di: Chen, Renqi, et al.
Pubblicazione: (2024)
di: Chen, Renqi, et al.
Pubblicazione: (2024)
Decomposing and Interpreting Image Representations via Text in ViTs Beyond CLIP
di: Balasubramanian, Sriram, et al.
Pubblicazione: (2024)
di: Balasubramanian, Sriram, et al.
Pubblicazione: (2024)
InvSeg: Test-Time Prompt Inversion for Semantic Segmentation
di: Lin, Jiayi, et al.
Pubblicazione: (2024)
di: Lin, Jiayi, et al.
Pubblicazione: (2024)
ViG-Bias: Visually Grounded Bias Discovery and Mitigation
di: Marani, Badr-Eddine, et al.
Pubblicazione: (2024)
di: Marani, Badr-Eddine, et al.
Pubblicazione: (2024)
RepViT: Revisiting Mobile CNN From ViT Perspective
di: Wang, Ao, et al.
Pubblicazione: (2023)
di: Wang, Ao, et al.
Pubblicazione: (2023)
TransForSeg: A Multitask Stereo ViT for Joint Stereo Segmentation and 3D Force Estimation in Catheterization
di: Fekri, Pedram, et al.
Pubblicazione: (2025)
di: Fekri, Pedram, et al.
Pubblicazione: (2025)
Partial CLIP is Enough: Chimera-Seg for Zero-shot Semantic Segmentation
di: Chen, Jialei, et al.
Pubblicazione: (2025)
di: Chen, Jialei, et al.
Pubblicazione: (2025)
ViTA-Seg: Vision Transformer for Amodal Segmentation in Robotics
di: Caramia, Donato, et al.
Pubblicazione: (2025)
di: Caramia, Donato, et al.
Pubblicazione: (2025)
Do Students Debias Like Teachers? On the Distillability of Bias Mitigation Methods
di: Cheng, Jiali, et al.
Pubblicazione: (2025)
di: Cheng, Jiali, et al.
Pubblicazione: (2025)
VidEoMT: Your ViT is Secretly Also a Video Segmentation Model
di: Norouzi, Narges, et al.
Pubblicazione: (2026)
di: Norouzi, Narges, et al.
Pubblicazione: (2026)
Sub-token ViT Embedding via Stochastic Resonance Transformers
di: Lao, Dong, et al.
Pubblicazione: (2023)
di: Lao, Dong, et al.
Pubblicazione: (2023)
Rethinking Random Masking in Self-Distillation on ViT
di: Seong, Jihyeon, et al.
Pubblicazione: (2025)
di: Seong, Jihyeon, et al.
Pubblicazione: (2025)
YOLO-Former: YOLO Shakes Hand With ViT
di: Khoramdel, Javad, et al.
Pubblicazione: (2024)
di: Khoramdel, Javad, et al.
Pubblicazione: (2024)
ViT-5: Vision Transformers for The Mid-2020s
di: Wang, Feng, et al.
Pubblicazione: (2026)
di: Wang, Feng, et al.
Pubblicazione: (2026)
ReCLIP++: Learn to Rectify the Bias of CLIP for Unsupervised Semantic Segmentation
di: Wang, Jingyun, et al.
Pubblicazione: (2024)
di: Wang, Jingyun, et al.
Pubblicazione: (2024)
MPTQ-ViT: Mixed-Precision Post-Training Quantization for Vision Transformer
di: Tai, Yu-Shan, et al.
Pubblicazione: (2024)
di: Tai, Yu-Shan, et al.
Pubblicazione: (2024)
ERVD: An Efficient and Robust ViT-Based Distillation Framework for Remote Sensing Image Retrieval
di: Dong, Le, et al.
Pubblicazione: (2024)
di: Dong, Le, et al.
Pubblicazione: (2024)
Alias-Free ViT: Fractional Shift Invariance via Linear Attention
di: Michaeli, Hagay, et al.
Pubblicazione: (2025)
di: Michaeli, Hagay, et al.
Pubblicazione: (2025)
Is CLIP Cross-Eyed? Revealing and Mitigating Center Bias in the CLIP Family
di: Chew, Oscar, et al.
Pubblicazione: (2026)
di: Chew, Oscar, et al.
Pubblicazione: (2026)
STRAP-ViT: Segregated Tokens with Randomized -- Transformations for Defense against Adversarial Patches in ViTs
di: Chattopadhyay, Nandish, et al.
Pubblicazione: (2026)
di: Chattopadhyay, Nandish, et al.
Pubblicazione: (2026)
GradiSeg: Gradient-Guided Gaussian Segmentation with Enhanced 3D Boundary Precision
di: Li, Zehao, et al.
Pubblicazione: (2024)
di: Li, Zehao, et al.
Pubblicazione: (2024)
Colinearity Decay: Training Quantization-Friendly ViTs with Outlier Decay
di: Tong, Jin, et al.
Pubblicazione: (2026)
di: Tong, Jin, et al.
Pubblicazione: (2026)
ViTCAE: ViT-based Class-conditioned Autoencoder
di: Jebraeeli, Vahid, et al.
Pubblicazione: (2025)
di: Jebraeeli, Vahid, et al.
Pubblicazione: (2025)
APHQ-ViT: Post-Training Quantization with Average Perturbation Hessian Based Reconstruction for Vision Transformers
di: Wu, Zhuguanyu, et al.
Pubblicazione: (2025)
di: Wu, Zhuguanyu, et al.
Pubblicazione: (2025)
EA-ViT: Efficient Adaptation for Elastic Vision Transformer
di: Zhu, Chen, et al.
Pubblicazione: (2025)
di: Zhu, Chen, et al.
Pubblicazione: (2025)
One-Shot Multilingual Font Generation Via ViT
di: Wang, Zhiheng, et al.
Pubblicazione: (2024)
di: Wang, Zhiheng, et al.
Pubblicazione: (2024)
ACC-ViT : Atrous Convolution's Comeback in Vision Transformers
di: Ibtehaz, Nabil, et al.
Pubblicazione: (2024)
di: Ibtehaz, Nabil, et al.
Pubblicazione: (2024)
FastPose-ViT: A Vision Transformer for Real-Time Spacecraft Pose Estimation
di: Ancey, Pierre, et al.
Pubblicazione: (2025)
di: Ancey, Pierre, et al.
Pubblicazione: (2025)
A Dual-Mode ViT-Conditioned Diffusion Framework with an Adaptive Conditioning Bridge for Breast Cancer Segmentation
di: Singh, Prateek, et al.
Pubblicazione: (2025)
di: Singh, Prateek, et al.
Pubblicazione: (2025)
UniRefiner: Teaching Pre-trained ViTs to Self-Dispose Dross via Contrastive Register
di: Qiu, Congpei, et al.
Pubblicazione: (2026)
di: Qiu, Congpei, et al.
Pubblicazione: (2026)
Purrturbed but Stable: Human-Cat Invariant Representations Across CNNs, ViTs and Self-Supervised ViTs
di: Shah, Arya, et al.
Pubblicazione: (2025)
di: Shah, Arya, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ViT$^3$: Unlocking Test-Time Training in Vision
di: Han, Dongchen, et al.
Pubblicazione: (2025) -
Your ViT is Secretly an Image Segmentation Model
di: Kerssies, Tommie, et al.
Pubblicazione: (2025) -
Vanilla ViT for Automotive Point Cloud Semantic Segmentation
di: Puy, Gilles, et al.
Pubblicazione: (2026) -
Applying ViT in Generalized Few-shot Semantic Segmentation
di: Geng, Liyuan, et al.
Pubblicazione: (2024) -
Test-Time Adaptation for Height Completion via Self-Supervised ViT Features and Monocular Foundation Models
di: Rafaeli, Osher, et al.
Pubblicazione: (2026)