Frustratingly Easy Test-Time Adaptation of Vision-Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Farina, Matteo, Franchi, Gianni, Iacca, Giovanni, Mancini, Massimiliano, Ricci, Elisa |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Rethinking Few-Shot Adaptation of Vision-Language Models in Two Stages
par: Farina, Matteo, et autres
Publié: (2025)
par: Farina, Matteo, et autres
Publié: (2025)
MULTIFLOW: Shifting Towards Task-Agnostic Vision-Language Pruning
par: Farina, Matteo, et autres
Publié: (2024)
par: Farina, Matteo, et autres
Publié: (2024)
Not Only Text: Exploring Compositionality of Visual Representations in Vision-Language Models
par: Berasi, Davide, et autres
Publié: (2025)
par: Berasi, Davide, et autres
Publié: (2025)
SEM: Sparse Embedding Modulation for Post-Hoc Debiasing of Vision-Language Models
par: Guimard, Quentin, et autres
Publié: (2026)
par: Guimard, Quentin, et autres
Publié: (2026)
Large Multimodal Models as General In-Context Classifiers
par: Garosi, Marco, et autres
Publié: (2026)
par: Garosi, Marco, et autres
Publié: (2026)
Less is more: Summarizing Patch Tokens for efficient Multi-Label Class-Incremental Learning
par: De Min, Thomas, et autres
Publié: (2024)
par: De Min, Thomas, et autres
Publié: (2024)
Classifier-to-Bias: Toward Unsupervised Automatic Bias Detection for Visual Classifiers
par: Guimard, Quentin, et autres
Publié: (2025)
par: Guimard, Quentin, et autres
Publié: (2025)
The Phantom Menace: Unmasking Privacy Leakages in Vision-Language Models
par: Caldarella, Simone, et autres
Publié: (2024)
par: Caldarella, Simone, et autres
Publié: (2024)
Safe Vision-Language Models via Unsafe Weights Manipulation
par: D'Incà, Moreno, et autres
Publié: (2025)
par: D'Incà, Moreno, et autres
Publié: (2025)
Automatic benchmarking of large multimodal models via iterative experiment programming
par: Conti, Alessandro, et autres
Publié: (2024)
par: Conti, Alessandro, et autres
Publié: (2024)
Test-time Vocabulary Adaptation for Language-driven Object Detection
par: Liu, Mingxuan, et autres
Publié: (2025)
par: Liu, Mingxuan, et autres
Publié: (2025)
TTP: Test-Time Padding for Adversarial Detection and Robust Adaptation on Vision-Language Models
par: Li, Zhiwei, et autres
Publié: (2025)
par: Li, Zhiwei, et autres
Publié: (2025)
Subspace Alignment for Vision-Language Model Test-time Adaptation
par: Zeng, Zhichen, et autres
Publié: (2026)
par: Zeng, Zhichen, et autres
Publié: (2026)
ProtoDCS: Towards Robust and Efficient Open-Set Test-Time Adaptation for Vision-Language Models
par: Luo, Wei, et autres
Publié: (2026)
par: Luo, Wei, et autres
Publié: (2026)
TAPS : Frustratingly Simple Test Time Active Learning for VLMs
par: Sarkar, Dhruv, et autres
Publié: (2025)
par: Sarkar, Dhruv, et autres
Publié: (2025)
Frustratingly Easy Feature Reconstruction for Out-of-Distribution Detection
par: Wang, Yingsheng, et autres
Publié: (2025)
par: Wang, Yingsheng, et autres
Publié: (2025)
Spurious Feature Eraser: Stabilizing Test-Time Adaptation for Vision-Language Foundation Model
par: Ma, Huan, et autres
Publié: (2024)
par: Ma, Huan, et autres
Publié: (2024)
StableTTA: Improving Vision Model Performance by Training-free Test-Time Adaptation Methods
par: Li, Zheng, et autres
Publié: (2026)
par: Li, Zheng, et autres
Publié: (2026)
Evolving Prompt Adaptation for Vision-Language Models
par: Zhang, Enming, et autres
Publié: (2026)
par: Zhang, Enming, et autres
Publié: (2026)
A Geometric Unification of Concept Learning with Concept Cones
par: Rocchi--Henry, Alexandre, et autres
Publié: (2025)
par: Rocchi--Henry, Alexandre, et autres
Publié: (2025)
DOTA: Distributional Test-Time Adaptation of Vision-Language Models
par: Han, Zongbo, et autres
Publié: (2024)
par: Han, Zongbo, et autres
Publié: (2024)
Multi-Cache Enhanced Prototype Learning for Test-Time Generalization of Vision-Language Models
par: Chen, Xinyu, et autres
Publié: (2025)
par: Chen, Xinyu, et autres
Publié: (2025)
Harnessing Large Language Models for Training-free Video Anomaly Detection
par: Zanella, Luca, et autres
Publié: (2024)
par: Zanella, Luca, et autres
Publié: (2024)
Concept-Based Mechanistic Interpretability Using Structured Knowledge Graphs
par: Chorna, Sofiia, et autres
Publié: (2025)
par: Chorna, Sofiia, et autres
Publié: (2025)
Chain-of-Adaptation: Surgical Vision-Language Adaptation with Reinforcement Learning
par: Li, Jiajie, et autres
Publié: (2026)
par: Li, Jiajie, et autres
Publié: (2026)
Benchmarking XAI Explanations with Human-Aligned Evaluations
par: Kazmierczak, Rémi, et autres
Publié: (2024)
par: Kazmierczak, Rémi, et autres
Publié: (2024)
ProactiveBench: Benchmarking Proactiveness in Multimodal Large Language Models
par: De Min, Thomas, et autres
Publié: (2026)
par: De Min, Thomas, et autres
Publié: (2026)
Towards Understanding Why Label Smoothing Degrades Selective Classification and How to Fix It
par: Xia, Guoxuan, et autres
Publié: (2024)
par: Xia, Guoxuan, et autres
Publié: (2024)
Organizing Unstructured Image Collections using Natural Language
par: Liu, Mingxuan, et autres
Publié: (2024)
par: Liu, Mingxuan, et autres
Publié: (2024)
Anthropogenic Regional Adaptation in Multimodal Vision-Language Model
par: Cahyawijaya, Samuel, et autres
Publié: (2026)
par: Cahyawijaya, Samuel, et autres
Publié: (2026)
Enhancing Adversarial Robustness of Vision-Language Models through Low-Rank Adaptation
par: Ji, Yuheng, et autres
Publié: (2024)
par: Ji, Yuheng, et autres
Publié: (2024)
MatRes: Zero-Shot Test-Time Model Adaptation for Simultaneous Matching and Restoration
par: Lee, Kanggeon, et autres
Publié: (2026)
par: Lee, Kanggeon, et autres
Publié: (2026)
When Small Guides Large: Cross-Model Co-Learning for Test-Time Adaptation
par: Yi, Chang'an, et autres
Publié: (2025)
par: Yi, Chang'an, et autres
Publié: (2025)
Distribution-Aware Continual Test-Time Adaptation for Semantic Segmentation
par: Ni, Jiayi, et autres
Publié: (2023)
par: Ni, Jiayi, et autres
Publié: (2023)
From Question to Exploration: Test-Time Adaptation in Semantic Segmentation?
par: Yi, Chang'an, et autres
Publié: (2023)
par: Yi, Chang'an, et autres
Publié: (2023)
Decoupling Stability and Plasticity for Multi-Modal Test-Time Adaptation
par: He, Yongbo, et autres
Publié: (2026)
par: He, Yongbo, et autres
Publié: (2026)
Return of Frustratingly Easy Unsupervised Video Domain Adaptation
par: Wei, Pengfei, et autres
Publié: (2026)
par: Wei, Pengfei, et autres
Publié: (2026)
Doubly Debiased Test-Time Prompt Tuning for Vision-Language Models
par: Song, Fei, et autres
Publié: (2025)
par: Song, Fei, et autres
Publié: (2025)
Linear Model Merging Unlocks Simple and Scalable Multimodal Data Mixture Optimization
par: Berasi, Davide, et autres
Publié: (2026)
par: Berasi, Davide, et autres
Publié: (2026)
The Geometry of Representational Failures in Vision Language Models
par: Savietto, Daniele, et autres
Publié: (2026)
par: Savietto, Daniele, et autres
Publié: (2026)
Documents similaires
-
Rethinking Few-Shot Adaptation of Vision-Language Models in Two Stages
par: Farina, Matteo, et autres
Publié: (2025) -
MULTIFLOW: Shifting Towards Task-Agnostic Vision-Language Pruning
par: Farina, Matteo, et autres
Publié: (2024) -
Not Only Text: Exploring Compositionality of Visual Representations in Vision-Language Models
par: Berasi, Davide, et autres
Publié: (2025) -
SEM: Sparse Embedding Modulation for Post-Hoc Debiasing of Vision-Language Models
par: Guimard, Quentin, et autres
Publié: (2026) -
Large Multimodal Models as General In-Context Classifiers
par: Garosi, Marco, et autres
Publié: (2026)