The Phantom Menace: Unmasking Privacy Leakages in Vision-Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Caldarella, Simone, Mancini, Massimiliano, Ricci, Elisa, Aljundi, Rahaf |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Incremental Object-Based Novelty Detection with Feedback Loop
par: Caldarella, Simone, et autres
Publié: (2023)
par: Caldarella, Simone, et autres
Publié: (2023)
SEM: Sparse Embedding Modulation for Post-Hoc Debiasing of Vision-Language Models
par: Guimard, Quentin, et autres
Publié: (2026)
par: Guimard, Quentin, et autres
Publié: (2026)
Online In-Context Distillation for Low-Resource Vision Language Models
par: Kang, Zhiqi, et autres
Publié: (2025)
par: Kang, Zhiqi, et autres
Publié: (2025)
Rethinking Few-Shot Adaptation of Vision-Language Models in Two Stages
par: Farina, Matteo, et autres
Publié: (2025)
par: Farina, Matteo, et autres
Publié: (2025)
Frustratingly Easy Test-Time Adaptation of Vision-Language Models
par: Farina, Matteo, et autres
Publié: (2024)
par: Farina, Matteo, et autres
Publié: (2024)
Annotation Free Semantic Segmentation with Vision Foundation Models
par: Seifi, Soroush, et autres
Publié: (2024)
par: Seifi, Soroush, et autres
Publié: (2024)
Not Only Text: Exploring Compositionality of Visual Representations in Vision-Language Models
par: Berasi, Davide, et autres
Publié: (2025)
par: Berasi, Davide, et autres
Publié: (2025)
Efficient Few-Shot Continual Learning in Vision-Language Models
par: Panos, Aristeidis, et autres
Publié: (2025)
par: Panos, Aristeidis, et autres
Publié: (2025)
MULTIFLOW: Shifting Towards Task-Agnostic Vision-Language Pruning
par: Farina, Matteo, et autres
Publié: (2024)
par: Farina, Matteo, et autres
Publié: (2024)
Ego: Embedding-Guided Personalization of Vision-Language Models
par: Seifi, Soroush, et autres
Publié: (2026)
par: Seifi, Soroush, et autres
Publié: (2026)
Personalization Toolkit: Training Free Personalization of Large Vision Language Models
par: Seifi, Soroush, et autres
Publié: (2025)
par: Seifi, Soroush, et autres
Publié: (2025)
Harnessing Large Language Models for Training-free Video Anomaly Detection
par: Zanella, Luca, et autres
Publié: (2024)
par: Zanella, Luca, et autres
Publié: (2024)
Imperfect Vision Encoders: Efficient and Robust Tuning for Vision-Language Models
par: Panos, Aristeidis, et autres
Publié: (2024)
par: Panos, Aristeidis, et autres
Publié: (2024)
ProactiveBench: Benchmarking Proactiveness in Multimodal Large Language Models
par: De Min, Thomas, et autres
Publié: (2026)
par: De Min, Thomas, et autres
Publié: (2026)
Large Multimodal Models as General In-Context Classifiers
par: Garosi, Marco, et autres
Publié: (2026)
par: Garosi, Marco, et autres
Publié: (2026)
Overcoming Generic Knowledge Loss with Selective Parameter Update
par: Zhang, Wenxuan, et autres
Publié: (2023)
par: Zhang, Wenxuan, et autres
Publié: (2023)
Can Text-to-Video Generation help Video-Language Alignment?
par: Zanella, Luca, et autres
Publié: (2025)
par: Zanella, Luca, et autres
Publié: (2025)
One VLM to Keep it Learning: Generation and Balancing for Data-free Continual Visual Question Answering
par: Das, Deepayan, et autres
Publié: (2024)
par: Das, Deepayan, et autres
Publié: (2024)
Training-Free Personalization via Retrieval and Reasoning on Fingerprints
par: Das, Deepayan, et autres
Publié: (2025)
par: Das, Deepayan, et autres
Publié: (2025)
Compositional Caching for Training-free Open-vocabulary Attribute Detection
par: Garosi, Marco, et autres
Publié: (2025)
par: Garosi, Marco, et autres
Publié: (2025)
Training-free Online Video Step Grounding
par: Zanella, Luca, et autres
Publié: (2025)
par: Zanella, Luca, et autres
Publié: (2025)
On Large Multimodal Models as Open-World Image Classifiers
par: Conti, Alessandro, et autres
Publié: (2025)
par: Conti, Alessandro, et autres
Publié: (2025)
Test-time Vocabulary Adaptation for Language-driven Object Detection
par: Liu, Mingxuan, et autres
Publié: (2025)
par: Liu, Mingxuan, et autres
Publié: (2025)
Recurrent Attention-based Token Selection for Efficient Streaming Video-LLMs
par: Dorovatas, Vaggelis, et autres
Publié: (2025)
par: Dorovatas, Vaggelis, et autres
Publié: (2025)
Unlearning Personal Data from a Single Image
par: De Min, Thomas, et autres
Publié: (2024)
par: De Min, Thomas, et autres
Publié: (2024)
Phantom of Latent for Large Language and Vision Models
par: Lee, Byung-Kwan, et autres
Publié: (2024)
par: Lee, Byung-Kwan, et autres
Publié: (2024)
Vision-by-Language for Training-Free Compositional Image Retrieval
par: Karthik, Shyamgopal, et autres
Publié: (2023)
par: Karthik, Shyamgopal, et autres
Publié: (2023)
Vocabulary-free Image Classification and Semantic Segmentation
par: Conti, Alessandro, et autres
Publié: (2024)
par: Conti, Alessandro, et autres
Publié: (2024)
Vocabulary-free Image Classification
par: Conti, Alessandro, et autres
Publié: (2023)
par: Conti, Alessandro, et autres
Publié: (2023)
Enhancing Vision-Language Model with Unmasked Token Alignment
par: Liu, Jihao, et autres
Publié: (2024)
par: Liu, Jihao, et autres
Publié: (2024)
From Weights to Concepts: Data-Free Interpretability of CLIP via Singular Vector Decomposition
par: Gentile, Francesco, et autres
Publié: (2026)
par: Gentile, Francesco, et autres
Publié: (2026)
First Session Adaptation: A Strong Replay-Free Baseline for Class-Incremental Learning
par: Panos, Aristeidis, et autres
Publié: (2023)
par: Panos, Aristeidis, et autres
Publié: (2023)
Classifier-to-Bias: Toward Unsupervised Automatic Bias Detection for Visual Classifiers
par: Guimard, Quentin, et autres
Publié: (2025)
par: Guimard, Quentin, et autres
Publié: (2025)
Training-Free Semantic Multi-Object Tracking with Vision-Language Models
par: Bonat, Laurence, et autres
Publié: (2026)
par: Bonat, Laurence, et autres
Publié: (2026)
Less is more: Summarizing Patch Tokens for efficient Multi-Label Class-Incremental Learning
par: De Min, Thomas, et autres
Publié: (2024)
par: De Min, Thomas, et autres
Publié: (2024)
Memo: Training Memory-Efficient Embodied Agents with Reinforcement Learning
par: Gupta, Gunshi, et autres
Publié: (2025)
par: Gupta, Gunshi, et autres
Publié: (2025)
Automatic benchmarking of large multimodal models via iterative experiment programming
par: Conti, Alessandro, et autres
Publié: (2024)
par: Conti, Alessandro, et autres
Publié: (2024)
Enhancing Robustness of Vision-Language Models through Orthogonality Learning and Self-Regularization
par: Li, Jinlong, et autres
Publié: (2024)
par: Li, Jinlong, et autres
Publié: (2024)
Safe Vision-Language Models via Unsafe Weights Manipulation
par: D'Incà, Moreno, et autres
Publié: (2025)
par: D'Incà, Moreno, et autres
Publié: (2025)
Evaluating the Impact of Post-Training Quantization on Reliable VQA with Multimodal LLMs
par: Kurz, Paul Jonas, et autres
Publié: (2026)
par: Kurz, Paul Jonas, et autres
Publié: (2026)
Documents similaires
-
Incremental Object-Based Novelty Detection with Feedback Loop
par: Caldarella, Simone, et autres
Publié: (2023) -
SEM: Sparse Embedding Modulation for Post-Hoc Debiasing of Vision-Language Models
par: Guimard, Quentin, et autres
Publié: (2026) -
Online In-Context Distillation for Low-Resource Vision Language Models
par: Kang, Zhiqi, et autres
Publié: (2025) -
Rethinking Few-Shot Adaptation of Vision-Language Models in Two Stages
par: Farina, Matteo, et autres
Publié: (2025) -
Frustratingly Easy Test-Time Adaptation of Vision-Language Models
par: Farina, Matteo, et autres
Publié: (2024)