Enregistré dans:
| Auteurs principaux: | Laiti, Francesco, Talon, Davide, Staiano, Jacopo, Ricci, Elisa |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2602.21877 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Conditioned Prompt-Optimization for Continual Deepfake Detection
par: Laiti, Francesco, et autres
Publié: (2024)
par: Laiti, Francesco, et autres
Publié: (2024)
One VLM to Keep it Learning: Generation and Balancing for Data-free Continual Visual Question Answering
par: Das, Deepayan, et autres
Publié: (2024)
par: Das, Deepayan, et autres
Publié: (2024)
Training-Free Personalization via Retrieval and Reasoning on Fingerprints
par: Das, Deepayan, et autres
Publié: (2025)
par: Das, Deepayan, et autres
Publié: (2025)
ProfVLM: A lightweight video-language model for multi-view proficiency estimation
par: Bianchi, Edoardo, et autres
Publié: (2025)
par: Bianchi, Edoardo, et autres
Publié: (2025)
Incremental Object-Based Novelty Detection with Feedback Loop
par: Caldarella, Simone, et autres
Publié: (2023)
par: Caldarella, Simone, et autres
Publié: (2023)
Evaluating Attribute Confusion in Fashion Text-to-Image Generation
par: Liu, Ziyue, et autres
Publié: (2025)
par: Liu, Ziyue, et autres
Publié: (2025)
ExpertAF: Expert Actionable Feedback from Video
par: Ashutosh, Kumar, et autres
Publié: (2024)
par: Ashutosh, Kumar, et autres
Publié: (2024)
Key Design Choices in Source-Free Unsupervised Domain Adaptation: An In-depth Empirical Analysis
par: Maracani, Andrea, et autres
Publié: (2024)
par: Maracani, Andrea, et autres
Publié: (2024)
Empowering Small VLMs to Think with Dynamic Memorization and Exploration
par: Liu, Jiazhen, et autres
Publié: (2025)
par: Liu, Jiazhen, et autres
Publié: (2025)
How Diffusion Models Memorize
par: Kim, Juyeop, et autres
Publié: (2025)
par: Kim, Juyeop, et autres
Publié: (2025)
Training-Free Semantic Multi-Object Tracking with Vision-Language Models
par: Bonat, Laurence, et autres
Publié: (2026)
par: Bonat, Laurence, et autres
Publié: (2026)
Specificity-aware reinforcement learning for fine-grained open-world classification
par: Angheben, Samuele, et autres
Publié: (2026)
par: Angheben, Samuele, et autres
Publié: (2026)
Seeing the Abstract: Translating the Abstract Language for Vision Language Models
par: Talon, Davide, et autres
Publié: (2025)
par: Talon, Davide, et autres
Publié: (2025)
Towards Unconstrained Human-Object Interaction
par: Tonini, Francesco, et autres
Publié: (2026)
par: Tonini, Francesco, et autres
Publié: (2026)
Dynamic Scoring with Enhanced Semantics for Training-Free Human-Object Interaction Detection
par: Tonini, Francesco, et autres
Publié: (2025)
par: Tonini, Francesco, et autres
Publié: (2025)
From Weights to Concepts: Data-Free Interpretability of CLIP via Singular Vector Decomposition
par: Gentile, Francesco, et autres
Publié: (2026)
par: Gentile, Francesco, et autres
Publié: (2026)
How (Mis)calibrated is Your Federated CLIP and What To Do About It?
par: Singha, Mainak, et autres
Publié: (2025)
par: Singha, Mainak, et autres
Publié: (2025)
AL-GTD: Deep Active Learning for Gaze Target Detection
par: Tonini, Francesco, et autres
Publié: (2024)
par: Tonini, Francesco, et autres
Publié: (2024)
Not Only Text: Exploring Compositionality of Visual Representations in Vision-Language Models
par: Berasi, Davide, et autres
Publié: (2025)
par: Berasi, Davide, et autres
Publié: (2025)
LOTS of Fashion! Multi-Conditioning for Image Generation via Sketch-Text Pairing
par: Girella, Federico, et autres
Publié: (2025)
par: Girella, Federico, et autres
Publié: (2025)
Multi-Level Conditioning by Pairing Localized Text and Sketch for Fashion Image Generation
par: Liu, Ziyue, et autres
Publié: (2026)
par: Liu, Ziyue, et autres
Publié: (2026)
Unconsciously Forget: Mitigating Memorization; Without Knowing What is being Memorized
par: Jin, Er, et autres
Publié: (2025)
par: Jin, Er, et autres
Publié: (2025)
Modeling Visual Memorability Assessment with Autoencoders Reveals Characteristics of Memorable Images
par: Bagheri, Elham, et autres
Publié: (2024)
par: Bagheri, Elham, et autres
Publié: (2024)
Interactive Episodic Memory with User Feedback
par: Subedi, Nikesh, et autres
Publié: (2026)
par: Subedi, Nikesh, et autres
Publié: (2026)
3D Object Detection from Images for Autonomous Driving: A Survey
par: Ma, Xinzhu, et autres
Publié: (2022)
par: Ma, Xinzhu, et autres
Publié: (2022)
The Phantom Menace: Unmasking Privacy Leakages in Vision-Language Models
par: Caldarella, Simone, et autres
Publié: (2024)
par: Caldarella, Simone, et autres
Publié: (2024)
Memorizing SAM: 3D Medical Segment Anything Model with Memorizing Transformer
par: Shao, Xinyuan, et autres
Publié: (2024)
par: Shao, Xinyuan, et autres
Publié: (2024)
Exploring Fine-grained Retail Product Discrimination with Zero-shot Object Classification Using Vision-Language Models
par: Tur, Anil Osman, et autres
Publié: (2024)
par: Tur, Anil Osman, et autres
Publié: (2024)
Retrieval-enriched zero-shot image classification in low-resource domains
par: Dall'Asen, Nicola, et autres
Publié: (2024)
par: Dall'Asen, Nicola, et autres
Publié: (2024)
Unlearning Personal Data from a Single Image
par: De Min, Thomas, et autres
Publié: (2024)
par: De Min, Thomas, et autres
Publié: (2024)
Understanding the Impact of Negative Prompts: When and How Do They Take Effect?
par: Ban, Yuanhao, et autres
Publié: (2024)
par: Ban, Yuanhao, et autres
Publié: (2024)
Large Multimodal Models as General In-Context Classifiers
par: Garosi, Marco, et autres
Publié: (2026)
par: Garosi, Marco, et autres
Publié: (2026)
Compositional Caching for Training-free Open-vocabulary Attribute Detection
par: Garosi, Marco, et autres
Publié: (2025)
par: Garosi, Marco, et autres
Publié: (2025)
Harnessing Large Language Models for Training-free Video Anomaly Detection
par: Zanella, Luca, et autres
Publié: (2024)
par: Zanella, Luca, et autres
Publié: (2024)
Test-Time Zero-Shot Temporal Action Localization
par: Liberatori, Benedetta, et autres
Publié: (2024)
par: Liberatori, Benedetta, et autres
Publié: (2024)
Novel class discovery meets foundation models for 3D semantic segmentation
par: Riz, Luigi, et autres
Publié: (2023)
par: Riz, Luigi, et autres
Publié: (2023)
Training-free Online Video Step Grounding
par: Zanella, Luca, et autres
Publié: (2025)
par: Zanella, Luca, et autres
Publié: (2025)
Task-Focused Memorization for Multimodal Agents
par: Zou, Tao, et autres
Publié: (2026)
par: Zou, Tao, et autres
Publié: (2026)
Investigating Memorization in Video Diffusion Models
par: Chen, Chen, et autres
Publié: (2024)
par: Chen, Chen, et autres
Publié: (2024)
Towards Memorization-Free Diffusion Models
par: Chen, Chen, et autres
Publié: (2024)
par: Chen, Chen, et autres
Publié: (2024)
Documents similaires
-
Conditioned Prompt-Optimization for Continual Deepfake Detection
par: Laiti, Francesco, et autres
Publié: (2024) -
One VLM to Keep it Learning: Generation and Balancing for Data-free Continual Visual Question Answering
par: Das, Deepayan, et autres
Publié: (2024) -
Training-Free Personalization via Retrieval and Reasoning on Fingerprints
par: Das, Deepayan, et autres
Publié: (2025) -
ProfVLM: A lightweight video-language model for multi-view proficiency estimation
par: Bianchi, Edoardo, et autres
Publié: (2025) -
Incremental Object-Based Novelty Detection with Feedback Loop
par: Caldarella, Simone, et autres
Publié: (2023)