Towards Training-free Anomaly Detection with Vision and Language Foundation Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Jinjin, Wang, Guodong, Jin, Yizhou, Huang, Di |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ONER: Online Experience Replay for Incremental Anomaly Detection
di: Jin, Yizhou, et al.
Pubblicazione: (2024)
di: Jin, Yizhou, et al.
Pubblicazione: (2024)
Reasoning-Driven Anomaly Detection and Localization with Image-Level Supervision
di: Jin, Yizhou, et al.
Pubblicazione: (2026)
di: Jin, Yizhou, et al.
Pubblicazione: (2026)
Harnessing Large Language Models for Training-free Video Anomaly Detection
di: Zanella, Luca, et al.
Pubblicazione: (2024)
di: Zanella, Luca, et al.
Pubblicazione: (2024)
One Language-Free Foundation Model Is Enough for Universal Vision Anomaly Detection
di: Gao, Bin-Bin, et al.
Pubblicazione: (2026)
di: Gao, Bin-Bin, et al.
Pubblicazione: (2026)
What Makes Synthetic Data Effective in Image Segmentation
di: Zhang, Jinjin, et al.
Pubblicazione: (2026)
di: Zhang, Jinjin, et al.
Pubblicazione: (2026)
Towards Unbiased Source-Free Object Detection via Vision Foundation Models
di: Cai, Zhi, et al.
Pubblicazione: (2026)
di: Cai, Zhi, et al.
Pubblicazione: (2026)
AnomalyMoE: Towards a Language-free Generalist Model for Unified Visual Anomaly Detection
di: Gu, Zhaopeng, et al.
Pubblicazione: (2025)
di: Gu, Zhaopeng, et al.
Pubblicazione: (2025)
HDM: Hybrid Diffusion Model for Unified Image Anomaly Detection
di: Weng, Zekang, et al.
Pubblicazione: (2025)
di: Weng, Zekang, et al.
Pubblicazione: (2025)
LIBERO-X: Robustness Litmus for Vision-Language-Action Models
di: Wang, Guodong, et al.
Pubblicazione: (2026)
di: Wang, Guodong, et al.
Pubblicazione: (2026)
SIGMA: Bridging Structural and Distributional Gaps for Vision Foundation Model Adaptation
di: Xiong, Lingyu, et al.
Pubblicazione: (2026)
di: Xiong, Lingyu, et al.
Pubblicazione: (2026)
Customizing Visual-Language Foundation Models for Multi-modal Anomaly Detection and Reasoning
di: Xu, Xiaohao, et al.
Pubblicazione: (2024)
di: Xu, Xiaohao, et al.
Pubblicazione: (2024)
Towards Fine-Grained Vision-Language Alignment for Few-Shot Anomaly Detection
di: Fan, Yuanting, et al.
Pubblicazione: (2025)
di: Fan, Yuanting, et al.
Pubblicazione: (2025)
Towards Zero-shot 3D Anomaly Localization
di: Wang, Yizhou, et al.
Pubblicazione: (2024)
di: Wang, Yizhou, et al.
Pubblicazione: (2024)
Implicit Modeling for Transferability Estimation of Vision Foundation Models
di: Zheng, Yaoyan, et al.
Pubblicazione: (2025)
di: Zheng, Yaoyan, et al.
Pubblicazione: (2025)
Rein++: Efficient Generalization and Adaptation for Semantic Segmentation with Vision Foundation Models
di: Wei, Zhixiang, et al.
Pubblicazione: (2025)
di: Wei, Zhixiang, et al.
Pubblicazione: (2025)
UniVAD: A Training-free Unified Model for Few-shot Visual Anomaly Detection
di: Gu, Zhaopeng, et al.
Pubblicazione: (2024)
di: Gu, Zhaopeng, et al.
Pubblicazione: (2024)
Stronger, Fewer, & Superior: Harnessing Vision Foundation Models for Domain Generalized Semantic Segmentation
di: Wei, Zhixiang, et al.
Pubblicazione: (2023)
di: Wei, Zhixiang, et al.
Pubblicazione: (2023)
Normal and Abnormal Pathology Knowledge-Augmented Vision-Language Model for Anomaly Detection in Pathology Images
di: Song, Jinsol, et al.
Pubblicazione: (2025)
di: Song, Jinsol, et al.
Pubblicazione: (2025)
Vision Foundation Model Embedding-Based Semantic Anomaly Detection
di: Ronecker, Max Peter, et al.
Pubblicazione: (2025)
di: Ronecker, Max Peter, et al.
Pubblicazione: (2025)
Vision-Language Models Assisted Unsupervised Video Anomaly Detection
di: Jiang, Yalong, et al.
Pubblicazione: (2024)
di: Jiang, Yalong, et al.
Pubblicazione: (2024)
Exploring Large Vision-Language Models for Robust and Efficient Industrial Anomaly Detection
di: Qian, Kun, et al.
Pubblicazione: (2024)
di: Qian, Kun, et al.
Pubblicazione: (2024)
AnomalyVFM -- Transforming Vision Foundation Models into Zero-Shot Anomaly Detectors
di: Fučka, Matic, et al.
Pubblicazione: (2026)
di: Fučka, Matic, et al.
Pubblicazione: (2026)
Less Could Be Better: Parameter-efficient Fine-tuning Advances Medical Vision Foundation Models
di: Lian, Chenyu, et al.
Pubblicazione: (2024)
di: Lian, Chenyu, et al.
Pubblicazione: (2024)
Towards Vision-Language Geo-Foundation Model: A Survey
di: Zhou, Yue, et al.
Pubblicazione: (2024)
di: Zhou, Yue, et al.
Pubblicazione: (2024)
Towards Training-free Open-world Segmentation via Image Prompt Foundation Models
di: Tang, Lv, et al.
Pubblicazione: (2023)
di: Tang, Lv, et al.
Pubblicazione: (2023)
Towards Generalist Intelligence in Dentistry: Vision Foundation Models for Oral and Maxillofacial Radiology
di: Huang, Xinrui, et al.
Pubblicazione: (2025)
di: Huang, Xinrui, et al.
Pubblicazione: (2025)
Adapting Visual-Language Models for Generalizable Anomaly Detection in Medical Images
di: Huang, Chaoqin, et al.
Pubblicazione: (2024)
di: Huang, Chaoqin, et al.
Pubblicazione: (2024)
Understanding and Improving Training-Free AI-Generated Image Detections with Vision Foundation Models
di: Tsai, Chung-Ting, et al.
Pubblicazione: (2024)
di: Tsai, Chung-Ting, et al.
Pubblicazione: (2024)
Test-Time Adaptive Object Detection with Foundation Model
di: Gao, Yingjie, et al.
Pubblicazione: (2025)
di: Gao, Yingjie, et al.
Pubblicazione: (2025)
Anomaly Detection by Adapting a pre-trained Vision Language Model
di: Cai, Yuxuan, et al.
Pubblicazione: (2024)
di: Cai, Yuxuan, et al.
Pubblicazione: (2024)
One for All: Toward Unified Foundation Models for Earth Vision
di: Xiong, Zhitong, et al.
Pubblicazione: (2024)
di: Xiong, Zhitong, et al.
Pubblicazione: (2024)
RegionGPT: Towards Region Understanding Vision Language Model
di: Guo, Qiushan, et al.
Pubblicazione: (2024)
di: Guo, Qiushan, et al.
Pubblicazione: (2024)
Training-Free Zero-Shot Temporal Action Detection with Vision-Language Models
di: Han, Chaolei, et al.
Pubblicazione: (2025)
di: Han, Chaolei, et al.
Pubblicazione: (2025)
Spatial Gram Alignment for Ultra-High-Resolution Image Synthesis
di: Zhang, Jinjin, et al.
Pubblicazione: (2026)
di: Zhang, Jinjin, et al.
Pubblicazione: (2026)
LLMind: Bio-inspired Training-free Adaptive Visual Representations for Vision-Language Models
di: Debnath, Soumyaratna, et al.
Pubblicazione: (2026)
di: Debnath, Soumyaratna, et al.
Pubblicazione: (2026)
Is Training Necessary for Anomaly Detection?
di: Zhang, Xingwu, et al.
Pubblicazione: (2026)
di: Zhang, Xingwu, et al.
Pubblicazione: (2026)
Simplifying Traffic Anomaly Detection with Video Foundation Models
di: Orlova, Svetlana, et al.
Pubblicazione: (2025)
di: Orlova, Svetlana, et al.
Pubblicazione: (2025)
AnomalyAgent: Training-Free Agentic Models for Zero-/Few-Shot Anomaly Detection
di: Zhang, Yi, et al.
Pubblicazione: (2026)
di: Zhang, Yi, et al.
Pubblicazione: (2026)
Vision-Language Models for Vision Tasks: A Survey
di: Zhang, Jingyi, et al.
Pubblicazione: (2023)
di: Zhang, Jingyi, et al.
Pubblicazione: (2023)
VLMDiff: Leveraging Vision-Language Models for Multi-Class Anomaly Detection with Diffusion
di: Hicsonmez, Samet, et al.
Pubblicazione: (2025)
di: Hicsonmez, Samet, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ONER: Online Experience Replay for Incremental Anomaly Detection
di: Jin, Yizhou, et al.
Pubblicazione: (2024) -
Reasoning-Driven Anomaly Detection and Localization with Image-Level Supervision
di: Jin, Yizhou, et al.
Pubblicazione: (2026) -
Harnessing Large Language Models for Training-free Video Anomaly Detection
di: Zanella, Luca, et al.
Pubblicazione: (2024) -
One Language-Free Foundation Model Is Enough for Universal Vision Anomaly Detection
di: Gao, Bin-Bin, et al.
Pubblicazione: (2026) -
What Makes Synthetic Data Effective in Image Segmentation
di: Zhang, Jinjin, et al.
Pubblicazione: (2026)