One Language-Free Foundation Model Is Enough for Universal Vision Anomaly Detection
Fuente:
arXiv
Salvato in:
| Autori principali: | Gao, Bin-Bin, Wang, Chengjie |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Towards Fine-Grained Vision-Language Alignment for Few-Shot Anomaly Detection
di: Fan, Yuanting, et al.
Pubblicazione: (2025)
di: Fan, Yuanting, et al.
Pubblicazione: (2025)
MetaUAS: Universal Anomaly Segmentation with One-Prompt Meta-Learning
di: Gao, Bin-Bin
Pubblicazione: (2025)
di: Gao, Bin-Bin
Pubblicazione: (2025)
Learning to Detect Multi-class Anomalies with Just One Normal Image Prompt
di: Gao, Bin-Bin
Pubblicazione: (2025)
di: Gao, Bin-Bin
Pubblicazione: (2025)
Enhancing Multi-Class Anomaly Detection via Diffusion Refinement with Dual Conditioning
di: Zhan, Jiawei, et al.
Pubblicazione: (2024)
di: Zhan, Jiawei, et al.
Pubblicazione: (2024)
AdaptCLIP: Adapting CLIP for Universal Visual Anomaly Detection
di: Gao, Bin-Bin, et al.
Pubblicazione: (2025)
di: Gao, Bin-Bin, et al.
Pubblicazione: (2025)
One Perturbation is Enough: On Generating Universal Adversarial Perturbations against Vision-Language Pre-training Models
di: Fang, Hao, et al.
Pubblicazione: (2024)
di: Fang, Hao, et al.
Pubblicazione: (2024)
Few-Shot Anomaly-Driven Generation for Anomaly Classification and Segmentation
di: Gui, Guan, et al.
Pubblicazione: (2025)
di: Gui, Guan, et al.
Pubblicazione: (2025)
AD-Copilot: A Vision-Language Assistant for Industrial Anomaly Detection via Visual In-context Comparison
di: Jiang, Xi, et al.
Pubblicazione: (2026)
di: Jiang, Xi, et al.
Pubblicazione: (2026)
MMAD: A Comprehensive Benchmark for Multimodal Large Language Models in Industrial Anomaly Detection
di: Jiang, Xi, et al.
Pubblicazione: (2024)
di: Jiang, Xi, et al.
Pubblicazione: (2024)
Large-Scale Universal Defect Generation: Foundation Models and Datasets
di: Fan, Yuanting, et al.
Pubblicazione: (2026)
di: Fan, Yuanting, et al.
Pubblicazione: (2026)
Towards Training-free Anomaly Detection with Vision and Language Foundation Models
di: Zhang, Jinjin, et al.
Pubblicazione: (2025)
di: Zhang, Jinjin, et al.
Pubblicazione: (2025)
SoftPatch+: Fully Unsupervised Anomaly Classification and Segmentation
di: Wang, Chengjie, et al.
Pubblicazione: (2024)
di: Wang, Chengjie, et al.
Pubblicazione: (2024)
Unsupervised Continual Anomaly Detection with Contrastively-learned Prompt
di: Liu, Jiaqi, et al.
Pubblicazione: (2024)
di: Liu, Jiaqi, et al.
Pubblicazione: (2024)
Real-IAD: A Real-World Multi-View Dataset for Benchmarking Versatile Industrial Anomaly Detection
di: Wang, Chengjie, et al.
Pubblicazione: (2024)
di: Wang, Chengjie, et al.
Pubblicazione: (2024)
SoftPatch: Unsupervised Anomaly Detection with Noisy Data
di: Jiang, Xi, et al.
Pubblicazione: (2024)
di: Jiang, Xi, et al.
Pubblicazione: (2024)
Towards Unbiased Source-Free Object Detection via Vision Foundation Models
di: Cai, Zhi, et al.
Pubblicazione: (2026)
di: Cai, Zhi, et al.
Pubblicazione: (2026)
Real-IAD Variety: Pushing Industrial Anomaly Detection Dataset to a Modern Era
di: Zhu, Wenbing, et al.
Pubblicazione: (2025)
di: Zhu, Wenbing, et al.
Pubblicazione: (2025)
VisualAD: Language-Free Zero-Shot Anomaly Detection via Vision Transformer
di: Hou, Yanning, et al.
Pubblicazione: (2026)
di: Hou, Yanning, et al.
Pubblicazione: (2026)
MatchDet: A Collaborative Framework for Image Matching and Object Detection
di: Lai, Jinxiang, et al.
Pubblicazione: (2023)
di: Lai, Jinxiang, et al.
Pubblicazione: (2023)
CLIP-AD: A Language-Guided Staged Dual-Path Model for Zero-shot Anomaly Detection
di: Chen, Xuhai, et al.
Pubblicazione: (2023)
di: Chen, Xuhai, et al.
Pubblicazione: (2023)
Vision Foundation Model Embedding-Based Semantic Anomaly Detection
di: Ronecker, Max Peter, et al.
Pubblicazione: (2025)
di: Ronecker, Max Peter, et al.
Pubblicazione: (2025)
Decoupling Classifier for Boosting Few-shot Object Detection and Instance Segmentation
di: Gao, Bin-Bin, et al.
Pubblicazione: (2025)
di: Gao, Bin-Bin, et al.
Pubblicazione: (2025)
Vision-Language Models Assisted Unsupervised Video Anomaly Detection
di: Jiang, Yalong, et al.
Pubblicazione: (2024)
di: Jiang, Yalong, et al.
Pubblicazione: (2024)
Exploring Large Vision-Language Models for Robust and Efficient Industrial Anomaly Detection
di: Qian, Kun, et al.
Pubblicazione: (2024)
di: Qian, Kun, et al.
Pubblicazione: (2024)
AnomalyVFM -- Transforming Vision Foundation Models into Zero-Shot Anomaly Detectors
di: Fučka, Matic, et al.
Pubblicazione: (2026)
di: Fučka, Matic, et al.
Pubblicazione: (2026)
Semantic Iterative Reconstruction: One-Shot Universal Anomaly Detection
di: Zhu, Ning
Pubblicazione: (2026)
di: Zhu, Ning
Pubblicazione: (2026)
Malicious Image Analysis via Vision-Language Segmentation Fusion: Detection, Element, and Location in One-shot
di: Hang, Sheng, et al.
Pubblicazione: (2025)
di: Hang, Sheng, et al.
Pubblicazione: (2025)
Dynamic Rank Adaptation for Vision-Language Models
di: Wang, Jiahui, et al.
Pubblicazione: (2025)
di: Wang, Jiahui, et al.
Pubblicazione: (2025)
Learning Multi-view Anomaly Detection with Efficient Adaptive Selection
di: He, Haoyang, et al.
Pubblicazione: (2024)
di: He, Haoyang, et al.
Pubblicazione: (2024)
FSOD-VFM: Few-Shot Object Detection with Vision Foundation Models and Graph Diffusion
di: Feng, Chen-Bin, et al.
Pubblicazione: (2026)
di: Feng, Chen-Bin, et al.
Pubblicazione: (2026)
When Large Vision-Language Models Meet Person Re-Identification
di: Wang, Qizao, et al.
Pubblicazione: (2024)
di: Wang, Qizao, et al.
Pubblicazione: (2024)
Is One GPU Enough? Pushing Image Generation at Higher-Resolutions with Foundation Models
di: Tragakis, Athanasios, et al.
Pubblicazione: (2024)
di: Tragakis, Athanasios, et al.
Pubblicazione: (2024)
Understanding and Improving Training-Free AI-Generated Image Detections with Vision Foundation Models
di: Tsai, Chung-Ting, et al.
Pubblicazione: (2024)
di: Tsai, Chung-Ting, et al.
Pubblicazione: (2024)
Integrated Structural Prompt Learning for Vision-Language Models
di: Wang, Jiahui, et al.
Pubblicazione: (2025)
di: Wang, Jiahui, et al.
Pubblicazione: (2025)
One for All: Toward Unified Foundation Models for Earth Vision
di: Xiong, Zhitong, et al.
Pubblicazione: (2024)
di: Xiong, Zhitong, et al.
Pubblicazione: (2024)
Anomaly Detection by Adapting a pre-trained Vision Language Model
di: Cai, Yuxuan, et al.
Pubblicazione: (2024)
di: Cai, Yuxuan, et al.
Pubblicazione: (2024)
Deep Industrial Image Anomaly Detection: A Survey
di: Liu, Jiaqi, et al.
Pubblicazione: (2023)
di: Liu, Jiaqi, et al.
Pubblicazione: (2023)
Boosting Gaze Object Prediction via Pixel-level Supervision from Vision Foundation Model
di: Jin, Yang, et al.
Pubblicazione: (2024)
di: Jin, Yang, et al.
Pubblicazione: (2024)
Sparse Reasoning is Enough: Biological-Inspired Framework for Video Anomaly Detection with Large Pre-trained Models
di: Huang, He, et al.
Pubblicazione: (2025)
di: Huang, He, et al.
Pubblicazione: (2025)
Real-IAD D3: A Real-World 2D/Pseudo-3D/3D Dataset for Industrial Anomaly Detection
di: Zhu, Wenbing, et al.
Pubblicazione: (2025)
di: Zhu, Wenbing, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Towards Fine-Grained Vision-Language Alignment for Few-Shot Anomaly Detection
di: Fan, Yuanting, et al.
Pubblicazione: (2025) -
MetaUAS: Universal Anomaly Segmentation with One-Prompt Meta-Learning
di: Gao, Bin-Bin
Pubblicazione: (2025) -
Learning to Detect Multi-class Anomalies with Just One Normal Image Prompt
di: Gao, Bin-Bin
Pubblicazione: (2025) -
Enhancing Multi-Class Anomaly Detection via Diffusion Refinement with Dual Conditioning
di: Zhan, Jiawei, et al.
Pubblicazione: (2024) -
AdaptCLIP: Adapting CLIP for Universal Visual Anomaly Detection
di: Gao, Bin-Bin, et al.
Pubblicazione: (2025)