A Structured Benchmark for Text-Guided Anomaly Detection: When Language Stops Conditioning the Decision
Fuente:
arXiv
Salvato in:
| Autori principali: | Samele, Stefano, Lomurno, Eugenio, Jovanovic, Teodora, Manohar, Sanjay Shivakumar, Crivellaro, Alberto, Matteucci, Matteo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Federated Knowledge Recycling: Privacy-Preserving Synthetic Data Sharing
di: Lomurno, Eugenio, et al.
Pubblicazione: (2024)
di: Lomurno, Eugenio, et al.
Pubblicazione: (2024)
Synthetic Image Learning: Preserving Performance and Preventing Membership Inference Attacks
di: Lomurno, Eugenio, et al.
Pubblicazione: (2024)
di: Lomurno, Eugenio, et al.
Pubblicazione: (2024)
MARS: a Multimodal Alignment and Ranking System for Few-Shot Segmentation
di: Catalano, Nico, et al.
Pubblicazione: (2025)
di: Catalano, Nico, et al.
Pubblicazione: (2025)
Stable Diffusion Dataset Generation for Downstream Classification Tasks
di: Lomurno, Eugenio, et al.
Pubblicazione: (2024)
di: Lomurno, Eugenio, et al.
Pubblicazione: (2024)
POMONAG: Pareto-Optimal Many-Objective Neural Architecture Generator
di: Lomurno, Eugenio, et al.
Pubblicazione: (2024)
di: Lomurno, Eugenio, et al.
Pubblicazione: (2024)
Neuro-Symbolic Scene Graph Conditioning for Synthetic Image Dataset Generation
di: Savazzi, Giacomo, et al.
Pubblicazione: (2025)
di: Savazzi, Giacomo, et al.
Pubblicazione: (2025)
Your Image Generator Is Your New Private Dataset
di: Resmini, Nicolo, et al.
Pubblicazione: (2025)
di: Resmini, Nicolo, et al.
Pubblicazione: (2025)
PolyGen: Fully Synthetic Vision-Language Training via Multi-Generator Ensembles
di: Brusini, Leonardo, et al.
Pubblicazione: (2026)
di: Brusini, Leonardo, et al.
Pubblicazione: (2026)
Deep Variational Contrastive Learning for Joint Risk Stratification and Time-to-Event Estimation
di: Erbil, Pinar, et al.
Pubblicazione: (2026)
di: Erbil, Pinar, et al.
Pubblicazione: (2026)
FPBoost: Fully Parametric Gradient Boosting for Survival Analysis
di: Archetti, Alberto, et al.
Pubblicazione: (2024)
di: Archetti, Alberto, et al.
Pubblicazione: (2024)
A Lightweight Neural Architecture Search Model for Medical Image Classification
di: Xie, Lunchen, et al.
Pubblicazione: (2024)
di: Xie, Lunchen, et al.
Pubblicazione: (2024)
ZO-DARTS++: An Efficient and Size-Variable Zeroth-Order Neural Architecture Search Algorithm
di: Xie, Lunchen, et al.
Pubblicazione: (2025)
di: Xie, Lunchen, et al.
Pubblicazione: (2025)
SCENEFORGE: Enhancing 3D-text alignment with Structured Scene Compositions
di: Sbrolli, Cristian, et al.
Pubblicazione: (2025)
di: Sbrolli, Cristian, et al.
Pubblicazione: (2025)
Inference-Time Refinement Closes the Synthetic-Real Gap in Tabular Diffusion
di: Lomurno, Eugenio, et al.
Pubblicazione: (2026)
di: Lomurno, Eugenio, et al.
Pubblicazione: (2026)
Can Shape-Infused Joint Embeddings Improve Image-Conditioned 3D Diffusion?
di: Sbrolli, Cristian, et al.
Pubblicazione: (2024)
di: Sbrolli, Cristian, et al.
Pubblicazione: (2024)
Benchmarking Recurrent Event-Based Object Detection for Industrial Multi-Class Recognition on MTevent
di: Manohar, Lokeshwaran, et al.
Pubblicazione: (2026)
di: Manohar, Lokeshwaran, et al.
Pubblicazione: (2026)
Text-Guided Multimodal Unified Industrial Anomaly Detection
di: Li, Zewen, et al.
Pubblicazione: (2026)
di: Li, Zewen, et al.
Pubblicazione: (2026)
Auto-Comp: An Automated Pipeline for Scalable Compositional Probing of Contrastive Vision-Language Models
di: Sbrolli, Cristian, et al.
Pubblicazione: (2026)
di: Sbrolli, Cristian, et al.
Pubblicazione: (2026)
Few Shot Semantic Segmentation: a review of methodologies, benchmarks, and open challenges
di: Catalano, Nico, et al.
Pubblicazione: (2023)
di: Catalano, Nico, et al.
Pubblicazione: (2023)
No Captions, No Problem: Captionless 3D-CLIP Alignment with Hard Negatives via CLIP Knowledge and LLMs
di: Sbrolli, Cristian, et al.
Pubblicazione: (2024)
di: Sbrolli, Cristian, et al.
Pubblicazione: (2024)
When Text and Images Don't Mix: Bias-Correcting Language-Image Similarity Scores for Anomaly Detection
di: Goodge, Adam, et al.
Pubblicazione: (2024)
di: Goodge, Adam, et al.
Pubblicazione: (2024)
Act, Think or Abstain: Complexity-Aware Adaptive Inference for Vision-Language-Action Models
di: Izzo, Riccardo Andrea, et al.
Pubblicazione: (2026)
di: Izzo, Riccardo Andrea, et al.
Pubblicazione: (2026)
SiM3D: Single-instance Multiview Multimodal and Multisetup 3D Anomaly Detection Benchmark
di: Costanzino, Alex, et al.
Pubblicazione: (2025)
di: Costanzino, Alex, et al.
Pubblicazione: (2025)
Text-Guided Variational Image Generation for Industrial Anomaly Detection and Segmentation
di: Lee, Mingyu, et al.
Pubblicazione: (2024)
di: Lee, Mingyu, et al.
Pubblicazione: (2024)
CLASH: A Benchmark for Cross-Modal Contradiction Detection
di: Popordanoska, Teodora, et al.
Pubblicazione: (2025)
di: Popordanoska, Teodora, et al.
Pubblicazione: (2025)
Rethinking Continual Anomaly Detection on the Edge: Benchmarking Under Realistic Industrial Conditions
di: Weatherly, Chad, et al.
Pubblicazione: (2026)
di: Weatherly, Chad, et al.
Pubblicazione: (2026)
ASBench: Image Anomalies Synthesis Benchmark for Anomaly Detection
di: Zhang, Qunyi, et al.
Pubblicazione: (2025)
di: Zhang, Qunyi, et al.
Pubblicazione: (2025)
The Empirical Impact of Forgetting and Transfer in Continual Visual Odometry
di: Cudrano, Paolo, et al.
Pubblicazione: (2024)
di: Cudrano, Paolo, et al.
Pubblicazione: (2024)
Quality-Aware Language-Conditioned Local Auto-Regressive Anomaly Synthesis and Detection
di: Qian, Long, et al.
Pubblicazione: (2025)
di: Qian, Long, et al.
Pubblicazione: (2025)
Guided Reconstruction with Conditioned Diffusion Models for Unsupervised Anomaly Detection in Brain MRIs
di: Behrendt, Finn, et al.
Pubblicazione: (2023)
di: Behrendt, Finn, et al.
Pubblicazione: (2023)
When do Convolutional Neural Networks Stop Learning?
di: Ahmad, Sahan, et al.
Pubblicazione: (2024)
di: Ahmad, Sahan, et al.
Pubblicazione: (2024)
When Text Hijacks Vision: Benchmarking and Mitigating Text Overlay-Induced Hallucination in Vision Language Models
di: Yakun, Cui, et al.
Pubblicazione: (2026)
di: Yakun, Cui, et al.
Pubblicazione: (2026)
OpenFusion++: An Open-vocabulary Real-time Scene Understanding System
di: Jin, Xiaofeng, et al.
Pubblicazione: (2025)
di: Jin, Xiaofeng, et al.
Pubblicazione: (2025)
Harnessing the Computing Continuum across Personalized Healthcare, Maintenance and Inspection, and Farming 4.0
di: Baghdadi, Fatemeh, et al.
Pubblicazione: (2024)
di: Baghdadi, Fatemeh, et al.
Pubblicazione: (2024)
Anomaly Detection with Conditioned Denoising Diffusion Models
di: Mousakhan, Arian, et al.
Pubblicazione: (2023)
di: Mousakhan, Arian, et al.
Pubblicazione: (2023)
EETnet: a CNN for Gaze Detection and Tracking for Smart-Eyewear
di: Aspesi, Andrea, et al.
Pubblicazione: (2025)
di: Aspesi, Andrea, et al.
Pubblicazione: (2025)
Can Multimodal Large Language Models be Guided to Improve Industrial Anomaly Detection?
di: Chen, Zhiling, et al.
Pubblicazione: (2025)
di: Chen, Zhiling, et al.
Pubblicazione: (2025)
SGR-OCC: Evolving Monocular Priors for Embodied 3D Occupancy Prediction via Soft-Gating Lifting and Semantic-Adaptive Geometric Refinement
di: Guo, Yiran, et al.
Pubblicazione: (2026)
di: Guo, Yiran, et al.
Pubblicazione: (2026)
Progressive Boundary Guided Anomaly Synthesis for Industrial Anomaly Detection
di: Chen, Qiyu, et al.
Pubblicazione: (2024)
di: Chen, Qiyu, et al.
Pubblicazione: (2024)
When Language Model Guides Vision: Grounding DINO for Cattle Muzzle Detection
di: Dulal, Rabin, et al.
Pubblicazione: (2025)
di: Dulal, Rabin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Federated Knowledge Recycling: Privacy-Preserving Synthetic Data Sharing
di: Lomurno, Eugenio, et al.
Pubblicazione: (2024) -
Synthetic Image Learning: Preserving Performance and Preventing Membership Inference Attacks
di: Lomurno, Eugenio, et al.
Pubblicazione: (2024) -
MARS: a Multimodal Alignment and Ranking System for Few-Shot Segmentation
di: Catalano, Nico, et al.
Pubblicazione: (2025) -
Stable Diffusion Dataset Generation for Downstream Classification Tasks
di: Lomurno, Eugenio, et al.
Pubblicazione: (2024) -
POMONAG: Pareto-Optimal Many-Objective Neural Architecture Generator
di: Lomurno, Eugenio, et al.
Pubblicazione: (2024)