LAD-Reasoner: Tiny Multimodal Models are Good Reasoners for Logical Anomaly Detection
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Weijia, Chu, Guanglei, Chen, Jiong, Xie, Guo-Sen, Shan, Caifeng, Zhao, Fang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
SAM-LAD: Segment Anything Model Meets Zero-Shot Logic Anomaly Detection
di: Peng, Yun, et al.
Pubblicazione: (2024)
di: Peng, Yun, et al.
Pubblicazione: (2024)
Kernel-Aware Graph Prompt Learning for Few-Shot Anomaly Detection
di: Tao, Fenfang, et al.
Pubblicazione: (2024)
di: Tao, Fenfang, et al.
Pubblicazione: (2024)
OmniAD: Detect and Understand Industrial Anomaly via Multimodal Reasoning
di: Zhao, Shifang, et al.
Pubblicazione: (2025)
di: Zhao, Shifang, et al.
Pubblicazione: (2025)
ABounD: Adversarial Boundary-Driven Few-Shot Learning for Multi-Class Anomaly Detection
di: Deng, Runzhi, et al.
Pubblicazione: (2025)
di: Deng, Runzhi, et al.
Pubblicazione: (2025)
LR-IAD:Mask-Free Industrial Anomaly Detection with Logical Reasoning
di: Zeng, Peijian, et al.
Pubblicazione: (2025)
di: Zeng, Peijian, et al.
Pubblicazione: (2025)
LogTinyLLM: Tiny Large Language Models Based Contextual Log Anomaly Detection
di: Ocansey, Isaiah Thompson, et al.
Pubblicazione: (2025)
di: Ocansey, Isaiah Thompson, et al.
Pubblicazione: (2025)
One-to-More: High-Fidelity Training-Free Anomaly Generation with Attention Control
di: Rao, Haoxiang, et al.
Pubblicazione: (2026)
di: Rao, Haoxiang, et al.
Pubblicazione: (2026)
Center-Aware Detection with Swin-based Co-DETR Framework for Cervical Cytology
di: Kong, Yan, et al.
Pubblicazione: (2026)
di: Kong, Yan, et al.
Pubblicazione: (2026)
MuSLR: Multimodal Symbolic Logical Reasoning
di: Xu, Jundong, et al.
Pubblicazione: (2025)
di: Xu, Jundong, et al.
Pubblicazione: (2025)
Weakly Supervised Video Anomaly Detection with Anomaly-Connected Components and Intention Reasoning
di: Wang, Yu, et al.
Pubblicazione: (2026)
di: Wang, Yu, et al.
Pubblicazione: (2026)
VideoDetective: Clue Hunting via both Extrinsic Query and Intrinsic Relevance for Long Video Understanding
di: Yang, Ruoliu, et al.
Pubblicazione: (2026)
di: Yang, Ruoliu, et al.
Pubblicazione: (2026)
PosterCopilot: Toward Layout Reasoning and Controllable Editing for Professional Graphic Design
di: Wei, Jiazhe, et al.
Pubblicazione: (2025)
di: Wei, Jiazhe, et al.
Pubblicazione: (2025)
DSCA: A Digital Subtraction Angiography Sequence Dataset and Spatio-Temporal Model for Cerebral Artery Segmentation
di: Zhang, Jiong, et al.
Pubblicazione: (2024)
di: Zhang, Jiong, et al.
Pubblicazione: (2024)
An Effective End-to-End Solution for Multimodal Action Recognition
di: Wang, Songping, et al.
Pubblicazione: (2025)
di: Wang, Songping, et al.
Pubblicazione: (2025)
Towards Zero-Shot Anomaly Detection and Reasoning with Multimodal Large Language Models
di: Xu, Jiacong, et al.
Pubblicazione: (2025)
di: Xu, Jiacong, et al.
Pubblicazione: (2025)
Semantic Visual Anomaly Detection and Reasoning in AI-Generated Images
di: Tan, Chuangchuang, et al.
Pubblicazione: (2025)
di: Tan, Chuangchuang, et al.
Pubblicazione: (2025)
AD-FM: Multimodal LLMs for Anomaly Detection via Multi-Stage Reasoning and Fine-Grained Reward Optimization
di: Liao, Jingyi, et al.
Pubblicazione: (2025)
di: Liao, Jingyi, et al.
Pubblicazione: (2025)
MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM
di: Dong, Bowen, et al.
Pubblicazione: (2025)
di: Dong, Bowen, et al.
Pubblicazione: (2025)
Reasoning-OCR: Can Large Multimodal Models Solve Complex Logical Reasoning Problems from OCR Cues?
di: He, Haibin, et al.
Pubblicazione: (2025)
di: He, Haibin, et al.
Pubblicazione: (2025)
Myriad: Large Multimodal Model by Applying Vision Experts for Industrial Anomaly Detection
di: Li, Yuanze, et al.
Pubblicazione: (2023)
di: Li, Yuanze, et al.
Pubblicazione: (2023)
Mario: Multimodal Graph Reasoning with Large Language Models
di: Sun, Yuanfu, et al.
Pubblicazione: (2026)
di: Sun, Yuanfu, et al.
Pubblicazione: (2026)
Follow the Rules: Reasoning for Video Anomaly Detection with Large Language Models
di: Yang, Yuchen, et al.
Pubblicazione: (2024)
di: Yang, Yuchen, et al.
Pubblicazione: (2024)
BSDM: Background Suppression Diffusion Model for Hyperspectral Anomaly Detection
di: Ma, Jitao, et al.
Pubblicazione: (2023)
di: Ma, Jitao, et al.
Pubblicazione: (2023)
Plug-and-Play Grounding of Reasoning in Multimodal Large Language Models
di: Chen, Jiaxing, et al.
Pubblicazione: (2024)
di: Chen, Jiaxing, et al.
Pubblicazione: (2024)
Language-Instructed Reasoning for Group Activity Detection via Multimodal Large Language Model
di: Peng, Jihua, et al.
Pubblicazione: (2025)
di: Peng, Jihua, et al.
Pubblicazione: (2025)
Similarity Distance-Based Label Assignment for Tiny Object Detection
di: Shi, Shuohao, et al.
Pubblicazione: (2024)
di: Shi, Shuohao, et al.
Pubblicazione: (2024)
CVP: Central-Peripheral Vision-Inspired Multimodal Model for Spatial Reasoning
di: Chen, Zeyuan, et al.
Pubblicazione: (2025)
di: Chen, Zeyuan, et al.
Pubblicazione: (2025)
TinyGLASS: Real-Time Self-Supervised In-Sensor Anomaly Detection
di: Bonazzi, Pietro, et al.
Pubblicazione: (2026)
di: Bonazzi, Pietro, et al.
Pubblicazione: (2026)
Text-Guided Multimodal Unified Industrial Anomaly Detection
di: Li, Zewen, et al.
Pubblicazione: (2026)
di: Li, Zewen, et al.
Pubblicazione: (2026)
Towards Explainable Industrial Anomaly Detection via Knowledge-Guided Latent Reasoning
di: Chen, Peng, et al.
Pubblicazione: (2026)
di: Chen, Peng, et al.
Pubblicazione: (2026)
An Empirical Analysis on Spatial Reasoning Capabilities of Large Multimodal Models
di: Shiri, Fatemeh, et al.
Pubblicazione: (2024)
di: Shiri, Fatemeh, et al.
Pubblicazione: (2024)
Component-aware Unsupervised Logical Anomaly Generation for Industrial Anomaly Detection
di: Tong, Xuan, et al.
Pubblicazione: (2025)
di: Tong, Xuan, et al.
Pubblicazione: (2025)
MMhops-R1: Multimodal Multi-hop Reasoning
di: Zhang, Tao, et al.
Pubblicazione: (2025)
di: Zhang, Tao, et al.
Pubblicazione: (2025)
IADGPT: Unified LVLM for Few-Shot Industrial Anomaly Detection, Localization, and Reasoning via In-Context Learning
di: Zhao, Mengyang, et al.
Pubblicazione: (2025)
di: Zhao, Mengyang, et al.
Pubblicazione: (2025)
Reasoning-Driven Anomaly Detection and Localization with Image-Level Supervision
di: Jin, Yizhou, et al.
Pubblicazione: (2026)
di: Jin, Yizhou, et al.
Pubblicazione: (2026)
DPNet: Dynamic Pooling Network for Tiny Object Detection
di: Gong, Luqi, et al.
Pubblicazione: (2025)
di: Gong, Luqi, et al.
Pubblicazione: (2025)
Cultivating Forensic Reasoning for Generalizable Multimodal Manipulation Detection
di: Zhang, Yuchen, et al.
Pubblicazione: (2026)
di: Zhang, Yuchen, et al.
Pubblicazione: (2026)
SpatiaLQA: A Benchmark for Evaluating Spatial Logical Reasoning in Vision-Language Models
di: Xie, Yuechen, et al.
Pubblicazione: (2026)
di: Xie, Yuechen, et al.
Pubblicazione: (2026)
LogicOCR: Do Your Large Multimodal Models Excel at Logical Reasoning on Text-Rich Images?
di: Ye, Maoyuan, et al.
Pubblicazione: (2025)
di: Ye, Maoyuan, et al.
Pubblicazione: (2025)
TinyEmo: Scaling down Emotional Reasoning via Metric Projection
di: Gutierrez, Cristian
Pubblicazione: (2024)
di: Gutierrez, Cristian
Pubblicazione: (2024)
Documenti analoghi
-
SAM-LAD: Segment Anything Model Meets Zero-Shot Logic Anomaly Detection
di: Peng, Yun, et al.
Pubblicazione: (2024) -
Kernel-Aware Graph Prompt Learning for Few-Shot Anomaly Detection
di: Tao, Fenfang, et al.
Pubblicazione: (2024) -
OmniAD: Detect and Understand Industrial Anomaly via Multimodal Reasoning
di: Zhao, Shifang, et al.
Pubblicazione: (2025) -
ABounD: Adversarial Boundary-Driven Few-Shot Learning for Multi-Class Anomaly Detection
di: Deng, Runzhi, et al.
Pubblicazione: (2025) -
LR-IAD:Mask-Free Industrial Anomaly Detection with Logical Reasoning
di: Zeng, Peijian, et al.
Pubblicazione: (2025)