LAD-Reasoner: Tiny Multimodal Models are Good Reasoners for Logical Anomaly Detection
Fuente:
arXiv
Guardado en:
| Autores principales: | Li, Weijia, Chu, Guanglei, Chen, Jiong, Xie, Guo-Sen, Shan, Caifeng, Zhao, Fang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
SAM-LAD: Segment Anything Model Meets Zero-Shot Logic Anomaly Detection
por: Peng, Yun, et al.
Publicado: (2024)
por: Peng, Yun, et al.
Publicado: (2024)
Kernel-Aware Graph Prompt Learning for Few-Shot Anomaly Detection
por: Tao, Fenfang, et al.
Publicado: (2024)
por: Tao, Fenfang, et al.
Publicado: (2024)
OmniAD: Detect and Understand Industrial Anomaly via Multimodal Reasoning
por: Zhao, Shifang, et al.
Publicado: (2025)
por: Zhao, Shifang, et al.
Publicado: (2025)
ABounD: Adversarial Boundary-Driven Few-Shot Learning for Multi-Class Anomaly Detection
por: Deng, Runzhi, et al.
Publicado: (2025)
por: Deng, Runzhi, et al.
Publicado: (2025)
LR-IAD:Mask-Free Industrial Anomaly Detection with Logical Reasoning
por: Zeng, Peijian, et al.
Publicado: (2025)
por: Zeng, Peijian, et al.
Publicado: (2025)
LogTinyLLM: Tiny Large Language Models Based Contextual Log Anomaly Detection
por: Ocansey, Isaiah Thompson, et al.
Publicado: (2025)
por: Ocansey, Isaiah Thompson, et al.
Publicado: (2025)
One-to-More: High-Fidelity Training-Free Anomaly Generation with Attention Control
por: Rao, Haoxiang, et al.
Publicado: (2026)
por: Rao, Haoxiang, et al.
Publicado: (2026)
Center-Aware Detection with Swin-based Co-DETR Framework for Cervical Cytology
por: Kong, Yan, et al.
Publicado: (2026)
por: Kong, Yan, et al.
Publicado: (2026)
MuSLR: Multimodal Symbolic Logical Reasoning
por: Xu, Jundong, et al.
Publicado: (2025)
por: Xu, Jundong, et al.
Publicado: (2025)
Weakly Supervised Video Anomaly Detection with Anomaly-Connected Components and Intention Reasoning
por: Wang, Yu, et al.
Publicado: (2026)
por: Wang, Yu, et al.
Publicado: (2026)
VideoDetective: Clue Hunting via both Extrinsic Query and Intrinsic Relevance for Long Video Understanding
por: Yang, Ruoliu, et al.
Publicado: (2026)
por: Yang, Ruoliu, et al.
Publicado: (2026)
PosterCopilot: Toward Layout Reasoning and Controllable Editing for Professional Graphic Design
por: Wei, Jiazhe, et al.
Publicado: (2025)
por: Wei, Jiazhe, et al.
Publicado: (2025)
DSCA: A Digital Subtraction Angiography Sequence Dataset and Spatio-Temporal Model for Cerebral Artery Segmentation
por: Zhang, Jiong, et al.
Publicado: (2024)
por: Zhang, Jiong, et al.
Publicado: (2024)
An Effective End-to-End Solution for Multimodal Action Recognition
por: Wang, Songping, et al.
Publicado: (2025)
por: Wang, Songping, et al.
Publicado: (2025)
Towards Zero-Shot Anomaly Detection and Reasoning with Multimodal Large Language Models
por: Xu, Jiacong, et al.
Publicado: (2025)
por: Xu, Jiacong, et al.
Publicado: (2025)
Semantic Visual Anomaly Detection and Reasoning in AI-Generated Images
por: Tan, Chuangchuang, et al.
Publicado: (2025)
por: Tan, Chuangchuang, et al.
Publicado: (2025)
AD-FM: Multimodal LLMs for Anomaly Detection via Multi-Stage Reasoning and Fine-Grained Reward Optimization
por: Liao, Jingyi, et al.
Publicado: (2025)
por: Liao, Jingyi, et al.
Publicado: (2025)
MIRAGE: Assessing Hallucination in Multimodal Reasoning Chains of MLLM
por: Dong, Bowen, et al.
Publicado: (2025)
por: Dong, Bowen, et al.
Publicado: (2025)
Reasoning-OCR: Can Large Multimodal Models Solve Complex Logical Reasoning Problems from OCR Cues?
por: He, Haibin, et al.
Publicado: (2025)
por: He, Haibin, et al.
Publicado: (2025)
Myriad: Large Multimodal Model by Applying Vision Experts for Industrial Anomaly Detection
por: Li, Yuanze, et al.
Publicado: (2023)
por: Li, Yuanze, et al.
Publicado: (2023)
Mario: Multimodal Graph Reasoning with Large Language Models
por: Sun, Yuanfu, et al.
Publicado: (2026)
por: Sun, Yuanfu, et al.
Publicado: (2026)
Follow the Rules: Reasoning for Video Anomaly Detection with Large Language Models
por: Yang, Yuchen, et al.
Publicado: (2024)
por: Yang, Yuchen, et al.
Publicado: (2024)
BSDM: Background Suppression Diffusion Model for Hyperspectral Anomaly Detection
por: Ma, Jitao, et al.
Publicado: (2023)
por: Ma, Jitao, et al.
Publicado: (2023)
Plug-and-Play Grounding of Reasoning in Multimodal Large Language Models
por: Chen, Jiaxing, et al.
Publicado: (2024)
por: Chen, Jiaxing, et al.
Publicado: (2024)
Language-Instructed Reasoning for Group Activity Detection via Multimodal Large Language Model
por: Peng, Jihua, et al.
Publicado: (2025)
por: Peng, Jihua, et al.
Publicado: (2025)
Similarity Distance-Based Label Assignment for Tiny Object Detection
por: Shi, Shuohao, et al.
Publicado: (2024)
por: Shi, Shuohao, et al.
Publicado: (2024)
CVP: Central-Peripheral Vision-Inspired Multimodal Model for Spatial Reasoning
por: Chen, Zeyuan, et al.
Publicado: (2025)
por: Chen, Zeyuan, et al.
Publicado: (2025)
TinyGLASS: Real-Time Self-Supervised In-Sensor Anomaly Detection
por: Bonazzi, Pietro, et al.
Publicado: (2026)
por: Bonazzi, Pietro, et al.
Publicado: (2026)
Text-Guided Multimodal Unified Industrial Anomaly Detection
por: Li, Zewen, et al.
Publicado: (2026)
por: Li, Zewen, et al.
Publicado: (2026)
Towards Explainable Industrial Anomaly Detection via Knowledge-Guided Latent Reasoning
por: Chen, Peng, et al.
Publicado: (2026)
por: Chen, Peng, et al.
Publicado: (2026)
An Empirical Analysis on Spatial Reasoning Capabilities of Large Multimodal Models
por: Shiri, Fatemeh, et al.
Publicado: (2024)
por: Shiri, Fatemeh, et al.
Publicado: (2024)
Component-aware Unsupervised Logical Anomaly Generation for Industrial Anomaly Detection
por: Tong, Xuan, et al.
Publicado: (2025)
por: Tong, Xuan, et al.
Publicado: (2025)
MMhops-R1: Multimodal Multi-hop Reasoning
por: Zhang, Tao, et al.
Publicado: (2025)
por: Zhang, Tao, et al.
Publicado: (2025)
IADGPT: Unified LVLM for Few-Shot Industrial Anomaly Detection, Localization, and Reasoning via In-Context Learning
por: Zhao, Mengyang, et al.
Publicado: (2025)
por: Zhao, Mengyang, et al.
Publicado: (2025)
Reasoning-Driven Anomaly Detection and Localization with Image-Level Supervision
por: Jin, Yizhou, et al.
Publicado: (2026)
por: Jin, Yizhou, et al.
Publicado: (2026)
DPNet: Dynamic Pooling Network for Tiny Object Detection
por: Gong, Luqi, et al.
Publicado: (2025)
por: Gong, Luqi, et al.
Publicado: (2025)
Cultivating Forensic Reasoning for Generalizable Multimodal Manipulation Detection
por: Zhang, Yuchen, et al.
Publicado: (2026)
por: Zhang, Yuchen, et al.
Publicado: (2026)
SpatiaLQA: A Benchmark for Evaluating Spatial Logical Reasoning in Vision-Language Models
por: Xie, Yuechen, et al.
Publicado: (2026)
por: Xie, Yuechen, et al.
Publicado: (2026)
LogicOCR: Do Your Large Multimodal Models Excel at Logical Reasoning on Text-Rich Images?
por: Ye, Maoyuan, et al.
Publicado: (2025)
por: Ye, Maoyuan, et al.
Publicado: (2025)
TinyEmo: Scaling down Emotional Reasoning via Metric Projection
por: Gutierrez, Cristian
Publicado: (2024)
por: Gutierrez, Cristian
Publicado: (2024)
Ejemplares similares
-
SAM-LAD: Segment Anything Model Meets Zero-Shot Logic Anomaly Detection
por: Peng, Yun, et al.
Publicado: (2024) -
Kernel-Aware Graph Prompt Learning for Few-Shot Anomaly Detection
por: Tao, Fenfang, et al.
Publicado: (2024) -
OmniAD: Detect and Understand Industrial Anomaly via Multimodal Reasoning
por: Zhao, Shifang, et al.
Publicado: (2025) -
ABounD: Adversarial Boundary-Driven Few-Shot Learning for Multi-Class Anomaly Detection
por: Deng, Runzhi, et al.
Publicado: (2025) -
LR-IAD:Mask-Free Industrial Anomaly Detection with Logical Reasoning
por: Zeng, Peijian, et al.
Publicado: (2025)