PromptMAD: Cross-Modal Prompting for Multi-Class Visual Anomaly Localization
Fuente:
arXiv
Salvato in:
| Autori principali: | McCain, Duncan, Kashiani, Hossein, Afghah, Fatemeh |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
ROADS: Robust Prompt-driven Multi-Class Anomaly Detection under Domain Shift
di: Kashiani, Hossein, et al.
Pubblicazione: (2024)
di: Kashiani, Hossein, et al.
Pubblicazione: (2024)
Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models
di: Talemi, Niloufar Alipour, et al.
Pubblicazione: (2024)
di: Talemi, Niloufar Alipour, et al.
Pubblicazione: (2024)
DiSa: Directional Saliency-Aware Prompt Learning for Generalizable Vision-Language Models
di: Talemi, Niloufar Alipour, et al.
Pubblicazione: (2025)
di: Talemi, Niloufar Alipour, et al.
Pubblicazione: (2025)
FreqDebias: Towards Generalizable Deepfake Detection via Consistency-Driven Frequency Debiasing
di: Kashiani, Hossein, et al.
Pubblicazione: (2025)
di: Kashiani, Hossein, et al.
Pubblicazione: (2025)
CATFace: Cross-Attribute-Guided Transformer with Self-Attention Distillation for Low-Quality Face Recognition
di: Talemi, Niloufar Alipour, et al.
Pubblicazione: (2024)
di: Talemi, Niloufar Alipour, et al.
Pubblicazione: (2024)
Modality-Aware SAM: Sharpness-Aware-Minimization Driven Gradient Modulation for Harmonized Multimodal Learning
di: Nowdeh, Hossein R., et al.
Pubblicazione: (2025)
di: Nowdeh, Hossein R., et al.
Pubblicazione: (2025)
FlameFinder: Illuminating Obscured Fire through Smoke with Attentive Deep Metric Learning
di: Rajoli, Hossein, et al.
Pubblicazione: (2024)
di: Rajoli, Hossein, et al.
Pubblicazione: (2024)
Audio-Guided Visual Editing with Complex Multi-Modal Prompts
di: Kim, Hyeonyu, et al.
Pubblicazione: (2025)
di: Kim, Hyeonyu, et al.
Pubblicazione: (2025)
Multi-Prompt with Depth Partitioned Cross-Modal Learning
di: Tian, Yingjie, et al.
Pubblicazione: (2023)
di: Tian, Yingjie, et al.
Pubblicazione: (2023)
MM-Prompt: Cross-Modal Prompt Tuning for Continual Visual Question Answering
di: Li, Xu, et al.
Pubblicazione: (2025)
di: Li, Xu, et al.
Pubblicazione: (2025)
Exploring Typographic Visual Prompts Injection Threats in Cross-Modality Generation Models
di: Cheng, Hao, et al.
Pubblicazione: (2025)
di: Cheng, Hao, et al.
Pubblicazione: (2025)
Label Anything: Multi-Class Few-Shot Semantic Segmentation with Visual Prompts
di: De Marinis, Pasquale, et al.
Pubblicazione: (2024)
di: De Marinis, Pasquale, et al.
Pubblicazione: (2024)
Thermal Image Calibration and Correction using Unpaired Cycle-Consistent Adversarial Networks
di: Rajoli, Hossein, et al.
Pubblicazione: (2024)
di: Rajoli, Hossein, et al.
Pubblicazione: (2024)
Federated Cross-Modal Style-Aware Prompt Generation
di: Prasad, Suraj, et al.
Pubblicazione: (2025)
di: Prasad, Suraj, et al.
Pubblicazione: (2025)
Deep Correlated Prompting for Visual Recognition with Missing Modalities
di: Hu, Lianyu, et al.
Pubblicazione: (2024)
di: Hu, Lianyu, et al.
Pubblicazione: (2024)
Synergistic Prompting for Robust Visual Recognition with Missing Modalities
di: Zhang, Zhihui, et al.
Pubblicazione: (2025)
di: Zhang, Zhihui, et al.
Pubblicazione: (2025)
DiffusionUavLoc: Visually Prompted Diffusion for Cross-View UAV Localization
di: Liu, Tao, et al.
Pubblicazione: (2025)
di: Liu, Tao, et al.
Pubblicazione: (2025)
PromptMoE: Generalizable Zero-Shot Anomaly Detection via Visually-Guided Prompt Mixtures
di: Shao, Yuheng, et al.
Pubblicazione: (2025)
di: Shao, Yuheng, et al.
Pubblicazione: (2025)
KAnoCLIP: Zero-Shot Anomaly Detection through Knowledge-Driven Prompt Learning and Enhanced Cross-Modal Integration
di: Li, Chengyuan, et al.
Pubblicazione: (2025)
di: Li, Chengyuan, et al.
Pubblicazione: (2025)
Bidirectional Cross-Modal Prompting for Event-Frame Asymmetric Stereo
di: Xu, Ninghui, et al.
Pubblicazione: (2026)
di: Xu, Ninghui, et al.
Pubblicazione: (2026)
Manipulating Multimodal Agents via Cross-Modal Prompt Injection
di: Wang, Le, et al.
Pubblicazione: (2025)
di: Wang, Le, et al.
Pubblicazione: (2025)
X-Prompt: Multi-modal Visual Prompt for Video Object Segmentation
di: Guo, Pinxue, et al.
Pubblicazione: (2024)
di: Guo, Pinxue, et al.
Pubblicazione: (2024)
Modality-Agnostic Prompt Learning for Multi-Modal Camouflaged Object Detection
di: Wang, Hao, et al.
Pubblicazione: (2026)
di: Wang, Hao, et al.
Pubblicazione: (2026)
Unified Open-World Segmentation with Multi-Modal Prompts
di: Liu, Yang, et al.
Pubblicazione: (2025)
di: Liu, Yang, et al.
Pubblicazione: (2025)
User-Friendly Customized Generation with Multi-Modal Prompts
di: Zhong, Linhao, et al.
Pubblicazione: (2024)
di: Zhong, Linhao, et al.
Pubblicazione: (2024)
DynImg: Key Frames with Visual Prompts are Good Representation for Multi-Modal Video Understanding
di: Bao, Xiaoyi, et al.
Pubblicazione: (2025)
di: Bao, Xiaoyi, et al.
Pubblicazione: (2025)
Robust RGB-T Tracking via Learnable Visual Fourier Prompt Fine-tuning and Modality Fusion Prompt Generation
di: Yang, Hongtao, et al.
Pubblicazione: (2025)
di: Yang, Hongtao, et al.
Pubblicazione: (2025)
Progressive Prompt-Guided Cross-Modal Reasoning for Referring Image Segmentation
di: Li, Jiachen, et al.
Pubblicazione: (2026)
di: Li, Jiachen, et al.
Pubblicazione: (2026)
LMPT: Prompt Tuning with Class-Specific Embedding Loss for Long-tailed Multi-Label Visual Recognition
di: Xia, Peng, et al.
Pubblicazione: (2023)
di: Xia, Peng, et al.
Pubblicazione: (2023)
Align3D-AD: Cross-Modal Feature Alignment and Dual-Prompt Learning for Zero-shot 3D Anomaly Detection
di: Bai, Letian, et al.
Pubblicazione: (2026)
di: Bai, Letian, et al.
Pubblicazione: (2026)
ModalPrompt: Towards Efficient Multimodal Continual Instruction Tuning with Dual-Modality Guided Prompt
di: Zeng, Fanhu, et al.
Pubblicazione: (2024)
di: Zeng, Fanhu, et al.
Pubblicazione: (2024)
Agentic AI in Remote Sensing: Foundations, Taxonomy, and Emerging Systems
di: Talemi, Niloufar Alipour, et al.
Pubblicazione: (2026)
di: Talemi, Niloufar Alipour, et al.
Pubblicazione: (2026)
CVPT: Cross Visual Prompt Tuning
di: Huang, Lingyun, et al.
Pubblicazione: (2024)
di: Huang, Lingyun, et al.
Pubblicazione: (2024)
PromptHub: Enhancing Multi-Prompt Visual In-Context Learning with Locality-Aware Fusion, Concentration and Alignment
di: Luo, Tianci, et al.
Pubblicazione: (2026)
di: Luo, Tianci, et al.
Pubblicazione: (2026)
Multi-Modal Prompt Learning on Blind Image Quality Assessment
di: Pan, Wensheng, et al.
Pubblicazione: (2024)
di: Pan, Wensheng, et al.
Pubblicazione: (2024)
Prompt Highlighter: Interactive Control for Multi-Modal LLMs
di: Zhang, Yuechen, et al.
Pubblicazione: (2023)
di: Zhang, Yuechen, et al.
Pubblicazione: (2023)
TCP:Textual-based Class-aware Prompt tuning for Visual-Language Model
di: Yao, Hantao, et al.
Pubblicazione: (2023)
di: Yao, Hantao, et al.
Pubblicazione: (2023)
BioVLM: Routing Prompts, Not Parameters, for Cross-Modality Generalization in Biomedical VLMs
di: Singha, Mainak, et al.
Pubblicazione: (2026)
di: Singha, Mainak, et al.
Pubblicazione: (2026)
Human-Free Automated Prompting for Vision-Language Anomaly Detection: Prompt Optimization with Meta-guiding Prompt Scheme
di: Chen, Pi-Wei, et al.
Pubblicazione: (2024)
di: Chen, Pi-Wei, et al.
Pubblicazione: (2024)
Exploring Interpretability for Visual Prompt Tuning with Cross-layer Concepts
di: Wang, Yubin, et al.
Pubblicazione: (2025)
di: Wang, Yubin, et al.
Pubblicazione: (2025)
Documenti analoghi
-
ROADS: Robust Prompt-driven Multi-Class Anomaly Detection under Domain Shift
di: Kashiani, Hossein, et al.
Pubblicazione: (2024) -
Style-Pro: Style-Guided Prompt Learning for Generalizable Vision-Language Models
di: Talemi, Niloufar Alipour, et al.
Pubblicazione: (2024) -
DiSa: Directional Saliency-Aware Prompt Learning for Generalizable Vision-Language Models
di: Talemi, Niloufar Alipour, et al.
Pubblicazione: (2025) -
FreqDebias: Towards Generalizable Deepfake Detection via Consistency-Driven Frequency Debiasing
di: Kashiani, Hossein, et al.
Pubblicazione: (2025) -
CATFace: Cross-Attribute-Guided Transformer with Self-Attention Distillation for Low-Quality Face Recognition
di: Talemi, Niloufar Alipour, et al.
Pubblicazione: (2024)