Deep Correlated Prompting for Visual Recognition with Missing Modalities
Fuente:
arXiv
Salvato in:
| Autori principali: | Hu, Lianyu, Shi, Tongkai, Feng, Wei, Shang, Fanhua, Wan, Liang |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Pose-Guided Fine-Grained Sign Language Video Generation
di: Shi, Tongkai, et al.
Pubblicazione: (2024)
di: Shi, Tongkai, et al.
Pubblicazione: (2024)
LightVLM: Acceleraing Large Multimodal Models with Pyramid Token Merging and KV Cache Compression
di: Hu, Lianyu, et al.
Pubblicazione: (2025)
di: Hu, Lianyu, et al.
Pubblicazione: (2025)
iLLaVA: An Image is Worth Fewer Than 1/3 Input Tokens in Large Multimodal Models
di: Hu, Lianyu, et al.
Pubblicazione: (2024)
di: Hu, Lianyu, et al.
Pubblicazione: (2024)
Improving Continuous Sign Language Recognition with Adapted Image Models
di: Hu, Lianyu, et al.
Pubblicazione: (2024)
di: Hu, Lianyu, et al.
Pubblicazione: (2024)
CorrNet+: Sign Language Recognition and Translation via Spatial-Temporal Correlation
di: Hu, Lianyu, et al.
Pubblicazione: (2024)
di: Hu, Lianyu, et al.
Pubblicazione: (2024)
Synergistic Prompting for Robust Visual Recognition with Missing Modalities
di: Zhang, Zhihui, et al.
Pubblicazione: (2025)
di: Zhang, Zhihui, et al.
Pubblicazione: (2025)
Dynamic Spatial-Temporal Aggregation for Skeleton-Aware Sign Language Recognition
di: Hu, Lianyu, et al.
Pubblicazione: (2024)
di: Hu, Lianyu, et al.
Pubblicazione: (2024)
Beyond Background Shift: Rethinking Instance Replay in Continual Semantic Segmentation
di: Yin, Hongmei, et al.
Pubblicazione: (2025)
di: Yin, Hongmei, et al.
Pubblicazione: (2025)
COMMA: Co-Articulated Multi-Modal Learning
di: Hu, Lianyu, et al.
Pubblicazione: (2023)
di: Hu, Lianyu, et al.
Pubblicazione: (2023)
Can Text-to-image Model Assist Multi-modal Learning for Visual Recognition with Visual Modality Missing?
di: Feng, Tiantian, et al.
Pubblicazione: (2024)
di: Feng, Tiantian, et al.
Pubblicazione: (2024)
PDD: Manifold-Prior Diverse Distillation for Medical Anomaly Detection
di: Lu, Xijun, et al.
Pubblicazione: (2026)
di: Lu, Xijun, et al.
Pubblicazione: (2026)
Multimodal Prompt Learning with Missing Modalities for Sentiment Analysis and Emotion Recognition
di: Guo, Zirun, et al.
Pubblicazione: (2024)
di: Guo, Zirun, et al.
Pubblicazione: (2024)
MoRA: Missing Modality Low-Rank Adaptation for Visual Recognition
di: Zhao, Shu, et al.
Pubblicazione: (2025)
di: Zhao, Shu, et al.
Pubblicazione: (2025)
Completed Feature Disentanglement Learning for Multimodal MRIs Analysis
di: Liu, Tianling, et al.
Pubblicazione: (2024)
di: Liu, Tianling, et al.
Pubblicazione: (2024)
CFCML: A Coarse-to-Fine Crossmodal Learning Framework For Disease Diagnosis Using Multimodal Images and Tabular Data
di: Liu, Tianling, et al.
Pubblicazione: (2026)
di: Liu, Tianling, et al.
Pubblicazione: (2026)
Towards Stable Cross-Domain Depression Recognition under Missing Modalities
di: Chen, Jiuyi, et al.
Pubblicazione: (2025)
di: Chen, Jiuyi, et al.
Pubblicazione: (2025)
AOEPT: Breaking the Implicit Modality-Reduction Bottleneck in Modality-Missing Prompt Tuning
di: Lang, Jian, et al.
Pubblicazione: (2026)
di: Lang, Jian, et al.
Pubblicazione: (2026)
Context-driven Missing-Modality Learning for Robust Medical Diagnosis with Image-Tabular Data
di: Liu, Tianling, et al.
Pubblicazione: (2026)
di: Liu, Tianling, et al.
Pubblicazione: (2026)
Efficient Prompting for Continual Adaptation to Missing Modalities
di: Guo, Zirun, et al.
Pubblicazione: (2025)
di: Guo, Zirun, et al.
Pubblicazione: (2025)
SciceVPR: Stable Cross-Image Correlation Enhanced Model for Visual Place Recognition
di: Wan, Shanshan, et al.
Pubblicazione: (2025)
di: Wan, Shanshan, et al.
Pubblicazione: (2025)
Vision-Language Model IP Protection via Prompt-based Learning
di: Wang, Lianyu, et al.
Pubblicazione: (2025)
di: Wang, Lianyu, et al.
Pubblicazione: (2025)
Multimodal Knowledge Distillation for Egocentric Action Recognition Robust to Missing Modalities
di: Santos-Villafranca, Maria, et al.
Pubblicazione: (2025)
di: Santos-Villafranca, Maria, et al.
Pubblicazione: (2025)
Reconstruct before Query: Continual Missing Modality Learning with Decomposed Prompt Collaboration
di: Zhao, Shu, et al.
Pubblicazione: (2024)
di: Zhao, Shu, et al.
Pubblicazione: (2024)
OptiCorNet: Optimizing Sequence-Based Context Correlation for Visual Place Recognition
di: Li, Zhenyu, et al.
Pubblicazione: (2025)
di: Li, Zhenyu, et al.
Pubblicazione: (2025)
Gradient-Guided Modality Decoupling for Missing-Modality Robustness
di: Wang, Hao, et al.
Pubblicazione: (2024)
di: Wang, Hao, et al.
Pubblicazione: (2024)
EPE-P: Evidence-based Parameter-efficient Prompting for Multimodal Learning with Missing Modalities
di: Chen, Zhe, et al.
Pubblicazione: (2024)
di: Chen, Zhe, et al.
Pubblicazione: (2024)
PVLR: Prompt-driven Visual-Linguistic Representation Learning for Multi-Label Image Recognition
di: Tan, Hao, et al.
Pubblicazione: (2024)
di: Tan, Hao, et al.
Pubblicazione: (2024)
Robust RGB-T Tracking via Learnable Visual Fourier Prompt Fine-tuning and Modality Fusion Prompt Generation
di: Yang, Hongtao, et al.
Pubblicazione: (2025)
di: Yang, Hongtao, et al.
Pubblicazione: (2025)
Explicit Visual Prompts for Visual Object Tracking
di: Shi, Liangtao, et al.
Pubblicazione: (2024)
di: Shi, Liangtao, et al.
Pubblicazione: (2024)
Deep Multimodal Learning with Missing Modality: A Survey
di: Wu, Renjie, et al.
Pubblicazione: (2024)
di: Wu, Renjie, et al.
Pubblicazione: (2024)
Sample Correlation for Fingerprinting Deep Face Recognition
di: Guan, Jiyang, et al.
Pubblicazione: (2024)
di: Guan, Jiyang, et al.
Pubblicazione: (2024)
Visual Prompting in LLMs for Enhancing Emotion Recognition
di: Zhang, Qixuan, et al.
Pubblicazione: (2024)
di: Zhang, Qixuan, et al.
Pubblicazione: (2024)
PromptMAD: Cross-Modal Prompting for Multi-Class Visual Anomaly Localization
di: McCain, Duncan, et al.
Pubblicazione: (2026)
di: McCain, Duncan, et al.
Pubblicazione: (2026)
Towards Robust Multimodal Emotion Recognition under Missing Modalities and Distribution Shifts
di: Zhong, Guowei, et al.
Pubblicazione: (2025)
di: Zhong, Guowei, et al.
Pubblicazione: (2025)
PROMISE: Prompt-Attentive Hierarchical Contrastive Learning for Robust Cross-Modal Representation with Missing Modalities
di: Chen, Jiajun, et al.
Pubblicazione: (2025)
di: Chen, Jiajun, et al.
Pubblicazione: (2025)
PASSION: Towards Effective Incomplete Multi-Modal Medical Image Segmentation with Imbalanced Missing Rates
di: Shi, Junjie, et al.
Pubblicazione: (2024)
di: Shi, Junjie, et al.
Pubblicazione: (2024)
Visual and Textual Prompts in VLLMs for Enhancing Emotion Recognition
di: Wang, Zhifeng, et al.
Pubblicazione: (2025)
di: Wang, Zhifeng, et al.
Pubblicazione: (2025)
Audio-Guided Visual Editing with Complex Multi-Modal Prompts
di: Kim, Hyeonyu, et al.
Pubblicazione: (2025)
di: Kim, Hyeonyu, et al.
Pubblicazione: (2025)
MissBench: Benchmarking Multimodal Affective Analysis under Imbalanced Missing Modalities
di: Pham, Tien Anh, et al.
Pubblicazione: (2026)
di: Pham, Tien Anh, et al.
Pubblicazione: (2026)
Manipulating Multimodal Agents via Cross-Modal Prompt Injection
di: Wang, Le, et al.
Pubblicazione: (2025)
di: Wang, Le, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Pose-Guided Fine-Grained Sign Language Video Generation
di: Shi, Tongkai, et al.
Pubblicazione: (2024) -
LightVLM: Acceleraing Large Multimodal Models with Pyramid Token Merging and KV Cache Compression
di: Hu, Lianyu, et al.
Pubblicazione: (2025) -
iLLaVA: An Image is Worth Fewer Than 1/3 Input Tokens in Large Multimodal Models
di: Hu, Lianyu, et al.
Pubblicazione: (2024) -
Improving Continuous Sign Language Recognition with Adapted Image Models
di: Hu, Lianyu, et al.
Pubblicazione: (2024) -
CorrNet+: Sign Language Recognition and Translation via Spatial-Temporal Correlation
di: Hu, Lianyu, et al.
Pubblicazione: (2024)