PRISM: Exposing and Resolving Spurious Isolation in Federated Multimodal Continual Learning
Fuente:
arXiv
Guardado en:
| Autores principales: | Wu, Beining, Ding, Zihao, Huang, Jun |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
EASE: Federated Multimodal Unlearning via Entanglement-Aware Anchor Closure
por: Ding, Zihao, et al.
Publicado: (2026)
por: Ding, Zihao, et al.
Publicado: (2026)
Beyond Spurious Signals: Debiasing Multimodal Large Language Models via Counterfactual Inference and Adaptive Expert Routing
por: Wu, Zichen, et al.
Publicado: (2025)
por: Wu, Zichen, et al.
Publicado: (2025)
ISMAF: Intrinsic-Social Modality Alignment and Fusion for Multimodal Rumor Detection
por: Yu, Zihao, et al.
Publicado: (2025)
por: Yu, Zihao, et al.
Publicado: (2025)
Dynamic Interaction-Aware and Causality-Disentangled Framework for Multimodal Sentiment Analysis
por: Dong, Guangyuan, et al.
Publicado: (2026)
por: Dong, Guangyuan, et al.
Publicado: (2026)
PRISM-XR: Empowering Privacy-Aware XR Collaboration with Multimodal Large Language Models
por: Chen, Jiangong, et al.
Publicado: (2026)
por: Chen, Jiangong, et al.
Publicado: (2026)
Beyond Isolated Utterances: Cue-Guided Interaction for Context-Dependent Conversational Multimodal Understanding
por: Pan, Zhaoyan, et al.
Publicado: (2026)
por: Pan, Zhaoyan, et al.
Publicado: (2026)
Remember Past, Anticipate Future: Learning Continual Multimodal Misinformation Detectors
por: Wang, Bing, et al.
Publicado: (2025)
por: Wang, Bing, et al.
Publicado: (2025)
SCI-Reason: A Dataset with Chain-of-Thought Rationales for Complex Multimodal Reasoning in Academic Areas
por: Ma, Chenghao, et al.
Publicado: (2025)
por: Ma, Chenghao, et al.
Publicado: (2025)
Domain-Skewed Federated Learning with Feature Decoupling and Calibration
por: Wang, Huan, et al.
Publicado: (2026)
por: Wang, Huan, et al.
Publicado: (2026)
Bridging Discrete and Continuous: A Multimodal Strategy for Complex Emotion Detection
por: Jia, Jiehui, et al.
Publicado: (2024)
por: Jia, Jiehui, et al.
Publicado: (2024)
Contribution-Guided Asymmetric Learning for Robust Multimodal Fusion under Imbalance and Noise
por: Xu, Zijing, et al.
Publicado: (2025)
por: Xu, Zijing, et al.
Publicado: (2025)
Unveiling Covert Toxicity in Multimodal Data via Toxicity Association Graphs: A Graph-Based Metric and Interpretable Detection Framework
por: Wu, Guanzong, et al.
Publicado: (2026)
por: Wu, Guanzong, et al.
Publicado: (2026)
Hyperbolic Multimodal Generative Representation Learning for Generalized Zero-Shot Multimodal Information Extraction
por: Zhou, Baohang, et al.
Publicado: (2026)
por: Zhou, Baohang, et al.
Publicado: (2026)
Towards Alleviating Text-to-Image Retrieval Hallucination for CLIP in Zero-shot Learning
por: Wang, Hanyao, et al.
Publicado: (2024)
por: Wang, Hanyao, et al.
Publicado: (2024)
To Fuse or to Drop? Dual-Path Learning for Resolving Modality Conflicts in Multimodal Emotion Recognition
por: Yu, Yangchen, et al.
Publicado: (2026)
por: Yu, Yangchen, et al.
Publicado: (2026)
Learning Shared Sentiment Prototypes for Adaptive Multimodal Sentiment Analysis
por: Su, Chen, et al.
Publicado: (2026)
por: Su, Chen, et al.
Publicado: (2026)
Beyond Forced Modality Balance: Intrinsic Information Budgets for Multimodal Learning
por: Xiong, Zechang, et al.
Publicado: (2026)
por: Xiong, Zechang, et al.
Publicado: (2026)
MM-InstructEval: Zero-Shot Evaluation of (Multimodal) Large Language Models on Multimodal Reasoning Tasks
por: Yang, Xiaocui, et al.
Publicado: (2024)
por: Yang, Xiaocui, et al.
Publicado: (2024)
Incorporating Visual Experts to Resolve the Information Loss in Multimodal Large Language Models
por: He, Xin, et al.
Publicado: (2024)
por: He, Xin, et al.
Publicado: (2024)
Multimodal Emotion Recognition with Large Language Models
por: Zhang, Hongrui, et al.
Publicado: (2026)
por: Zhang, Hongrui, et al.
Publicado: (2026)
Exposing Cross-Modal Consistency for Fake News Detection in Short-Form Videos
por: Tian, Chong, et al.
Publicado: (2026)
por: Tian, Chong, et al.
Publicado: (2026)
Multimodal Fusion via Hypergraph Autoencoder and Contrastive Learning for Emotion Recognition in Conversation
por: Yi, Zijian, et al.
Publicado: (2024)
por: Yi, Zijian, et al.
Publicado: (2024)
Multimodal LLM-based Query Paraphrasing for Video Search
por: Wu, Jiaxin, et al.
Publicado: (2024)
por: Wu, Jiaxin, et al.
Publicado: (2024)
RA-BLIP: Multimodal Adaptive Retrieval-Augmented Bootstrapping Language-Image Pre-training
por: Ding, Muhe, et al.
Publicado: (2024)
por: Ding, Muhe, et al.
Publicado: (2024)
Virbo: Multimodal Multilingual Avatar Video Generation in Digital Marketing
por: Zhang, Juan, et al.
Publicado: (2024)
por: Zhang, Juan, et al.
Publicado: (2024)
Learning Complex Heterogeneous Multimodal Fake News via Social Latent Network Inference
por: Li, Mingxin, et al.
Publicado: (2025)
por: Li, Mingxin, et al.
Publicado: (2025)
Multimodal Classification and Out-of-distribution Detection for Multimodal Intent Understanding
por: Zhang, Hanlei, et al.
Publicado: (2024)
por: Zhang, Hanlei, et al.
Publicado: (2024)
MMC: Iterative Refinement of VLM Reasoning via MCTS-based Multimodal Critique
por: Liu, Shuhang, et al.
Publicado: (2025)
por: Liu, Shuhang, et al.
Publicado: (2025)
Exploring Transferability of Multimodal Adversarial Samples for Vision-Language Pre-training Models with Contrastive Learning
por: Wang, Youze, et al.
Publicado: (2023)
por: Wang, Youze, et al.
Publicado: (2023)
Multimodal Interaction Modeling via Self-Supervised Multi-Task Learning for Review Helpfulness Prediction
por: Gong, HongLin, et al.
Publicado: (2024)
por: Gong, HongLin, et al.
Publicado: (2024)
DiffCL: A Diffusion-Based Contrastive Learning Framework with Semantic Alignment for Multimodal Recommendations
por: Song, Qiya, et al.
Publicado: (2025)
por: Song, Qiya, et al.
Publicado: (2025)
PRM-BAS: Enhancing Multimodal Reasoning through PRM-guided Beam Annealing Search
por: Hu, Pengfei, et al.
Publicado: (2025)
por: Hu, Pengfei, et al.
Publicado: (2025)
Multimodal Representation Learning and Fusion
por: Jin, Qihang, et al.
Publicado: (2025)
por: Jin, Qihang, et al.
Publicado: (2025)
Dark Side of Modalities: Reinforced Multimodal Distillation for Multimodal Knowledge Graph Reasoning
por: Zhao, Yu, et al.
Publicado: (2025)
por: Zhao, Yu, et al.
Publicado: (2025)
MInD: Improving Multimodal Sentiment Analysis via Multimodal Information Disentanglement
por: Dai, Weichen, et al.
Publicado: (2024)
por: Dai, Weichen, et al.
Publicado: (2024)
Is One-Shot In-Context Learning Helpful for Data Selection in Task-Specific Fine-Tuning of Multimodal LLMs?
por: An, Xiao, et al.
Publicado: (2026)
por: An, Xiao, et al.
Publicado: (2026)
Differential Mental Disorder Detection with Psychology-Inspired Multimodal Stimuli
por: Zhou, Zhiyuan, et al.
Publicado: (2026)
por: Zhou, Zhiyuan, et al.
Publicado: (2026)
State-Anchored Complete-View Distillation for Robust Conversational Multimodal Emotion Recognition
por: Pan, Zhaoyan, et al.
Publicado: (2026)
por: Pan, Zhaoyan, et al.
Publicado: (2026)
Modality-Aware Identity Construction and Counterfactual Structure Learning for ID-Free Multimodal Recommendation
por: Ma, Hongjian, et al.
Publicado: (2026)
por: Ma, Hongjian, et al.
Publicado: (2026)
Recognizing Everything from All Modalities at Once: Grounded Multimodal Universal Information Extraction
por: Zhang, Meishan, et al.
Publicado: (2024)
por: Zhang, Meishan, et al.
Publicado: (2024)
Ejemplares similares
-
EASE: Federated Multimodal Unlearning via Entanglement-Aware Anchor Closure
por: Ding, Zihao, et al.
Publicado: (2026) -
Beyond Spurious Signals: Debiasing Multimodal Large Language Models via Counterfactual Inference and Adaptive Expert Routing
por: Wu, Zichen, et al.
Publicado: (2025) -
ISMAF: Intrinsic-Social Modality Alignment and Fusion for Multimodal Rumor Detection
por: Yu, Zihao, et al.
Publicado: (2025) -
Dynamic Interaction-Aware and Causality-Disentangled Framework for Multimodal Sentiment Analysis
por: Dong, Guangyuan, et al.
Publicado: (2026) -
PRISM-XR: Empowering Privacy-Aware XR Collaboration with Multimodal Large Language Models
por: Chen, Jiangong, et al.
Publicado: (2026)