Overcome Modal Bias in Multi-modal Federated Learning via Balanced Modality Selection
Fuente:
arXiv
Guardado en:
| Autores principales: | Fan, Yunfeng, Xu, Wenchao, Wang, Haozhao, Huo, Fushuo, Chen, Jinyu, Guo, Song |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Balanced Multi-modal Federated Learning via Cross-Modal Infiltration
por: Fan, Yunfeng, et al.
Publicado: (2023)
por: Fan, Yunfeng, et al.
Publicado: (2023)
Detached and Interactive Multimodal Learning
por: Fan, Yunfeng, et al.
Publicado: (2024)
por: Fan, Yunfeng, et al.
Publicado: (2024)
MM-MovieDubber: Towards Multi-Modal Learning for Multi-Modal Movie Dubbing
por: Zheng, Junjie, et al.
Publicado: (2025)
por: Zheng, Junjie, et al.
Publicado: (2025)
Quantifying and Enhancing Multi-modal Robustness with Modality Preference
por: Yang, Zequn, et al.
Publicado: (2024)
por: Yang, Zequn, et al.
Publicado: (2024)
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
por: Zhang, Zhenxing, et al.
Publicado: (2024)
por: Zhang, Zhenxing, et al.
Publicado: (2024)
MIRROR: Multi-Modal Pathological Self-Supervised Representation Learning via Modality Alignment and Retention
por: Wang, Tianyi, et al.
Publicado: (2025)
por: Wang, Tianyi, et al.
Publicado: (2025)
Multi-Modal Image Fusion via Intervention-Stable Feature Learning
por: Wang, Xue, et al.
Publicado: (2026)
por: Wang, Xue, et al.
Publicado: (2026)
HuMo: Human-Centric Video Generation via Collaborative Multi-Modal Conditioning
por: Chen, Liyang, et al.
Publicado: (2025)
por: Chen, Liyang, et al.
Publicado: (2025)
Hypergraph Tversky-Aware Domain Incremental Learning for Brain Tumor Segmentation with Missing Modalities
por: Wang, Junze, et al.
Publicado: (2025)
por: Wang, Junze, et al.
Publicado: (2025)
Signal: Selective Interaction and Global-local Alignment for Multi-Modal Object Re-Identification
por: Liu, Yangyang, et al.
Publicado: (2025)
por: Liu, Yangyang, et al.
Publicado: (2025)
SpikeMba: Multi-Modal Spiking Saliency Mamba for Temporal Video Grounding
por: Li, Wenrui, et al.
Publicado: (2024)
por: Li, Wenrui, et al.
Publicado: (2024)
Anisotropic Modality Align
por: Yu, Xiaomin, et al.
Publicado: (2026)
por: Yu, Xiaomin, et al.
Publicado: (2026)
Gradient-Guided Modality Decoupling for Missing-Modality Robustness
por: Wang, Hao, et al.
Publicado: (2024)
por: Wang, Hao, et al.
Publicado: (2024)
Truth in the Few: High-Value Data Selection for Efficient Multi-Modal Reasoning
por: Li, Shenshen, et al.
Publicado: (2025)
por: Li, Shenshen, et al.
Publicado: (2025)
Find the Cliffhanger: Multi-Modal Trailerness in Soap Operas
por: Bretti, Carlo, et al.
Publicado: (2024)
por: Bretti, Carlo, et al.
Publicado: (2024)
Cross-Modal and Uni-Modal Soft-Label Alignment for Image-Text Retrieval
por: Huang, Hailang, et al.
Publicado: (2024)
por: Huang, Hailang, et al.
Publicado: (2024)
Robust Modality-incomplete Anomaly Detection: A Modality-instructive Framework with Benchmark
por: Miao, Bingchen, et al.
Publicado: (2024)
por: Miao, Bingchen, et al.
Publicado: (2024)
CL2CM: Improving Cross-Lingual Cross-Modal Retrieval via Cross-Lingual Knowledge Transfer
por: Wang, Yabing, et al.
Publicado: (2023)
por: Wang, Yabing, et al.
Publicado: (2023)
HeGraphAdapter: Tuning Multi-Modal Vision-Language Models with Heterogeneous Graph Adapter
por: Zhao, Yumiao, et al.
Publicado: (2024)
por: Zhao, Yumiao, et al.
Publicado: (2024)
Multi-modal Speech Emotion Recognition via Feature Distribution Adaptation Network
por: Li, Shaokai, et al.
Publicado: (2024)
por: Li, Shaokai, et al.
Publicado: (2024)
Interactive Spatial-Frequency Fusion Mamba for Multi-Modal Image Fusion
por: Zhu, Yixin, et al.
Publicado: (2026)
por: Zhu, Yixin, et al.
Publicado: (2026)
Cross Modal Fine-Grained Alignment via Granularity-Aware and Region-Uncertain Modeling
por: Liu, Jiale, et al.
Publicado: (2025)
por: Liu, Jiale, et al.
Publicado: (2025)
DMC$^3$: Dual-Modal Counterfactual Contrastive Construction for Egocentric Video Question Answering
por: Zou, Jiayi, et al.
Publicado: (2025)
por: Zou, Jiayi, et al.
Publicado: (2025)
An Empirical Comparison of Video Frame Sampling Methods for Multi-Modal RAG Retrieval
por: Kandhare, Mahesh, et al.
Publicado: (2024)
por: Kandhare, Mahesh, et al.
Publicado: (2024)
GTPBD-MM: A Global Terraced Parcel and Boundary Dataset with Multi-Modality
por: Zhang, Zhiwei, et al.
Publicado: (2026)
por: Zhang, Zhiwei, et al.
Publicado: (2026)
Teacher-Guided Pseudo Supervision and Cross-Modal Alignment for Audio-Visual Video Parsing
por: Chen, Yaru, et al.
Publicado: (2025)
por: Chen, Yaru, et al.
Publicado: (2025)
Towards Universal Modal Tracking with Online Dense Temporal Token Learning
por: Zheng, Yaozong, et al.
Publicado: (2025)
por: Zheng, Yaozong, et al.
Publicado: (2025)
Robust Self-Paced Hashing for Cross-Modal Retrieval with Noisy Labels
por: Pu, Ruitao, et al.
Publicado: (2025)
por: Pu, Ruitao, et al.
Publicado: (2025)
PUMA: Layer-Pruned Language Model for Efficient Unified Multimodal Retrieval with Modality-Adaptive Learning
por: Lyu, Yibo, et al.
Publicado: (2025)
por: Lyu, Yibo, et al.
Publicado: (2025)
MambaPro: Multi-Modal Object Re-Identification with Mamba Aggregation and Synergistic Prompt
por: Wang, Yuhao, et al.
Publicado: (2024)
por: Wang, Yuhao, et al.
Publicado: (2024)
Towards Unbiased Cross-Modal Representation Learning for Food Image-to-Recipe Retrieval
por: Wang, Qing, et al.
Publicado: (2025)
por: Wang, Qing, et al.
Publicado: (2025)
Mitigating Cross-modal Representation Bias for Multicultural Image-to-Recipe Retrieval
por: Wang, Qing, et al.
Publicado: (2025)
por: Wang, Qing, et al.
Publicado: (2025)
SM3Det: A Unified Model for Multi-Modal Remote Sensing Object Detection
por: Li, Yuxuan, et al.
Publicado: (2024)
por: Li, Yuxuan, et al.
Publicado: (2024)
M3FAS: An Accurate and Robust MultiModal Mobile Face Anti-Spoofing System
por: Kong, Chenqi, et al.
Publicado: (2023)
por: Kong, Chenqi, et al.
Publicado: (2023)
Omni-Customizer: End-to-End MultiModal Customization for Joint Audio-Video Generation
por: Chen, Yuheng, et al.
Publicado: (2026)
por: Chen, Yuheng, et al.
Publicado: (2026)
M3R: Localized Rainfall Nowcasting with Meteorology-Informed MultiModal Attention
por: Panta, Sanjeev, et al.
Publicado: (2026)
por: Panta, Sanjeev, et al.
Publicado: (2026)
Deep Reversible Consistency Learning for Cross-modal Retrieval
por: Pu, Ruitao, et al.
Publicado: (2025)
por: Pu, Ruitao, et al.
Publicado: (2025)
Turing Patterns for Multimedia: Reaction-Diffusion Multi-Modal Fusion for Language-Guided Video Moment Retrieval
por: Fang, Xiang, et al.
Publicado: (2026)
por: Fang, Xiang, et al.
Publicado: (2026)
MSCT: Differential Cross-Modal Attention for Deepfake Detection
por: Wei, Fangda, et al.
Publicado: (2026)
por: Wei, Fangda, et al.
Publicado: (2026)
MM-Point: Multi-View Information-Enhanced Multi-Modal Self-Supervised 3D Point Cloud Understanding
por: Yu, Hai-Tao, et al.
Publicado: (2024)
por: Yu, Hai-Tao, et al.
Publicado: (2024)
Ejemplares similares
-
Balanced Multi-modal Federated Learning via Cross-Modal Infiltration
por: Fan, Yunfeng, et al.
Publicado: (2023) -
Detached and Interactive Multimodal Learning
por: Fan, Yunfeng, et al.
Publicado: (2024) -
MM-MovieDubber: Towards Multi-Modal Learning for Multi-Modal Movie Dubbing
por: Zheng, Junjie, et al.
Publicado: (2025) -
Quantifying and Enhancing Multi-modal Robustness with Modality Preference
por: Yang, Zequn, et al.
Publicado: (2024) -
ASAP: Advancing Semantic Alignment Promotes Multi-Modal Manipulation Detecting and Grounding
por: Zhang, Zhenxing, et al.
Publicado: (2024)