Robult: Leveraging Redundancy and Modality Specific Features for Robust Multimodal Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Nguyen, Duy A., Kamboj, Abhi, Do, Minh N. |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Towards Achieving Perfect Multimodal Alignment
di: Kamboj, Abhi, et al.
Pubblicazione: (2025)
di: Kamboj, Abhi, et al.
Pubblicazione: (2025)
A Survey of IMU Based Cross-Modal Transfer Learning in Human Activity Recognition
di: Kamboj, Abhi, et al.
Pubblicazione: (2024)
di: Kamboj, Abhi, et al.
Pubblicazione: (2024)
C3T: Cross-modal Transfer Through Time for Sensor-based Human Activity Recognition
di: Kamboj, Abhi, et al.
Pubblicazione: (2024)
di: Kamboj, Abhi, et al.
Pubblicazione: (2024)
The Progression of Transformers from Language to Vision to MOT: A Literature Review on Multi-Object Tracking with Transformers
di: Kamboj, Abhi
Pubblicazione: (2024)
di: Kamboj, Abhi
Pubblicazione: (2024)
A Brief Survey on Leveraging Large Scale Vision Models for Enhanced Robot Grasping
di: Kamboj, Abhi, et al.
Pubblicazione: (2024)
di: Kamboj, Abhi, et al.
Pubblicazione: (2024)
Robust Multimodal Learning via Cross-Modal Proxy Tokens
di: Reza, Md Kaykobad, et al.
Pubblicazione: (2025)
di: Reza, Md Kaykobad, et al.
Pubblicazione: (2025)
Leveraging Model Soups to Classify Intangible Cultural Heritage Images from the Mekong Delta
di: Tran, Quoc-Khang, et al.
Pubblicazione: (2026)
di: Tran, Quoc-Khang, et al.
Pubblicazione: (2026)
Self-Captioning Multimodal Interaction Tuning: Amplifying Exploitable Redundancies for Robust Vision Language Models
di: Ryan, Yuriel, et al.
Pubblicazione: (2026)
di: Ryan, Yuriel, et al.
Pubblicazione: (2026)
Low-cost Robust Night-time Aerial Material Segmentation through Hyperspectral Data and Sparse Spatio-Temporal Learning
di: Bajaj, Chandrajit, et al.
Pubblicazione: (2024)
di: Bajaj, Chandrajit, et al.
Pubblicazione: (2024)
Multi-Surrogate-Teacher Assistance for Representation Alignment in Fingerprint-based Indoor Localization
di: Nguyen, Son Minh, et al.
Pubblicazione: (2024)
di: Nguyen, Son Minh, et al.
Pubblicazione: (2024)
A Multimodal Fusion Model Leveraging MLP Mixer and Handcrafted Features-based Deep Learning Networks for Facial Palsy Detection
di: Oo, Heng Yim Nicole, et al.
Pubblicazione: (2025)
di: Oo, Heng Yim Nicole, et al.
Pubblicazione: (2025)
Explaining and Mitigating the Modality Gap in Contrastive Multimodal Learning
di: Yaras, Can, et al.
Pubblicazione: (2024)
di: Yaras, Can, et al.
Pubblicazione: (2024)
Deep Multimodal Learning with Missing Modality: A Survey
di: Wu, Renjie, et al.
Pubblicazione: (2024)
di: Wu, Renjie, et al.
Pubblicazione: (2024)
Universal Multi-Domain Translation via Diffusion Routers
di: Kieu, Duc, et al.
Pubblicazione: (2025)
di: Kieu, Duc, et al.
Pubblicazione: (2025)
Point Cloud Compression with Bits-back Coding
di: Hieu, Nguyen Quang, et al.
Pubblicazione: (2024)
di: Hieu, Nguyen Quang, et al.
Pubblicazione: (2024)
Diverse Prototypical Ensembles Improve Robustness to Subpopulation Shift
di: To, Minh Nguyen Nhat, et al.
Pubblicazione: (2025)
di: To, Minh Nguyen Nhat, et al.
Pubblicazione: (2025)
Redundancy-aware Action Spaces for Robot Learning
di: Mazzaglia, Pietro, et al.
Pubblicazione: (2024)
di: Mazzaglia, Pietro, et al.
Pubblicazione: (2024)
Adversarial Attacks Leverage Interference Between Features in Superposition
di: Stevinson, Edward, et al.
Pubblicazione: (2025)
di: Stevinson, Edward, et al.
Pubblicazione: (2025)
Multi-Modal Video Feature Extraction for Popularity Prediction
di: Liu, Haixu, et al.
Pubblicazione: (2025)
di: Liu, Haixu, et al.
Pubblicazione: (2025)
SuoiAI: Building a Dataset for Aquatic Invertebrates in Vietnam
di: Vo, Tue, et al.
Pubblicazione: (2025)
di: Vo, Tue, et al.
Pubblicazione: (2025)
Learnable Expansion of Graph Operators for Multi-Modal Feature Fusion
di: Ding, Dexuan, et al.
Pubblicazione: (2024)
di: Ding, Dexuan, et al.
Pubblicazione: (2024)
CroMe: Multimodal Fake News Detection using Cross-Modal Tri-Transformer and Metric Learning
di: Choi, Eunjee, et al.
Pubblicazione: (2025)
di: Choi, Eunjee, et al.
Pubblicazione: (2025)
VDInstruct: Zero-Shot Key Information Extraction via Content-Aware Vision Tokenization
di: Nguyen, Son, et al.
Pubblicazione: (2025)
di: Nguyen, Son, et al.
Pubblicazione: (2025)
Diagnosing and Mitigating Modality Interference in Multimodal Large Language Models
di: Cai, Rui, et al.
Pubblicazione: (2025)
di: Cai, Rui, et al.
Pubblicazione: (2025)
AFD: Mitigating Feature Gap for Adversarial Robustness by Feature Disentanglement
di: Zhou, Nuoyan, et al.
Pubblicazione: (2024)
di: Zhou, Nuoyan, et al.
Pubblicazione: (2024)
Logit Calibration and Feature Contrast for Robust Federated Learning on Non-IID Data
di: Qiao, Yu, et al.
Pubblicazione: (2024)
di: Qiao, Yu, et al.
Pubblicazione: (2024)
Learning Robust Convolutional Neural Networks with Relevant Feature Focusing via Explanations
di: Adachi, Kazuki, et al.
Pubblicazione: (2022)
di: Adachi, Kazuki, et al.
Pubblicazione: (2022)
Hide and Seek: Investigating Redundancy in Earth Observation Imagery
di: Papazafeiropoulos, Tasos, et al.
Pubblicazione: (2026)
di: Papazafeiropoulos, Tasos, et al.
Pubblicazione: (2026)
Dynamic Cross-Modal Prompt Generation for Multimodal Continual Instruction Tuning
di: Hu, Tao, et al.
Pubblicazione: (2026)
di: Hu, Tao, et al.
Pubblicazione: (2026)
Multimodal Foundation Model for Cross-Modal Retrieval and Activity Recognition Tasks
di: Matsuishi, Koki, et al.
Pubblicazione: (2025)
di: Matsuishi, Koki, et al.
Pubblicazione: (2025)
Multimodal Pathway: Improve Transformers with Irrelevant Data from Other Modalities
di: Zhang, Yiyuan, et al.
Pubblicazione: (2024)
di: Zhang, Yiyuan, et al.
Pubblicazione: (2024)
Learning to Inference Adaptively for Multimodal Large Language Models
di: Xu, Zhuoyan, et al.
Pubblicazione: (2025)
di: Xu, Zhuoyan, et al.
Pubblicazione: (2025)
Multimodal Fusion Strategies for Mapping Biophysical Landscape Features
di: Gordon, Lucia, et al.
Pubblicazione: (2024)
di: Gordon, Lucia, et al.
Pubblicazione: (2024)
MIND: Modality-Informed Knowledge Distillation Framework for Multimodal Clinical Prediction Tasks
di: Guerra-Manzanares, Alejandro, et al.
Pubblicazione: (2025)
di: Guerra-Manzanares, Alejandro, et al.
Pubblicazione: (2025)
StitchFusion: Weaving Any Visual Modalities to Enhance Multimodal Semantic Segmentation
di: Li, Bingyu, et al.
Pubblicazione: (2024)
di: Li, Bingyu, et al.
Pubblicazione: (2024)
TRACER: Persistent Regularization for Robust Multimodal Finetuning
di: Asadollahzadeh, Hesam, et al.
Pubblicazione: (2026)
di: Asadollahzadeh, Hesam, et al.
Pubblicazione: (2026)
Learning Noise-Robust Joint Representation for Multimodal Emotion Recognition under Incomplete Data Scenarios
di: Fan, Qi, et al.
Pubblicazione: (2023)
di: Fan, Qi, et al.
Pubblicazione: (2023)
VIFO: Visual Feature Empowered Multivariate Time Series Forecasting with Cross-Modal Fusion
di: Wang, Yanlong, et al.
Pubblicazione: (2025)
di: Wang, Yanlong, et al.
Pubblicazione: (2025)
Detecting Brittle Decisions for Free: Leveraging Margin Consistency in Deep Robust Classifiers
di: Ngnawé, Jonas, et al.
Pubblicazione: (2024)
di: Ngnawé, Jonas, et al.
Pubblicazione: (2024)
Learning and Leveraging World Models in Visual Representation Learning
di: Garrido, Quentin, et al.
Pubblicazione: (2024)
di: Garrido, Quentin, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Towards Achieving Perfect Multimodal Alignment
di: Kamboj, Abhi, et al.
Pubblicazione: (2025) -
A Survey of IMU Based Cross-Modal Transfer Learning in Human Activity Recognition
di: Kamboj, Abhi, et al.
Pubblicazione: (2024) -
C3T: Cross-modal Transfer Through Time for Sensor-based Human Activity Recognition
di: Kamboj, Abhi, et al.
Pubblicazione: (2024) -
The Progression of Transformers from Language to Vision to MOT: A Literature Review on Multi-Object Tracking with Transformers
di: Kamboj, Abhi
Pubblicazione: (2024) -
A Brief Survey on Leveraging Large Scale Vision Models for Enhanced Robot Grasping
di: Kamboj, Abhi, et al.
Pubblicazione: (2024)