Multi-modal Data Spectrum: Multi-modal Datasets are Multi-dimensional
Fuente:
arXiv
Salvato in:
| Autori principali: | Madaan, Divyam, Muhunthan, Varshan, Cho, Kyunghyun, Chopra, Sumit |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Jointly Modeling Inter- & Intra-Modality Dependencies for Multi-modal Learning
di: Madaan, Divyam, et al.
Pubblicazione: (2024)
di: Madaan, Divyam, et al.
Pubblicazione: (2024)
Temporal Generalization: A Reality Check
di: Madaan, Divyam, et al.
Pubblicazione: (2025)
di: Madaan, Divyam, et al.
Pubblicazione: (2025)
Characterizing the Predictive Impact of Modalities with Supervised Latent-Variable Modeling
di: Madaan, Divyam, et al.
Pubblicazione: (2026)
di: Madaan, Divyam, et al.
Pubblicazione: (2026)
HIST-AID: Leveraging Historical Patient Reports for Enhanced Multi-Modal Automatic Diagnosis
di: Huang, Haoxu, et al.
Pubblicazione: (2024)
di: Huang, Haoxu, et al.
Pubblicazione: (2024)
BloomVQA: Assessing Hierarchical Multi-modal Comprehension
di: Gong, Yunye, et al.
Pubblicazione: (2023)
di: Gong, Yunye, et al.
Pubblicazione: (2023)
MuMA-ToM: Multi-modal Multi-Agent Theory of Mind
di: Shi, Haojun, et al.
Pubblicazione: (2024)
di: Shi, Haojun, et al.
Pubblicazione: (2024)
What If the TV Was Off? Examining Counterfactual Reasoning Abilities of Multi-modal Language Models
di: Zhang, Letian, et al.
Pubblicazione: (2023)
di: Zhang, Letian, et al.
Pubblicazione: (2023)
The Labyrinth of Links: Navigating the Associative Maze of Multi-modal LLMs
di: Li, Hong, et al.
Pubblicazione: (2024)
di: Li, Hong, et al.
Pubblicazione: (2024)
SPHINX-X: Scaling Data and Parameters for a Family of Multi-modal Large Language Models
di: Liu, Dongyang, et al.
Pubblicazione: (2024)
di: Liu, Dongyang, et al.
Pubblicazione: (2024)
Multi-level and Multi-modal Action Anticipation
di: Kim, Seulgi, et al.
Pubblicazione: (2025)
di: Kim, Seulgi, et al.
Pubblicazione: (2025)
Concepts or Skills? Rethinking Instruction Selection for Multi-modal Models
di: Bai, Andrew, et al.
Pubblicazione: (2025)
di: Bai, Andrew, et al.
Pubblicazione: (2025)
GET: Unlocking the Multi-modal Potential of CLIP for Generalized Category Discovery
di: Wang, Enguang, et al.
Pubblicazione: (2024)
di: Wang, Enguang, et al.
Pubblicazione: (2024)
A training regime to learn unified representations from complementary breast imaging modalities
di: Sharma, Umang, et al.
Pubblicazione: (2024)
di: Sharma, Umang, et al.
Pubblicazione: (2024)
Mitigating the Modality Gap: Few-Shot Out-of-Distribution Detection with Multi-modal Prototypes and Image Bias Estimation
di: Wang, Yimu, et al.
Pubblicazione: (2025)
di: Wang, Yimu, et al.
Pubblicazione: (2025)
ElectroVizQA: How well do Multi-modal LLMs perform in Electronics Visual Question Answering?
di: Meshram, Pragati Shuddhodhan, et al.
Pubblicazione: (2024)
di: Meshram, Pragati Shuddhodhan, et al.
Pubblicazione: (2024)
MIS-ME: A Multi-modal Framework for Soil Moisture Estimation
di: Rakib, Mohammed, et al.
Pubblicazione: (2024)
di: Rakib, Mohammed, et al.
Pubblicazione: (2024)
MMCTAgent: Multi-modal Critical Thinking Agent Framework for Complex Visual Reasoning
di: Kumar, Somnath, et al.
Pubblicazione: (2024)
di: Kumar, Somnath, et al.
Pubblicazione: (2024)
Simultaneous Long-tailed Recognition and Multi-modal Fusion for Highly Imbalanced Multi-modal Data
di: Yoon, Heegeon, et al.
Pubblicazione: (2026)
di: Yoon, Heegeon, et al.
Pubblicazione: (2026)
Plane Geometry Problem Solving with Multi-modal Reasoning: A Survey
di: Cho, Seunghyuk, et al.
Pubblicazione: (2025)
di: Cho, Seunghyuk, et al.
Pubblicazione: (2025)
Multi-modal Preference Alignment Remedies Degradation of Visual Instruction Tuning on Language Models
di: Li, Shengzhi, et al.
Pubblicazione: (2024)
di: Li, Shengzhi, et al.
Pubblicazione: (2024)
Learnable Cross-modal Knowledge Distillation for Multi-modal Learning with Missing Modality
di: Wang, Hu, et al.
Pubblicazione: (2023)
di: Wang, Hu, et al.
Pubblicazione: (2023)
Large Multi-modal Models Can Interpret Features in Large Multi-modal Models
di: Zhang, Kaichen, et al.
Pubblicazione: (2024)
di: Zhang, Kaichen, et al.
Pubblicazione: (2024)
Analyzing and Boosting the Power of Fine-Grained Visual Recognition for Multi-modal Large Language Models
di: He, Hulingxiao, et al.
Pubblicazione: (2025)
di: He, Hulingxiao, et al.
Pubblicazione: (2025)
Preserving Pre-trained Representation Space: On Effectiveness of Prefix-tuning for Large Multi-modal Models
di: Kim, Donghoon, et al.
Pubblicazione: (2024)
di: Kim, Donghoon, et al.
Pubblicazione: (2024)
From Consistency to Complementarity: Aligned and Disentangled Multi-modal Learning for Time Series Understanding and Reasoning
di: Ni, Hang, et al.
Pubblicazione: (2026)
di: Ni, Hang, et al.
Pubblicazione: (2026)
Towards Multi-modal Transformers in Federated Learning
di: Sun, Guangyu, et al.
Pubblicazione: (2024)
di: Sun, Guangyu, et al.
Pubblicazione: (2024)
Multi-modal learning for geospatial vegetation forecasting
di: Benson, Vitus, et al.
Pubblicazione: (2023)
di: Benson, Vitus, et al.
Pubblicazione: (2023)
Multi-modal Data Binding for Survival Analysis Modeling with Incomplete Data and Annotations
di: Qu, Linhao, et al.
Pubblicazione: (2024)
di: Qu, Linhao, et al.
Pubblicazione: (2024)
Multi-modal Representation Learning for Cross-modal Prediction of Continuous Weather Patterns from Discrete Low-Dimensional Data
di: Qayyum, Alif Bin Abdul, et al.
Pubblicazione: (2024)
di: Qayyum, Alif Bin Abdul, et al.
Pubblicazione: (2024)
MathVerse: Does Your Multi-modal LLM Truly See the Diagrams in Visual Math Problems?
di: Zhang, Renrui, et al.
Pubblicazione: (2024)
di: Zhang, Renrui, et al.
Pubblicazione: (2024)
Multi-modal Semantic Understanding with Contrastive Cross-modal Feature Alignment
di: Zhang, Ming, et al.
Pubblicazione: (2024)
di: Zhang, Ming, et al.
Pubblicazione: (2024)
cadrille: Multi-modal CAD Reconstruction with Reinforcement Learning
di: Kolodiazhnyi, Maksim, et al.
Pubblicazione: (2025)
di: Kolodiazhnyi, Maksim, et al.
Pubblicazione: (2025)
Multi-level Cross-modal Alignment for Image Clustering
di: Qiu, Liping, et al.
Pubblicazione: (2024)
di: Qiu, Liping, et al.
Pubblicazione: (2024)
Fairness in Multi-modal Medical Diagnosis with Demonstration Selection
di: Li, Dawei, et al.
Pubblicazione: (2025)
di: Li, Dawei, et al.
Pubblicazione: (2025)
Do We Really Need Curated Malicious Data for Safety Alignment in Multi-modal Large Language Models?
di: Wang, Yanbo, et al.
Pubblicazione: (2025)
di: Wang, Yanbo, et al.
Pubblicazione: (2025)
Improving Medical Multi-modal Contrastive Learning with Expert Annotations
di: Kumar, Yogesh, et al.
Pubblicazione: (2024)
di: Kumar, Yogesh, et al.
Pubblicazione: (2024)
Cross-modal Causal Relation Alignment for Video Question Grounding
di: Chen, Weixing, et al.
Pubblicazione: (2025)
di: Chen, Weixing, et al.
Pubblicazione: (2025)
Multi-modal Co-learning for Earth Observation: Enhancing single-modality models via modality collaboration
di: Mena, Francisco, et al.
Pubblicazione: (2025)
di: Mena, Francisco, et al.
Pubblicazione: (2025)
On the Multi-modal Vulnerability of Diffusion Models
di: Yang, Dingcheng, et al.
Pubblicazione: (2024)
di: Yang, Dingcheng, et al.
Pubblicazione: (2024)
Cross-modal RAG: Sub-dimensional Text-to-Image Retrieval-Augmented Generation
di: Zhu, Mengdan, et al.
Pubblicazione: (2025)
di: Zhu, Mengdan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Jointly Modeling Inter- & Intra-Modality Dependencies for Multi-modal Learning
di: Madaan, Divyam, et al.
Pubblicazione: (2024) -
Temporal Generalization: A Reality Check
di: Madaan, Divyam, et al.
Pubblicazione: (2025) -
Characterizing the Predictive Impact of Modalities with Supervised Latent-Variable Modeling
di: Madaan, Divyam, et al.
Pubblicazione: (2026) -
HIST-AID: Leveraging Historical Patient Reports for Enhanced Multi-Modal Automatic Diagnosis
di: Huang, Haoxu, et al.
Pubblicazione: (2024) -
BloomVQA: Assessing Hierarchical Multi-modal Comprehension
di: Gong, Yunye, et al.
Pubblicazione: (2023)