The More, the Merrier: Contrastive Fusion for Higher-Order Multimodal Alignment
Fuente:
arXiv
Guardado en:
| Autores principales: | Koutoupis, Stefanos, Zervou, Michaela Areti, Kontras, Konstantinos, De Vos, Maarten, Tsakalides, Panagiotis, Tsagkatakis, Grigorios |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Improving Multimodal Learning with Multi-Loss Gradient Modulation
por: Kontras, Konstantinos, et al.
Publicado: (2024)
por: Kontras, Konstantinos, et al.
Publicado: (2024)
Balancing Multimodal Training Through Game-Theoretic Regularization
por: Kontras, Konstantinos, et al.
Publicado: (2024)
por: Kontras, Konstantinos, et al.
Publicado: (2024)
Multimodal Alignment and Fusion: A Survey
por: Li, Songtao, et al.
Publicado: (2024)
por: Li, Songtao, et al.
Publicado: (2024)
Latent Reconstruction from Generated Data for Multimodal Misinformation Detection
por: Papadopoulos, Stefanos-Iordanis, et al.
Publicado: (2025)
por: Papadopoulos, Stefanos-Iordanis, et al.
Publicado: (2025)
RED-DOT: Multimodal Fact-checking via Relevant Evidence Detection
por: Papadopoulos, Stefanos-Iordanis, et al.
Publicado: (2023)
por: Papadopoulos, Stefanos-Iordanis, et al.
Publicado: (2023)
"Humor, Art, or Misinformation?": A Multimodal Dataset for Intent-Aware Synthetic Image Detection
por: Skoularikis, Anastasios, et al.
Publicado: (2025)
por: Skoularikis, Anastasios, et al.
Publicado: (2025)
Multimodal and Multiview Deep Fusion for Autonomous Marine Navigation
por: Dagdilelis, Dimitrios, et al.
Publicado: (2025)
por: Dagdilelis, Dimitrios, et al.
Publicado: (2025)
4D Multimodal Co-attention Fusion Network with Latent Contrastive Alignment for Alzheimer's Diagnosis
por: Wei, Yuxiang, et al.
Publicado: (2025)
por: Wei, Yuxiang, et al.
Publicado: (2025)
MF2Summ: Multimodal Fusion for Video Summarization with Temporal Alignment
por: wang, Shuo, et al.
Publicado: (2025)
por: wang, Shuo, et al.
Publicado: (2025)
Learning Contrastive Multimodal Fusion with Improved Modality Dropout for Disease Detection and Prediction
por: Gu, Yi, et al.
Publicado: (2025)
por: Gu, Yi, et al.
Publicado: (2025)
UrbanFusion: Stochastic Multimodal Fusion for Contrastive Learning of Robust Spatial Representations
por: Mühlematter, Dominik J., et al.
Publicado: (2025)
por: Mühlematter, Dominik J., et al.
Publicado: (2025)
TropNNC: Structured Neural Network Compression Using Tropical Geometry
por: Fotopoulos, Konstantinos, et al.
Publicado: (2024)
por: Fotopoulos, Konstantinos, et al.
Publicado: (2024)
HAL-NeRF: High Accuracy Localization Leveraging Neural Radiance Fields
por: Reppas, Asterios, et al.
Publicado: (2025)
por: Reppas, Asterios, et al.
Publicado: (2025)
Uncertainty-guided Contrastive Learning for Single Source Domain Generalisation
por: Arsenos, Anastasios, et al.
Publicado: (2024)
por: Arsenos, Anastasios, et al.
Publicado: (2024)
DashFusion: Dual-stream Alignment with Hierarchical Bottleneck Fusion for Multimodal Sentiment Analysis
por: Wen, Yuhua, et al.
Publicado: (2025)
por: Wen, Yuhua, et al.
Publicado: (2025)
Alignment and Adversarial Robustness: Are More Human-Like Models More Secure?
por: Hoak, Blaine, et al.
Publicado: (2025)
por: Hoak, Blaine, et al.
Publicado: (2025)
ShapeFusion: A 3D diffusion model for localized shape editing
por: Potamias, Rolandos Alexandros, et al.
Publicado: (2024)
por: Potamias, Rolandos Alexandros, et al.
Publicado: (2024)
Similarity over Factuality: Are we making progress on multimodal out-of-context misinformation detection?
por: Papadopoulos, Stefanos-Iordanis, et al.
Publicado: (2024)
por: Papadopoulos, Stefanos-Iordanis, et al.
Publicado: (2024)
A Hybrid Approach for Closing the Sim2real Appearance Gap in Game Engine Synthetic Datasets
por: Pasios, Stefanos
Publicado: (2026)
por: Pasios, Stefanos
Publicado: (2026)
SeaDATE: Remedy Dual-Attention Transformer with Semantic Alignment via Contrast Learning for Multimodal Object Detection
por: Dong, Shuhan, et al.
Publicado: (2024)
por: Dong, Shuhan, et al.
Publicado: (2024)
Trajectory-Aware Adaptive Inference in Object Detection Models
por: Papanikolaou, Grigorios, et al.
Publicado: (2026)
por: Papanikolaou, Grigorios, et al.
Publicado: (2026)
SyCoCa: Symmetrizing Contrastive Captioners with Attentive Masking for Multimodal Alignment
por: Ma, Ziping, et al.
Publicado: (2024)
por: Ma, Ziping, et al.
Publicado: (2024)
Twins-PainViT: Towards a Modality-Agnostic Vision Transformer Framework for Multimodal Automatic Pain Assessment using Facial Videos and fNIRS
por: Gkikas, Stefanos, et al.
Publicado: (2024)
por: Gkikas, Stefanos, et al.
Publicado: (2024)
Parkinson's Disease Classification Using Contrastive Graph Cross-View Learning with Multimodal Fusion of SPECT Images and Clinical Features
por: Ding, Jun-En, et al.
Publicado: (2023)
por: Ding, Jun-En, et al.
Publicado: (2023)
Alignment, Mining and Fusion: Representation Alignment with Hard Negative Mining and Selective Knowledge Fusion for Medical Visual Question Answering
por: Zou, Yuanhao, et al.
Publicado: (2025)
por: Zou, Yuanhao, et al.
Publicado: (2025)
SignMouth: Leveraging Mouthing Cues for Sign Language Translation by Multimodal Contrastive Fusion
por: Wu, Wenfang, et al.
Publicado: (2025)
por: Wu, Wenfang, et al.
Publicado: (2025)
Unbiased Dynamic Multimodal Fusion
por: Wei, Shicai, et al.
Publicado: (2026)
por: Wei, Shicai, et al.
Publicado: (2026)
AGSP-DSA: An Adaptive Graph Signal Processing Framework for Robust Multimodal Fusion with Dynamic Semantic Alignment
por: Karthikeya, KV, et al.
Publicado: (2026)
por: Karthikeya, KV, et al.
Publicado: (2026)
Understanding Multimodal Complementarity for Single-Frame Action Anticipation
por: Benavent-Lledo, Manuel, et al.
Publicado: (2026)
por: Benavent-Lledo, Manuel, et al.
Publicado: (2026)
See More, Change Less: Anatomy-Aware Diffusion for Contrast Enhancement
por: Liu, Junqi, et al.
Publicado: (2025)
por: Liu, Junqi, et al.
Publicado: (2025)
PCF-Lift: Panoptic Lifting by Probabilistic Contrastive Fusion
por: Zhu, Runsong, et al.
Publicado: (2024)
por: Zhu, Runsong, et al.
Publicado: (2024)
Denoising-Contrastive Alignment for Continuous Sign Language Recognition
por: Guo, Leming, et al.
Publicado: (2023)
por: Guo, Leming, et al.
Publicado: (2023)
Representation Alignment Contrastive Regularization for Multi-Object Tracking
por: Liu, Zhonglin, et al.
Publicado: (2024)
por: Liu, Zhonglin, et al.
Publicado: (2024)
Backdooring Self-Supervised Contrastive Learning by Noisy Alignment
por: Chen, Tuo, et al.
Publicado: (2025)
por: Chen, Tuo, et al.
Publicado: (2025)
PowerCLIP: Powerset Alignment for Contrastive Pre-Training
por: Kawamura, Masaki, et al.
Publicado: (2025)
por: Kawamura, Masaki, et al.
Publicado: (2025)
Improving Contrastive Learning for Referring Expression Counting
por: Triaridis, Kostas, et al.
Publicado: (2025)
por: Triaridis, Kostas, et al.
Publicado: (2025)
Hyperbolic Cycle Alignment for Infrared-Visible Image Fusion
por: Li, Timing, et al.
Publicado: (2025)
por: Li, Timing, et al.
Publicado: (2025)
Interactive Multimodal Fusion with Temporal Modeling
por: Yu, Jun, et al.
Publicado: (2025)
por: Yu, Jun, et al.
Publicado: (2025)
FusionMamba: Dynamic Feature Enhancement for Multimodal Image Fusion with Mamba
por: Xie, Xinyu, et al.
Publicado: (2024)
por: Xie, Xinyu, et al.
Publicado: (2024)
GeminiFusion: Efficient Pixel-wise Multimodal Fusion for Vision Transformer
por: Jia, Ding, et al.
Publicado: (2024)
por: Jia, Ding, et al.
Publicado: (2024)
Ejemplares similares
-
Improving Multimodal Learning with Multi-Loss Gradient Modulation
por: Kontras, Konstantinos, et al.
Publicado: (2024) -
Balancing Multimodal Training Through Game-Theoretic Regularization
por: Kontras, Konstantinos, et al.
Publicado: (2024) -
Multimodal Alignment and Fusion: A Survey
por: Li, Songtao, et al.
Publicado: (2024) -
Latent Reconstruction from Generated Data for Multimodal Misinformation Detection
por: Papadopoulos, Stefanos-Iordanis, et al.
Publicado: (2025) -
RED-DOT: Multimodal Fact-checking via Relevant Evidence Detection
por: Papadopoulos, Stefanos-Iordanis, et al.
Publicado: (2023)