Closing the Modality Gap Aligns Group-Wise Semantics
Fuente:
arXiv
Salvato in:
| Autori principali: | Grassucci, Eleonora, Cicchetti, Giordano, Frasca, Emanuele, Uncini, Aurelio, Comminiello, Danilo |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Closing the gap in multimodal medical representation alignment
di: Grassucci, Eleonora, et al.
Pubblicazione: (2026)
di: Grassucci, Eleonora, et al.
Pubblicazione: (2026)
A TRIANGLE Enables Multimodal Alignment Beyond Cosine Similarity
di: Cicchetti, Giordano, et al.
Pubblicazione: (2025)
di: Cicchetti, Giordano, et al.
Pubblicazione: (2025)
FoleyGRAM: Video-to-Audio Generation with GRAM-Aligned Multimodal Encoders
di: Gramaccioni, Riccardo Fosco, et al.
Pubblicazione: (2025)
di: Gramaccioni, Riccardo Fosco, et al.
Pubblicazione: (2025)
Gramian Multimodal Representation Learning and Alignment
di: Cicchetti, Giordano, et al.
Pubblicazione: (2024)
di: Cicchetti, Giordano, et al.
Pubblicazione: (2024)
Semantic Compression via Multimodal Representation Learning
di: Grassucci, Eleonora, et al.
Pubblicazione: (2025)
di: Grassucci, Eleonora, et al.
Pubblicazione: (2025)
Generalizing Medical Image Representations via Quaternion Wavelet Networks
di: Sigillo, Luigi, et al.
Pubblicazione: (2023)
di: Sigillo, Luigi, et al.
Pubblicazione: (2023)
Hierarchical Hypercomplex Network for Multimodal Emotion Recognition
di: Lopez, Eleonora, et al.
Pubblicazione: (2024)
di: Lopez, Eleonora, et al.
Pubblicazione: (2024)
Multi-View Hypercomplex Learning for Breast Cancer Screening
di: Lopez, Eleonora, et al.
Pubblicazione: (2022)
di: Lopez, Eleonora, et al.
Pubblicazione: (2022)
Language-Oriented Semantic Latent Representation for Image Transmission
di: Cicchetti, Giordano, et al.
Pubblicazione: (2024)
di: Cicchetti, Giordano, et al.
Pubblicazione: (2024)
Quaternion Wavelet-Conditioned Diffusion Models for Image Super-Resolution
di: Sigillo, Luigi, et al.
Pubblicazione: (2025)
di: Sigillo, Luigi, et al.
Pubblicazione: (2025)
NAF-DPM: A Nonlinear Activation-Free Diffusion Probabilistic Model for Document Enhancement
di: Cicchetti, Giordano, et al.
Pubblicazione: (2024)
di: Cicchetti, Giordano, et al.
Pubblicazione: (2024)
Training-Free Multimodal Guidance for Video to Audio Generation
di: Grassucci, Eleonora, et al.
Pubblicazione: (2025)
di: Grassucci, Eleonora, et al.
Pubblicazione: (2025)
Towards Explaining Hypercomplex Neural Networks
di: Lopez, Eleonora, et al.
Pubblicazione: (2024)
di: Lopez, Eleonora, et al.
Pubblicazione: (2024)
TACE: Tumor-Aware Counterfactual Explanations
di: Rossi, Eleonora Beatrice, et al.
Pubblicazione: (2024)
di: Rossi, Eleonora Beatrice, et al.
Pubblicazione: (2024)
Demystifying the Hypercomplex: Inductive Biases in Hypercomplex Deep Learning
di: Comminiello, Danilo, et al.
Pubblicazione: (2024)
di: Comminiello, Danilo, et al.
Pubblicazione: (2024)
Beyond Answers: How LLMs Can Pursue Strategic Thinking in Education
di: Grassucci, Eleonora, et al.
Pubblicazione: (2025)
di: Grassucci, Eleonora, et al.
Pubblicazione: (2025)
A Wavelet Diffusion GAN for Image Super-Resolution
di: Aloisi, Lorenzo, et al.
Pubblicazione: (2024)
di: Aloisi, Lorenzo, et al.
Pubblicazione: (2024)
Attention-Map Augmentation for Hypercomplex Breast Cancer Classification
di: Lopez, Eleonora, et al.
Pubblicazione: (2023)
di: Lopez, Eleonora, et al.
Pubblicazione: (2023)
Controllable Audio-Visual Viewpoint Generation from 360° Spatial Information
di: Marinoni, Christian, et al.
Pubblicazione: (2025)
di: Marinoni, Christian, et al.
Pubblicazione: (2025)
Training-Free Multi-User Generative Semantic Communications via Null-Space Diffusion Sampling
di: Grassucci, Eleonora, et al.
Pubblicazione: (2024)
di: Grassucci, Eleonora, et al.
Pubblicazione: (2024)
Metadata, Wavelet, and Time Aware Diffusion Models for Satellite Image Super Resolution
di: Sigillo, Luigi, et al.
Pubblicazione: (2025)
di: Sigillo, Luigi, et al.
Pubblicazione: (2025)
PHemoNet: A Multimodal Network for Physiological Signals
di: Lopez, Eleonora, et al.
Pubblicazione: (2024)
di: Lopez, Eleonora, et al.
Pubblicazione: (2024)
Guess What I Think: Streamlined EEG-to-Image Generation with Latent Diffusion Models
di: Lopez, Eleonora, et al.
Pubblicazione: (2024)
di: Lopez, Eleonora, et al.
Pubblicazione: (2024)
Lightweight Diffusion Models for Resource-Constrained Semantic Communication
di: Pignata, Giovanni, et al.
Pubblicazione: (2024)
di: Pignata, Giovanni, et al.
Pubblicazione: (2024)
Ship in Sight: Diffusion Models for Ship-Image Super Resolution
di: Sigillo, Luigi, et al.
Pubblicazione: (2024)
di: Sigillo, Luigi, et al.
Pubblicazione: (2024)
Latent Wavelet Diffusion For Ultra-High-Resolution Image Synthesis
di: Sigillo, Luigi, et al.
Pubblicazione: (2025)
di: Sigillo, Luigi, et al.
Pubblicazione: (2025)
Narrowing Class-Wise Robustness Gaps in Adversarial Training
di: Amerehi, Fatemeh, et al.
Pubblicazione: (2025)
di: Amerehi, Fatemeh, et al.
Pubblicazione: (2025)
Toward Modality Gap: Vision Prototype Learning for Weakly-supervised Semantic Segmentation with CLIP
di: Xu, Zhongxing, et al.
Pubblicazione: (2024)
di: Xu, Zhongxing, et al.
Pubblicazione: (2024)
Closing the Modality Gap for Mixed Modality Search
di: Li, Binxu, et al.
Pubblicazione: (2025)
di: Li, Binxu, et al.
Pubblicazione: (2025)
Mind the Gap: Preserving and Compensating for the Modality Gap in CLIP-Based Continual Learning
di: Huang, Linlan, et al.
Pubblicazione: (2025)
di: Huang, Linlan, et al.
Pubblicazione: (2025)
Fill the Gap: Quantifying and Reducing the Modality Gap in Image-Text Representation Learning
di: Role, François, et al.
Pubblicazione: (2025)
di: Role, François, et al.
Pubblicazione: (2025)
Mind the Gap: Learning Modality-Agnostic Representations with a Cross-Modality UNet
di: Niu, Xin, et al.
Pubblicazione: (2026)
di: Niu, Xin, et al.
Pubblicazione: (2026)
Closing the Alignment-Maturity Gap in Federated Prototype Learning
di: Casado-Diez, Mario, et al.
Pubblicazione: (2026)
di: Casado-Diez, Mario, et al.
Pubblicazione: (2026)
Multimodal Unsupervised Domain Generalization by Retrieving Across the Modality Gap
di: Liao, Christopher, et al.
Pubblicazione: (2024)
di: Liao, Christopher, et al.
Pubblicazione: (2024)
Bridge the Modality and Capability Gaps in Vision-Language Model Selection
di: Yi, Chao, et al.
Pubblicazione: (2024)
di: Yi, Chao, et al.
Pubblicazione: (2024)
Closing the Oracle Gap: Increment Vector Transformation for Class Incremental Learning
di: Qiu, Zihuan, et al.
Pubblicazione: (2025)
di: Qiu, Zihuan, et al.
Pubblicazione: (2025)
GO4Align: Group Optimization for Multi-Task Alignment
di: Shen, Jiayi, et al.
Pubblicazione: (2024)
di: Shen, Jiayi, et al.
Pubblicazione: (2024)
SOOD-ImageNet: a Large-Scale Dataset for Semantic Out-Of-Distribution Image Classification and Semantic Segmentation
di: Bacchin, Alberto, et al.
Pubblicazione: (2024)
di: Bacchin, Alberto, et al.
Pubblicazione: (2024)
Is the Modality Gap a Bug or a Feature? A Robustness Perspective
di: Chowers, Rhea, et al.
Pubblicazione: (2026)
di: Chowers, Rhea, et al.
Pubblicazione: (2026)
Closing the Approximation Gap of Partial AUC Optimization: A Tale of Two Formulations
di: Jiang, Yangbangyan, et al.
Pubblicazione: (2025)
di: Jiang, Yangbangyan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Closing the gap in multimodal medical representation alignment
di: Grassucci, Eleonora, et al.
Pubblicazione: (2026) -
A TRIANGLE Enables Multimodal Alignment Beyond Cosine Similarity
di: Cicchetti, Giordano, et al.
Pubblicazione: (2025) -
FoleyGRAM: Video-to-Audio Generation with GRAM-Aligned Multimodal Encoders
di: Gramaccioni, Riccardo Fosco, et al.
Pubblicazione: (2025) -
Gramian Multimodal Representation Learning and Alignment
di: Cicchetti, Giordano, et al.
Pubblicazione: (2024) -
Semantic Compression via Multimodal Representation Learning
di: Grassucci, Eleonora, et al.
Pubblicazione: (2025)