Semantic Compression via Multimodal Representation Learning
Fuente:
arXiv
Saved in:
| Main Authors: | Grassucci, Eleonora, Cicchetti, Giordano, Uncini, Aurelio, Comminiello, Danilo |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Closing the Modality Gap Aligns Group-Wise Semantics
by: Grassucci, Eleonora, et al.
Published: (2026)
by: Grassucci, Eleonora, et al.
Published: (2026)
Training-Free Multimodal Guidance for Video to Audio Generation
by: Grassucci, Eleonora, et al.
Published: (2025)
by: Grassucci, Eleonora, et al.
Published: (2025)
Gramian Multimodal Representation Learning and Alignment
by: Cicchetti, Giordano, et al.
Published: (2024)
by: Cicchetti, Giordano, et al.
Published: (2024)
A TRIANGLE Enables Multimodal Alignment Beyond Cosine Similarity
by: Cicchetti, Giordano, et al.
Published: (2025)
by: Cicchetti, Giordano, et al.
Published: (2025)
Closing the gap in multimodal medical representation alignment
by: Grassucci, Eleonora, et al.
Published: (2026)
by: Grassucci, Eleonora, et al.
Published: (2026)
FoleyGRAM: Video-to-Audio Generation with GRAM-Aligned Multimodal Encoders
by: Gramaccioni, Riccardo Fosco, et al.
Published: (2025)
by: Gramaccioni, Riccardo Fosco, et al.
Published: (2025)
Generalizing Medical Image Representations via Quaternion Wavelet Networks
by: Sigillo, Luigi, et al.
Published: (2023)
by: Sigillo, Luigi, et al.
Published: (2023)
Demystifying the Hypercomplex: Inductive Biases in Hypercomplex Deep Learning
by: Comminiello, Danilo, et al.
Published: (2024)
by: Comminiello, Danilo, et al.
Published: (2024)
PHemoNet: A Multimodal Network for Physiological Signals
by: Lopez, Eleonora, et al.
Published: (2024)
by: Lopez, Eleonora, et al.
Published: (2024)
Hierarchical Hypercomplex Network for Multimodal Emotion Recognition
by: Lopez, Eleonora, et al.
Published: (2024)
by: Lopez, Eleonora, et al.
Published: (2024)
Training-Free Multi-User Generative Semantic Communications via Null-Space Diffusion Sampling
by: Grassucci, Eleonora, et al.
Published: (2024)
by: Grassucci, Eleonora, et al.
Published: (2024)
Beyond Answers: How LLMs Can Pursue Strategic Thinking in Education
by: Grassucci, Eleonora, et al.
Published: (2025)
by: Grassucci, Eleonora, et al.
Published: (2025)
Lightweight Diffusion Models for Resource-Constrained Semantic Communication
by: Pignata, Giovanni, et al.
Published: (2024)
by: Pignata, Giovanni, et al.
Published: (2024)
Multi-View Hypercomplex Learning for Breast Cancer Screening
by: Lopez, Eleonora, et al.
Published: (2022)
by: Lopez, Eleonora, et al.
Published: (2022)
Language-Oriented Semantic Latent Representation for Image Transmission
by: Cicchetti, Giordano, et al.
Published: (2024)
by: Cicchetti, Giordano, et al.
Published: (2024)
Quaternion Wavelet-Conditioned Diffusion Models for Image Super-Resolution
by: Sigillo, Luigi, et al.
Published: (2025)
by: Sigillo, Luigi, et al.
Published: (2025)
Effective Blind Source Separation Based on the Adam Algorithm
by: Scarpiniti, Michele, et al.
Published: (2016)
by: Scarpiniti, Michele, et al.
Published: (2016)
Generative AI Meets Semantic Communication: Evolution and Revolution of Communication Tasks
by: Grassucci, Eleonora, et al.
Published: (2024)
by: Grassucci, Eleonora, et al.
Published: (2024)
NAF-DPM: A Nonlinear Activation-Free Diffusion Probabilistic Model for Document Enhancement
by: Cicchetti, Giordano, et al.
Published: (2024)
by: Cicchetti, Giordano, et al.
Published: (2024)
Generative Semantic Communication: Diffusion Models Beyond Bit Recovery
by: Grassucci, Eleonora, et al.
Published: (2023)
by: Grassucci, Eleonora, et al.
Published: (2023)
Overview of the L3DAS23 Challenge on Audio-Visual Extended Reality
by: Marinoni, Christian, et al.
Published: (2024)
by: Marinoni, Christian, et al.
Published: (2024)
Generative Models for Helmholtz Equation Solutions: A Dataset of Acoustic Materials
by: Gramaccioni, Riccardo Fosco, et al.
Published: (2025)
by: Gramaccioni, Riccardo Fosco, et al.
Published: (2025)
A New Class of Efficient Adaptive Filters for Online Nonlinear Modeling
by: Comminiello, Danilo, et al.
Published: (2021)
by: Comminiello, Danilo, et al.
Published: (2021)
Semantic Communication Challenges: Understanding Dos and Avoiding Don'ts
by: Choi, Jinho, et al.
Published: (2024)
by: Choi, Jinho, et al.
Published: (2024)
TACE: Tumor-Aware Counterfactual Explanations
by: Rossi, Eleonora Beatrice, et al.
Published: (2024)
by: Rossi, Eleonora Beatrice, et al.
Published: (2024)
Towards Explaining Hypercomplex Neural Networks
by: Lopez, Eleonora, et al.
Published: (2024)
by: Lopez, Eleonora, et al.
Published: (2024)
The IJCNN 2025 Review Process
by: Scarpiniti, Michele, et al.
Published: (2026)
by: Scarpiniti, Michele, et al.
Published: (2026)
A Wavelet Diffusion GAN for Image Super-Resolution
by: Aloisi, Lorenzo, et al.
Published: (2024)
by: Aloisi, Lorenzo, et al.
Published: (2024)
Attention-Map Augmentation for Hypercomplex Breast Cancer Classification
by: Lopez, Eleonora, et al.
Published: (2023)
by: Lopez, Eleonora, et al.
Published: (2023)
Controllable Audio-Visual Viewpoint Generation from 360° Spatial Information
by: Marinoni, Christian, et al.
Published: (2025)
by: Marinoni, Christian, et al.
Published: (2025)
Guess What I Think: Streamlined EEG-to-Image Generation with Latent Diffusion Models
by: Lopez, Eleonora, et al.
Published: (2024)
by: Lopez, Eleonora, et al.
Published: (2024)
Concrete Dense Network for Long-Sequence Time Series Clustering
by: Taloma, Redemptor Jr Laceda, et al.
Published: (2024)
by: Taloma, Redemptor Jr Laceda, et al.
Published: (2024)
Metadata, Wavelet, and Time Aware Diffusion Models for Satellite Image Super Resolution
by: Sigillo, Luigi, et al.
Published: (2025)
by: Sigillo, Luigi, et al.
Published: (2025)
Latent Wavelet Diffusion For Ultra-High-Resolution Image Synthesis
by: Sigillo, Luigi, et al.
Published: (2025)
by: Sigillo, Luigi, et al.
Published: (2025)
Multimodal Representation Learning Conditioned on Semantic Relations
by: Qiao, Yang, et al.
Published: (2025)
by: Qiao, Yang, et al.
Published: (2025)
Ship in Sight: Diffusion Models for Ship-Image Super Resolution
by: Sigillo, Luigi, et al.
Published: (2024)
by: Sigillo, Luigi, et al.
Published: (2024)
Semantically Guided Representation Learning For Action Anticipation
by: Diko, Anxhelo, et al.
Published: (2024)
by: Diko, Anxhelo, et al.
Published: (2024)
Disentangling Uncertainties by Learning Compressed Data Representation
by: An, Zhiyu, et al.
Published: (2025)
by: An, Zhiyu, et al.
Published: (2025)
FolAI: Synchronized Foley Sound Generation with Semantic and Temporal Alignment
by: Gramaccioni, Riccardo Fosco, et al.
Published: (2024)
by: Gramaccioni, Riccardo Fosco, et al.
Published: (2024)
Amplifying Prominent Representations in Multimodal Learning via Variational Dirichlet Process
by: Chan, Tsai Hor, et al.
Published: (2025)
by: Chan, Tsai Hor, et al.
Published: (2025)
Similar Items
-
Closing the Modality Gap Aligns Group-Wise Semantics
by: Grassucci, Eleonora, et al.
Published: (2026) -
Training-Free Multimodal Guidance for Video to Audio Generation
by: Grassucci, Eleonora, et al.
Published: (2025) -
Gramian Multimodal Representation Learning and Alignment
by: Cicchetti, Giordano, et al.
Published: (2024) -
A TRIANGLE Enables Multimodal Alignment Beyond Cosine Similarity
by: Cicchetti, Giordano, et al.
Published: (2025) -
Closing the gap in multimodal medical representation alignment
by: Grassucci, Eleonora, et al.
Published: (2026)