Le MuMo JEPA: Multi-Modal Self-Supervised Representation Learning with Learnable Fusion Tokens
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Cornelissen, Ciem, Leroux, Sam, Simoens, Pieter |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Adaptive Clustering for Efficient Phenotype Segmentation of UAV Hyperspectral Data
par: Cornelissen, Ciem, et autres
Publié: (2025)
par: Cornelissen, Ciem, et autres
Publié: (2025)
In-Field Mapping of Grape Yield and Quality with Illumination-Invariant Deep Learning
par: Cornelissen, Ciem, et autres
Publié: (2025)
par: Cornelissen, Ciem, et autres
Publié: (2025)
Mitigating Bias Using Model-Agnostic Data Attribution
par: De Coninck, Sander, et autres
Publié: (2024)
par: De Coninck, Sander, et autres
Publié: (2024)
Efficient On-Board Processing of Oblique UAV Video for Rapid Flood Extent Mapping
par: Sharma, Vishisht, et autres
Publié: (2026)
par: Sharma, Vishisht, et autres
Publié: (2026)
Discrete JEPA: Learning Discrete Token Representations without Reconstruction
par: Baek, Junyeob, et autres
Publié: (2025)
par: Baek, Junyeob, et autres
Publié: (2025)
Enabling Privacy-Aware AI-Based Ergonomic Analysis
par: De Coninck, Sander, et autres
Publié: (2025)
par: De Coninck, Sander, et autres
Publié: (2025)
LeJEPA: Provable and Scalable Self-Supervised Learning Without the Heuristics
par: Balestriero, Randall, et autres
Publié: (2025)
par: Balestriero, Randall, et autres
Publié: (2025)
3D-JEPA: A Joint Embedding Predictive Architecture for 3D Self-Supervised Representation Learning
par: Hu, Naiwen, et autres
Publié: (2024)
par: Hu, Naiwen, et autres
Publié: (2024)
Privacy-Preserving Computer Vision for Industry: Three Case Studies in Human-Centric Manufacturing
par: De Coninck, Sander, et autres
Publié: (2025)
par: De Coninck, Sander, et autres
Publié: (2025)
Event-based Facial Keypoint Alignment via Cross-Modal Fusion Attention and Self-Supervised Multi-Event Representation Learning
par: Kang, Donghwa, et autres
Publié: (2025)
par: Kang, Donghwa, et autres
Publié: (2025)
KerJEPA: Kernel Discrepancies for Euclidean Self-Supervised Learning
par: Zimmermann, Eric, et autres
Publié: (2025)
par: Zimmermann, Eric, et autres
Publié: (2025)
V-JEPA 2.1: Unlocking Dense Features in Video Self-Supervised Learning
par: Mur-Labadia, Lorenzo, et autres
Publié: (2026)
par: Mur-Labadia, Lorenzo, et autres
Publié: (2026)
Point-JEPA: A Joint Embedding Predictive Architecture for Self-Supervised Learning on Point Cloud
par: Saito, Ayumu, et autres
Publié: (2024)
par: Saito, Ayumu, et autres
Publié: (2024)
HQ-JEPA: Hybrid Quantum Joint-Embedding Predictive Architecture for Cross-Modal Remote Sensing Representation Learning
par: Hossain, Md Aminur, et autres
Publié: (2026)
par: Hossain, Md Aminur, et autres
Publié: (2026)
OmniSat: Self-Supervised Modality Fusion for Earth Observation
par: Astruc, Guillaume, et autres
Publié: (2024)
par: Astruc, Guillaume, et autres
Publié: (2024)
Mine-JEPA: In-Domain Self-Supervised Learning for Mine-Like Object Classification in Side-Scan Sonar
par: Kwon, Taeyoun, et autres
Publié: (2026)
par: Kwon, Taeyoun, et autres
Publié: (2026)
Gaussian-Constrained LeJEPA Representations for Unsupervised Scene Discovery and Pose Consistency
par: Mostafa, Mohsen
Publié: (2026)
par: Mostafa, Mohsen
Publié: (2026)
MIRROR: Multi-Modal Pathological Self-Supervised Representation Learning via Modality Alignment and Retention
par: Wang, Tianyi, et autres
Publié: (2025)
par: Wang, Tianyi, et autres
Publié: (2025)
Multi-Task Multi-Modal Self-Supervised Learning for Facial Expression Recognition
par: Halawa, Marah, et autres
Publié: (2024)
par: Halawa, Marah, et autres
Publié: (2024)
CroMo-Mixup: Augmenting Cross-Model Representations for Continual Self-Supervised Learning
par: Mushtaq, Erum, et autres
Publié: (2024)
par: Mushtaq, Erum, et autres
Publié: (2024)
Learnable Expansion of Graph Operators for Multi-Modal Feature Fusion
par: Ding, Dexuan, et autres
Publié: (2024)
par: Ding, Dexuan, et autres
Publié: (2024)
MatFusion: A Generative Diffusion Model for SVBRDF Capture
par: Sartor, Sam, et autres
Publié: (2024)
par: Sartor, Sam, et autres
Publié: (2024)
Self-Supervised JEPA-based World Models for LiDAR Occupancy Completion and Forecasting
par: Zhu, Haoran, et autres
Publié: (2026)
par: Zhu, Haoran, et autres
Publié: (2026)
Modality-Specific Enhancement and Complementary Fusion for Semi-Supervised Multi-Modal Brain Tumor Segmentation
par: Chung, Tien-Dat, et autres
Publié: (2025)
par: Chung, Tien-Dat, et autres
Publié: (2025)
CrossJEPA: Cross-Modal Joint-Embedding Predictive Architecture for Efficient 3D Representation Learning from 2D Images
par: Perera, Avishka, et autres
Publié: (2025)
par: Perera, Avishka, et autres
Publié: (2025)
CNN-JEPA: Self-Supervised Pretraining Convolutional Neural Networks Using Joint Embedding Predictive Architecture
par: Kalapos, András, et autres
Publié: (2024)
par: Kalapos, András, et autres
Publié: (2024)
LeMeViT: Efficient Vision Transformer with Learnable Meta Tokens for Remote Sensing Image Interpretation
par: Jiang, Wentao, et autres
Publié: (2024)
par: Jiang, Wentao, et autres
Publié: (2024)
On the Discriminability of Self-Supervised Representation Learning
par: Song, Zeen, et autres
Publié: (2024)
par: Song, Zeen, et autres
Publié: (2024)
Modality-Guided Dynamic Graph Fusion and Temporal Diffusion for Self-Supervised RGB-T Tracking
par: Li, Shenglan, et autres
Publié: (2025)
par: Li, Shenglan, et autres
Publié: (2025)
CR-JEPA: Cross-Modal Joint-Embedding Predictive Learning for Remote Sensing Image Retrieval
par: Hossain, Md Aminur, et autres
Publié: (2026)
par: Hossain, Md Aminur, et autres
Publié: (2026)
Decoupling Multi-Contrast Super-Resolution: Self-Supervised Implicit Re-Representation for Unpaired Cross-Modal Synthesis
par: Wu, Yinzhe, et autres
Publié: (2025)
par: Wu, Yinzhe, et autres
Publié: (2025)
Multi-Modal Representation Learning via Semi-Supervised Rate Reduction for Generalized Category Discovery
par: He, Wei, et autres
Publié: (2026)
par: He, Wei, et autres
Publié: (2026)
Self-Supervised Flow Matching for Scalable Multi-Modal Synthesis
par: Chefer, Hila, et autres
Publié: (2026)
par: Chefer, Hila, et autres
Publié: (2026)
JEPA-T: Joint-Embedding Predictive Architecture with Text Fusion for Image Generation
par: Wan, Siheng, et autres
Publié: (2025)
par: Wan, Siheng, et autres
Publié: (2025)
Self-Supervised Scene Flow Estimation with Point-Voxel Fusion and Surface Representation
par: Xiang, Xuezhi, et autres
Publié: (2024)
par: Xiang, Xuezhi, et autres
Publié: (2024)
Text-Conditional JEPA for Learning Semantically Rich Visual Representations
par: Huang, Chen, et autres
Publié: (2026)
par: Huang, Chen, et autres
Publié: (2026)
Self-Supervised Generative-Contrastive Learning of Multi-Modal Euclidean Input for 3D Shape Latent Representations: A Dynamic Switching Approach
par: Wu, Chengzhi, et autres
Publié: (2023)
par: Wu, Chengzhi, et autres
Publié: (2023)
Self-Supervised Learning of Plant Image Representations
par: Moummad, Ilyass, et autres
Publié: (2026)
par: Moummad, Ilyass, et autres
Publié: (2026)
MaskFuser: Masked Fusion of Joint Multi-Modal Tokenization for End-to-End Autonomous Driving
par: Duan, Yiqun, et autres
Publié: (2024)
par: Duan, Yiqun, et autres
Publié: (2024)
Task-driven Image Fusion with Learnable Fusion Loss
par: Bai, Haowen, et autres
Publié: (2024)
par: Bai, Haowen, et autres
Publié: (2024)
Documents similaires
-
Adaptive Clustering for Efficient Phenotype Segmentation of UAV Hyperspectral Data
par: Cornelissen, Ciem, et autres
Publié: (2025) -
In-Field Mapping of Grape Yield and Quality with Illumination-Invariant Deep Learning
par: Cornelissen, Ciem, et autres
Publié: (2025) -
Mitigating Bias Using Model-Agnostic Data Attribution
par: De Coninck, Sander, et autres
Publié: (2024) -
Efficient On-Board Processing of Oblique UAV Video for Rapid Flood Extent Mapping
par: Sharma, Vishisht, et autres
Publié: (2026) -
Discrete JEPA: Learning Discrete Token Representations without Reconstruction
par: Baek, Junyeob, et autres
Publié: (2025)