Cross-Modal-Domain Generalization Through Semantically Aligned Discrete Representations
Fuente:
arXiv
Salvato in:
| Autori principali: | Sen, Souptik, Younis, Raneen, Ahmadi, Zahra |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Learning from the Right Patches: A Two-Stage Wavelet-Driven Masked Autoencoder for Histopathology Representation Learning
di: Younis, Raneen, et al.
Pubblicazione: (2025)
di: Younis, Raneen, et al.
Pubblicazione: (2025)
Cross-Modal Binary Attention: An Energy-Efficient Fusion Framework for Audio-Visual Learning
di: Saleh, Mohamed, et al.
Pubblicazione: (2026)
di: Saleh, Mohamed, et al.
Pubblicazione: (2026)
DecAlign: Hierarchical Cross-Modal Alignment for Decoupled Multimodal Representation Learning
di: Qian, Chengxuan, et al.
Pubblicazione: (2025)
di: Qian, Chengxuan, et al.
Pubblicazione: (2025)
AlignGen: Boosting Personalized Image Generation with Cross-Modality Prior Alignment
di: Lin, Yiheng, et al.
Pubblicazione: (2025)
di: Lin, Yiheng, et al.
Pubblicazione: (2025)
SemGrasp: Semantic Grasp Generation via Language Aligned Discretization
di: Li, Kailin, et al.
Pubblicazione: (2024)
di: Li, Kailin, et al.
Pubblicazione: (2024)
Open-set Cross Modal Generalization via Multimodal Unified Representation
di: Huang, Hai, et al.
Pubblicazione: (2025)
di: Huang, Hai, et al.
Pubblicazione: (2025)
CrossFlowDG: Bridging the Modality Gap with Cross-modal Flow Matching for Domain Generalization
di: Kritikos, Antonios, et al.
Pubblicazione: (2026)
di: Kritikos, Antonios, et al.
Pubblicazione: (2026)
Learning Modality-agnostic Representation for Semantic Segmentation from Any Modalities
di: Zheng, Xu, et al.
Pubblicazione: (2024)
di: Zheng, Xu, et al.
Pubblicazione: (2024)
Visual Foundation Models Boost Cross-Modal Unsupervised Domain Adaptation for 3D Semantic Segmentation
di: Xu, Jingyi, et al.
Pubblicazione: (2024)
di: Xu, Jingyi, et al.
Pubblicazione: (2024)
AdaptDiff: Cross-Modality Domain Adaptation via Weak Conditional Semantic Diffusion for Retinal Vessel Segmentation
di: Hu, Dewei, et al.
Pubblicazione: (2024)
di: Hu, Dewei, et al.
Pubblicazione: (2024)
CrossWeaver: Cross-modal Weaving for Arbitrary-Modality Semantic Segmentation
di: Zhang, Zelin, et al.
Pubblicazione: (2026)
di: Zhang, Zelin, et al.
Pubblicazione: (2026)
Closing the Modality Gap Aligns Group-Wise Semantics
di: Grassucci, Eleonora, et al.
Pubblicazione: (2026)
di: Grassucci, Eleonora, et al.
Pubblicazione: (2026)
Asymmetric Cross-Modal Knowledge Distillation: Bridging Modalities with Weak Semantic Consistency
di: Wei, Riling, et al.
Pubblicazione: (2025)
di: Wei, Riling, et al.
Pubblicazione: (2025)
Enhancing Multimodal Unified Representations for Cross Modal Generalization
di: Huang, Hai, et al.
Pubblicazione: (2024)
di: Huang, Hai, et al.
Pubblicazione: (2024)
StructAlign: Structured Cross-Modal Alignment for Continual Text-to-Video Retrieval
di: Wang, Shaokun, et al.
Pubblicazione: (2026)
di: Wang, Shaokun, et al.
Pubblicazione: (2026)
Time2General: Learning Spatiotemporal Invariant Representations for Domain-Generalization Video Semantic Segmentation
di: Chen, Siyu, et al.
Pubblicazione: (2026)
di: Chen, Siyu, et al.
Pubblicazione: (2026)
Enhancing Multi-Modal Video Sentiment Classification Through Semi-Supervised Clustering
di: Saadatinia, Mehrshad, et al.
Pubblicazione: (2025)
di: Saadatinia, Mehrshad, et al.
Pubblicazione: (2025)
Cross-Domain Semantic Segmentation with Large Language Model-Assisted Descriptor Generation
di: Hughes, Philip, et al.
Pubblicazione: (2025)
di: Hughes, Philip, et al.
Pubblicazione: (2025)
Mix, Align, Distil: Reliable Cross-Domain Atypical Mitosis Classification
di: Atey, Kaustubh, et al.
Pubblicazione: (2025)
di: Atey, Kaustubh, et al.
Pubblicazione: (2025)
DynAlign: Unsupervised Dynamic Taxonomy Alignment for Cross-Domain Segmentation
di: Sun, Han, et al.
Pubblicazione: (2025)
di: Sun, Han, et al.
Pubblicazione: (2025)
AsymFormer: Asymmetrical Cross-Modal Representation Learning for Mobile Platform Real-Time RGB-D Semantic Segmentation
di: Du, Siqi, et al.
Pubblicazione: (2023)
di: Du, Siqi, et al.
Pubblicazione: (2023)
Continual Cross-Modal Generalization
di: Xia, Yan, et al.
Pubblicazione: (2025)
di: Xia, Yan, et al.
Pubblicazione: (2025)
Choosing Wisely and Learning Deeply: Selective Cross-Modality Distillation via CLIP for Domain Generalization
di: Leng, Jixuan, et al.
Pubblicazione: (2023)
di: Leng, Jixuan, et al.
Pubblicazione: (2023)
IntraStyler: Intra-Domain Style Synthesis for Cross-Modality MRI Domain Adaptation
di: Liu, Han, et al.
Pubblicazione: (2026)
di: Liu, Han, et al.
Pubblicazione: (2026)
Self-Enhanced Image Clustering with Cross-Modal Semantic Consistency
di: Li, Zihan, et al.
Pubblicazione: (2025)
di: Li, Zihan, et al.
Pubblicazione: (2025)
Dynamic Cross-Modal Alignment for Robust Semantic Location Prediction
di: Jing, Liu, et al.
Pubblicazione: (2024)
di: Jing, Liu, et al.
Pubblicazione: (2024)
Cross-Modal Scene Semantic Alignment for Image Complexity Assessment
di: Luo, Yuqing, et al.
Pubblicazione: (2025)
di: Luo, Yuqing, et al.
Pubblicazione: (2025)
Cross-Modal Self-Training: Aligning Images and Pointclouds to Learn Classification without Labels
di: Dharmasiri, Amaya, et al.
Pubblicazione: (2024)
di: Dharmasiri, Amaya, et al.
Pubblicazione: (2024)
Domain Generalization via Discrete Codebook Learning
di: Long, Shaocong, et al.
Pubblicazione: (2025)
di: Long, Shaocong, et al.
Pubblicazione: (2025)
Continual Road-Scene Semantic Segmentation via Feature-Aligned Symmetric Multi-Modal Network
di: Barbato, Francesco, et al.
Pubblicazione: (2023)
di: Barbato, Francesco, et al.
Pubblicazione: (2023)
Cross-view Domain Generalization via Geometric Consistency for LiDAR Semantic Segmentation
di: Zhao, Jindong, et al.
Pubblicazione: (2026)
di: Zhao, Jindong, et al.
Pubblicazione: (2026)
Semantic Residual for Multimodal Unified Discrete Representation
di: Huang, Hai, et al.
Pubblicazione: (2024)
di: Huang, Hai, et al.
Pubblicazione: (2024)
Depth-Sensitive Soft Suppression with RGB-D Inter-Modal Stylization Flow for Domain Generalization Semantic Segmentation
di: Wei, Binbin, et al.
Pubblicazione: (2025)
di: Wei, Binbin, et al.
Pubblicazione: (2025)
SPARC: Concept-Aligned Sparse Autoencoders for Cross-Model and Cross-Modal Interpretability
di: Nasiri-Sarvi, Ali, et al.
Pubblicazione: (2025)
di: Nasiri-Sarvi, Ali, et al.
Pubblicazione: (2025)
RefAlign: Representation Alignment for Reference-to-Video Generation
di: Wang, Lei, et al.
Pubblicazione: (2026)
di: Wang, Lei, et al.
Pubblicazione: (2026)
Anisotropic Modality Align
di: Yu, Xiaomin, et al.
Pubblicazione: (2026)
di: Yu, Xiaomin, et al.
Pubblicazione: (2026)
Investigating Permutation-Invariant Discrete Representation Learning for Spatially Aligned Images
di: Stirling, Jamie S. J., et al.
Pubblicazione: (2026)
di: Stirling, Jamie S. J., et al.
Pubblicazione: (2026)
Adaptive Domain Shift in Diffusion Models for Cross-Modality Image Translation
di: Wang, Zihao, et al.
Pubblicazione: (2026)
di: Wang, Zihao, et al.
Pubblicazione: (2026)
Towards Stable Cross-Domain Depression Recognition under Missing Modalities
di: Chen, Jiuyi, et al.
Pubblicazione: (2025)
di: Chen, Jiuyi, et al.
Pubblicazione: (2025)
Cubic Discrete Diffusion: Discrete Visual Generation on High-Dimensional Representation Tokens
di: Wang, Yuqing, et al.
Pubblicazione: (2026)
di: Wang, Yuqing, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Learning from the Right Patches: A Two-Stage Wavelet-Driven Masked Autoencoder for Histopathology Representation Learning
di: Younis, Raneen, et al.
Pubblicazione: (2025) -
Cross-Modal Binary Attention: An Energy-Efficient Fusion Framework for Audio-Visual Learning
di: Saleh, Mohamed, et al.
Pubblicazione: (2026) -
DecAlign: Hierarchical Cross-Modal Alignment for Decoupled Multimodal Representation Learning
di: Qian, Chengxuan, et al.
Pubblicazione: (2025) -
AlignGen: Boosting Personalized Image Generation with Cross-Modality Prior Alignment
di: Lin, Yiheng, et al.
Pubblicazione: (2025) -
SemGrasp: Semantic Grasp Generation via Language Aligned Discretization
di: Li, Kailin, et al.
Pubblicazione: (2024)