CrossWeaver: Cross-modal Weaving for Arbitrary-Modality Semantic Segmentation
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhang, Zelin, Li, Kedi, Liang, Huiqi, Zhang, Tao, Xu, Chuanzhi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
EGFormer: Towards Efficient and Generalizable Multimodal Semantic Segmentation
di: Zhang, Zelin, et al.
Pubblicazione: (2025)
di: Zhang, Zelin, et al.
Pubblicazione: (2025)
ConceptWeaver: Weaving Disentangled Concepts with Flow
di: Chen, Jintao, et al.
Pubblicazione: (2026)
di: Chen, Jintao, et al.
Pubblicazione: (2026)
BindWeave: Subject-Consistent Video Generation via Cross-Modal Integration
di: Li, Zhaoyang, et al.
Pubblicazione: (2025)
di: Li, Zhaoyang, et al.
Pubblicazione: (2025)
CHARM: Collaborative Harmonization across Arbitrary Modalities for Modality-agnostic Semantic Segmentation
di: Wen, Lekang, et al.
Pubblicazione: (2025)
di: Wen, Lekang, et al.
Pubblicazione: (2025)
DriveXQA: Cross-modal Visual Question Answering for Adverse Driving Scene Understanding
di: Tao, Mingzhe, et al.
Pubblicazione: (2026)
di: Tao, Mingzhe, et al.
Pubblicazione: (2026)
StitchFusion: Weaving Any Visual Modalities to Enhance Multimodal Semantic Segmentation
di: Li, Bingyu, et al.
Pubblicazione: (2024)
di: Li, Bingyu, et al.
Pubblicazione: (2024)
FilmWeaver: Weaving Consistent Multi-Shot Videos with Cache-Guided Autoregressive Diffusion
di: Luo, Xiangyang, et al.
Pubblicazione: (2025)
di: Luo, Xiangyang, et al.
Pubblicazione: (2025)
ScaleWeaver: Weaving Efficient Controllable T2I Generation with Multi-Scale Reference Attention
di: Liu, Keli, et al.
Pubblicazione: (2025)
di: Liu, Keli, et al.
Pubblicazione: (2025)
Drive&Segment: Unsupervised Semantic Segmentation of Urban Scenes via Cross-modal Distillation
di: Vobecky, Antonin, et al.
Pubblicazione: (2022)
di: Vobecky, Antonin, et al.
Pubblicazione: (2022)
Local-to-Global Cross-Modal Attention-Aware Fusion for HSI-X Semantic Segmentation
di: Zhang, Xuming, et al.
Pubblicazione: (2024)
di: Zhang, Xuming, et al.
Pubblicazione: (2024)
Multi-modal Semantic Understanding with Contrastive Cross-modal Feature Alignment
di: Zhang, Ming, et al.
Pubblicazione: (2024)
di: Zhang, Ming, et al.
Pubblicazione: (2024)
Visual Foundation Models Boost Cross-Modal Unsupervised Domain Adaptation for 3D Semantic Segmentation
di: Xu, Jingyi, et al.
Pubblicazione: (2024)
di: Xu, Jingyi, et al.
Pubblicazione: (2024)
Fusion-then-Distillation: Toward Cross-modal Positive Distillation for Domain Adaptive 3D Semantic Segmentation
di: Wu, Yao, et al.
Pubblicazione: (2024)
di: Wu, Yao, et al.
Pubblicazione: (2024)
CoMiX: Cross-Modal Fusion with Deformable Convolutions for HSI-X Semantic Segmentation
di: Zhang, Xuming, et al.
Pubblicazione: (2024)
di: Zhang, Xuming, et al.
Pubblicazione: (2024)
MemorySAM: Memorize Modalities and Semantics with Segment Anything Model 2 for Multi-modal Semantic Segmentation
di: Liao, Chenfei, et al.
Pubblicazione: (2025)
di: Liao, Chenfei, et al.
Pubblicazione: (2025)
Rad-VLSM: A Cross-Modal Framework with Semantics-Assisted Prompting for Medical Segmentation and Diagnosis
di: Zhang, Fengyi, et al.
Pubblicazione: (2026)
di: Zhang, Fengyi, et al.
Pubblicazione: (2026)
MixReorg: Cross-Modal Mixed Patch Reorganization is a Good Mask Learner for Open-World Semantic Segmentation
di: Cai, Kaixin, et al.
Pubblicazione: (2023)
di: Cai, Kaixin, et al.
Pubblicazione: (2023)
Learnable Cross-modal Knowledge Distillation for Multi-modal Learning with Missing Modality
di: Wang, Hu, et al.
Pubblicazione: (2023)
di: Wang, Hu, et al.
Pubblicazione: (2023)
Memory-based Cross-modal Semantic Alignment Network for Radiology Report Generation
di: Tao, Yitian, et al.
Pubblicazione: (2024)
di: Tao, Yitian, et al.
Pubblicazione: (2024)
DA-Cal: Towards Cross-Domain Calibration in Semantic Segmentation
di: Li, Wangkai, et al.
Pubblicazione: (2026)
di: Li, Wangkai, et al.
Pubblicazione: (2026)
Unsupervised Modality Adaptation with Text-to-Image Diffusion Models for Semantic Segmentation
di: Xia, Ruihao, et al.
Pubblicazione: (2024)
di: Xia, Ruihao, et al.
Pubblicazione: (2024)
Semantics-enhanced Cross-modal Masked Image Modeling for Vision-Language Pre-training
di: Liu, Haowei, et al.
Pubblicazione: (2024)
di: Liu, Haowei, et al.
Pubblicazione: (2024)
Category-Adaptive Cross-Modal Semantic Refinement and Transfer for Open-Vocabulary Multi-Label Recognition
di: Liu, Haijing, et al.
Pubblicazione: (2024)
di: Liu, Haijing, et al.
Pubblicazione: (2024)
TUNI: Real-time RGB-T Semantic Segmentation with Unified Multi-Modal Feature Extraction and Cross-Modal Feature Fusion
di: Guo, Xiaodong, et al.
Pubblicazione: (2025)
di: Guo, Xiaodong, et al.
Pubblicazione: (2025)
Multi-modality Affinity Inference for Weakly Supervised 3D Semantic Segmentation
di: Li, Xiawei, et al.
Pubblicazione: (2023)
di: Li, Xiawei, et al.
Pubblicazione: (2023)
Revisiting Cross-Modal Knowledge Distillation: A Disentanglement Approach for RGBD Semantic Segmentation
di: Ferrod, Roger, et al.
Pubblicazione: (2025)
di: Ferrod, Roger, et al.
Pubblicazione: (2025)
Dynamic Adapter with Semantics Disentangling for Cross-lingual Cross-modal Retrieval
di: Cai, Rui, et al.
Pubblicazione: (2024)
di: Cai, Rui, et al.
Pubblicazione: (2024)
Multi-modal Generation via Cross-Modal In-Context Learning
di: Kumar, Amandeep, et al.
Pubblicazione: (2024)
di: Kumar, Amandeep, et al.
Pubblicazione: (2024)
CrossFlowDG: Bridging the Modality Gap with Cross-modal Flow Matching for Domain Generalization
di: Kritikos, Antonios, et al.
Pubblicazione: (2026)
di: Kritikos, Antonios, et al.
Pubblicazione: (2026)
Image Translation-Based Unsupervised Cross-Modality Domain Adaptation for Medical Image Segmentation
di: Yang, Tao, et al.
Pubblicazione: (2025)
di: Yang, Tao, et al.
Pubblicazione: (2025)
Explicit Temporal-Semantic Modeling for Dense Video Captioning via Context-Aware Cross-Modal Interaction
di: Jia, Mingda, et al.
Pubblicazione: (2025)
di: Jia, Mingda, et al.
Pubblicazione: (2025)
APSeg: Auto-Prompt Network for Cross-Domain Few-Shot Semantic Segmentation
di: He, Weizhao, et al.
Pubblicazione: (2024)
di: He, Weizhao, et al.
Pubblicazione: (2024)
Multi-Grained Cross-modal Alignment for Learning Open-vocabulary Semantic Segmentation from Text Supervision
di: Liu, Yajie, et al.
Pubblicazione: (2024)
di: Liu, Yajie, et al.
Pubblicazione: (2024)
Unsupervised Spike Depth Estimation via Cross-modality Cross-domain Knowledge Transfer
di: Liu, Jiaming, et al.
Pubblicazione: (2022)
di: Liu, Jiaming, et al.
Pubblicazione: (2022)
BrainAnytime: Anatomy-Aware Cross-Modal Pretraining for Brain Image Analysis with Arbitrary Modality Availability
di: Yang, Guangqian, et al.
Pubblicazione: (2026)
di: Yang, Guangqian, et al.
Pubblicazione: (2026)
CM-MaskSD: Cross-Modality Masked Self-Distillation for Referring Image Segmentation
di: Wang, Wenxuan, et al.
Pubblicazione: (2023)
di: Wang, Wenxuan, et al.
Pubblicazione: (2023)
Asymmetric Cross-Modal Knowledge Distillation: Bridging Modalities with Weak Semantic Consistency
di: Wei, Riling, et al.
Pubblicazione: (2025)
di: Wei, Riling, et al.
Pubblicazione: (2025)
Progressive Prompt-Guided Cross-Modal Reasoning for Referring Image Segmentation
di: Li, Jiachen, et al.
Pubblicazione: (2026)
di: Li, Jiachen, et al.
Pubblicazione: (2026)
Parameter Efficient Fine-tuning via Cross Block Orchestration for Segment Anything Model
di: Peng, Zelin, et al.
Pubblicazione: (2023)
di: Peng, Zelin, et al.
Pubblicazione: (2023)
SCASeg: Strip Cross-Attention for Efficient Semantic Segmentation
di: Xu, Guoan, et al.
Pubblicazione: (2024)
di: Xu, Guoan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
EGFormer: Towards Efficient and Generalizable Multimodal Semantic Segmentation
di: Zhang, Zelin, et al.
Pubblicazione: (2025) -
ConceptWeaver: Weaving Disentangled Concepts with Flow
di: Chen, Jintao, et al.
Pubblicazione: (2026) -
BindWeave: Subject-Consistent Video Generation via Cross-Modal Integration
di: Li, Zhaoyang, et al.
Pubblicazione: (2025) -
CHARM: Collaborative Harmonization across Arbitrary Modalities for Modality-agnostic Semantic Segmentation
di: Wen, Lekang, et al.
Pubblicazione: (2025) -
DriveXQA: Cross-modal Visual Question Answering for Adverse Driving Scene Understanding
di: Tao, Mingzhe, et al.
Pubblicazione: (2026)