Salvato in:
| Autori principali: | Liu, Ziyuan, Zhang, Jiawei, Wang, Wenyu, Gu, Yuantao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2503.19406 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
JL1-CD: A New Benchmark for Remote Sensing Change Detection and a Robust Multi-Teacher Knowledge Distillation Framework
di: Liu, Ziyuan, et al.
Pubblicazione: (2025)
di: Liu, Ziyuan, et al.
Pubblicazione: (2025)
Can MLLMs Reason in Multimodality? EMMA: An Enhanced MultiModal ReAsoning Benchmark
di: Hao, Yunzhuo, et al.
Pubblicazione: (2025)
di: Hao, Yunzhuo, et al.
Pubblicazione: (2025)
Open-CD: A Comprehensive Toolbox for Change Detection
di: Li, Kaiyu, et al.
Pubblicazione: (2024)
di: Li, Kaiyu, et al.
Pubblicazione: (2024)
UniRoute: Unified Routing Mixture-of-Experts for Modality-Adaptive Remote Sensing Change Detection
di: Shu, Qingling, et al.
Pubblicazione: (2026)
di: Shu, Qingling, et al.
Pubblicazione: (2026)
TeamPath: Building MultiModal Pathology Experts with Reasoning AI Copilots
di: Liu, Tianyu, et al.
Pubblicazione: (2025)
di: Liu, Tianyu, et al.
Pubblicazione: (2025)
M3: 3D-Spatial MultiModal Memory
di: Zou, Xueyan, et al.
Pubblicazione: (2025)
di: Zou, Xueyan, et al.
Pubblicazione: (2025)
Improving Diffusion-based Inverse Algorithms under Few-Step Constraint via Learnable Linear Extrapolation
di: Zhang, Jiawei, et al.
Pubblicazione: (2025)
di: Zhang, Jiawei, et al.
Pubblicazione: (2025)
Re-M3Dr: Rebalanced MultiModal Mean Deviation Regression
di: Yin, Haojie, et al.
Pubblicazione: (2026)
di: Yin, Haojie, et al.
Pubblicazione: (2026)
MultiModal Action Conditioned Video Generation
di: Li, Yichen, et al.
Pubblicazione: (2025)
di: Li, Yichen, et al.
Pubblicazione: (2025)
MultiModal Fine-tuning with Synthetic Captions
di: Enomoto, Shohei, et al.
Pubblicazione: (2026)
di: Enomoto, Shohei, et al.
Pubblicazione: (2026)
Sparse-Dense Mixture of Experts Adapter for Multi-Modal Tracking
di: Zhu, Yabin, et al.
Pubblicazione: (2026)
di: Zhu, Yabin, et al.
Pubblicazione: (2026)
ProM3E: Probabilistic Masked MultiModal Embedding Model for Ecology
di: Sastry, Srikumar, et al.
Pubblicazione: (2025)
di: Sastry, Srikumar, et al.
Pubblicazione: (2025)
CapS-Adapter: Caption-based MultiModal Adapter in Zero-Shot Classification
di: Wang, Qijie, et al.
Pubblicazione: (2024)
di: Wang, Qijie, et al.
Pubblicazione: (2024)
M3FAS: An Accurate and Robust MultiModal Mobile Face Anti-Spoofing System
di: Kong, Chenqi, et al.
Pubblicazione: (2023)
di: Kong, Chenqi, et al.
Pubblicazione: (2023)
MMA-Diffusion: MultiModal Attack on Diffusion Models
di: Yang, Yijun, et al.
Pubblicazione: (2023)
di: Yang, Yijun, et al.
Pubblicazione: (2023)
Multi-Expert Learning Framework with the State Space Model for Optical and SAR Image Registration
di: Wang, Wei, et al.
Pubblicazione: (2025)
di: Wang, Wei, et al.
Pubblicazione: (2025)
ControlEdit: A MultiModal Local Clothing Image Editing Method
di: Cheng, Di, et al.
Pubblicazione: (2024)
di: Cheng, Di, et al.
Pubblicazione: (2024)
Visual-Oriented Fine-Grained Knowledge Editing for MultiModal Large Language Models
di: Zeng, Zhen, et al.
Pubblicazione: (2024)
di: Zeng, Zhen, et al.
Pubblicazione: (2024)
M$^4$-SAM: Multi-Modal Mixture-of-Experts with Memory-Augmented SAM for RGB-D Video Salient Object Detection
di: Liu, Jiyuan, et al.
Pubblicazione: (2026)
di: Liu, Jiyuan, et al.
Pubblicazione: (2026)
SARES-DEIM: Sparse Mixture-of-Experts Meets DETR for Robust SAR Ship Detection
di: Song, Fenghao, et al.
Pubblicazione: (2026)
di: Song, Fenghao, et al.
Pubblicazione: (2026)
M3R: Localized Rainfall Nowcasting with Meteorology-Informed MultiModal Attention
di: Panta, Sanjeev, et al.
Pubblicazione: (2026)
di: Panta, Sanjeev, et al.
Pubblicazione: (2026)
HAMMR: HierArchical MultiModal React agents for generic VQA
di: Castrejon, Lluis, et al.
Pubblicazione: (2024)
di: Castrejon, Lluis, et al.
Pubblicazione: (2024)
MMRPT: MultiModal Reinforcement Pre-Training via Masked Vision-Dependent Reasoning
di: Zheng, Xuhui, et al.
Pubblicazione: (2025)
di: Zheng, Xuhui, et al.
Pubblicazione: (2025)
Mixture of Scale Experts for Alignment-free RGBT Video Object Detection and A Unified Benchmark
di: Wang, Qishun, et al.
Pubblicazione: (2024)
di: Wang, Qishun, et al.
Pubblicazione: (2024)
MOS: Mitigating Optical-SAR Modality Gap for Cross-Modal Ship Re-Identification
di: Zhao, Yujian, et al.
Pubblicazione: (2025)
di: Zhao, Yujian, et al.
Pubblicazione: (2025)
MMCORE: MultiModal COnnection with Representation Aligned Latent Embeddings
di: Li, Zijie, et al.
Pubblicazione: (2026)
di: Li, Zijie, et al.
Pubblicazione: (2026)
LongHalQA: Long-Context Hallucination Evaluation for MultiModal Large Language Models
di: Qiu, Han, et al.
Pubblicazione: (2024)
di: Qiu, Han, et al.
Pubblicazione: (2024)
Prior-guided Fusion of Multimodal Features for Change Detection from Optical-SAR Images
di: Liu, Xuanguang, et al.
Pubblicazione: (2026)
di: Liu, Xuanguang, et al.
Pubblicazione: (2026)
Not All Voxels Are Equal: Hardness-Aware Semantic Scene Completion with Self-Distillation
di: Wang, Song, et al.
Pubblicazione: (2024)
di: Wang, Song, et al.
Pubblicazione: (2024)
CharGen: High Accurate Character-Level Visual Text Generation Model with MultiModal Encoder
di: Ma, Lichen, et al.
Pubblicazione: (2024)
di: Ma, Lichen, et al.
Pubblicazione: (2024)
Omni-Customizer: End-to-End MultiModal Customization for Joint Audio-Video Generation
di: Chen, Yuheng, et al.
Pubblicazione: (2026)
di: Chen, Yuheng, et al.
Pubblicazione: (2026)
Mixture-of-Attack-Experts with Class Regularization for Unified Physical-Digital Face Attack Detection
di: Chen, Shunxin, et al.
Pubblicazione: (2025)
di: Chen, Shunxin, et al.
Pubblicazione: (2025)
DeMo: Decoupled Feature-Based Mixture of Experts for Multi-Modal Object Re-Identification
di: Wang, Yuhao, et al.
Pubblicazione: (2024)
di: Wang, Yuhao, et al.
Pubblicazione: (2024)
An Efficient Machine Learning Framework for Forest Height Estimation from Multi-Polarimetric Multi-Baseline SAR data
di: Razzano, Francesca, et al.
Pubblicazione: (2025)
di: Razzano, Francesca, et al.
Pubblicazione: (2025)
TERRA-CD: Multi-Temporal Framework for Multi-class and Semantic Change Detection
di: Oak, Omkar, et al.
Pubblicazione: (2026)
di: Oak, Omkar, et al.
Pubblicazione: (2026)
MMA-DFER: MultiModal Adaptation of unimodal models for Dynamic Facial Expression Recognition in-the-wild
di: Chumachenko, Kateryna, et al.
Pubblicazione: (2024)
di: Chumachenko, Kateryna, et al.
Pubblicazione: (2024)
Lightweight SAR Ship Detection via Contrastive Distillation
di: Devasundaram, Surendar, et al.
Pubblicazione: (2026)
di: Devasundaram, Surendar, et al.
Pubblicazione: (2026)
Towards Robust Optical-SAR Object Detection under Missing Modalities: A Dynamic Quality-Aware Fusion Framework
di: Zhao, Zhicheng, et al.
Pubblicazione: (2025)
di: Zhao, Zhicheng, et al.
Pubblicazione: (2025)
FlexiReID: Adaptive Mixture of Expert for Multi-Modal Person Re-Identification
di: Sun, Zhen, et al.
Pubblicazione: (2025)
di: Sun, Zhen, et al.
Pubblicazione: (2025)
m2mKD: Module-to-Module Knowledge Distillation for Modular Transformers
di: Lo, Ka Man, et al.
Pubblicazione: (2024)
di: Lo, Ka Man, et al.
Pubblicazione: (2024)
Documenti analoghi
-
JL1-CD: A New Benchmark for Remote Sensing Change Detection and a Robust Multi-Teacher Knowledge Distillation Framework
di: Liu, Ziyuan, et al.
Pubblicazione: (2025) -
Can MLLMs Reason in Multimodality? EMMA: An Enhanced MultiModal ReAsoning Benchmark
di: Hao, Yunzhuo, et al.
Pubblicazione: (2025) -
Open-CD: A Comprehensive Toolbox for Change Detection
di: Li, Kaiyu, et al.
Pubblicazione: (2024) -
UniRoute: Unified Routing Mixture-of-Experts for Modality-Adaptive Remote Sensing Change Detection
di: Shu, Qingling, et al.
Pubblicazione: (2026) -
TeamPath: Building MultiModal Pathology Experts with Reasoning AI Copilots
di: Liu, Tianyu, et al.
Pubblicazione: (2025)