MMMamba: A Versatile Cross-Modal In Context Fusion Framework for Pan-Sharpening and Zero-Shot Image Enhancement
Fuente:
arXiv
Saved in:
| Main Authors: | Wang, Yingying, He, Xuanhua, Wu, Chen, Huang, Jialing, Zhang, Suiyun, Liu, Rui, Ding, Xinghao, Che, Haoxuan |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Frequency-Adaptive Pan-Sharpening with Mixture of Experts
by: He, Xuanhua, et al.
Published: (2024)
by: He, Xuanhua, et al.
Published: (2024)
Hybrid Fusion: One-Minute Efficient Training for Zero-Shot Cross-Domain Image Fusion
by: Zhang, Ran, et al.
Published: (2026)
by: Zhang, Ran, et al.
Published: (2026)
Self-supervised Multiplex Consensus Mamba for General Image Fusion
by: Wang, Yingying, et al.
Published: (2025)
by: Wang, Yingying, et al.
Published: (2025)
Multigrain-aware Semantic Prototype Scanning and Tri-Token Prompt Learning Embraced High-Order RWKV for Pan-Sharpening
by: Li, Junfeng, et al.
Published: (2026)
by: Li, Junfeng, et al.
Published: (2026)
A Representation Sharpening Framework for Zero Shot Dense Retrieval
by: Ashok, Dhananjay, et al.
Published: (2025)
by: Ashok, Dhananjay, et al.
Published: (2025)
PCMamba: Physics-Informed Cross-Modal State Space Model for Dual-Camera Compressive Hyperspectral Imaging
by: Meng, Ge, et al.
Published: (2025)
by: Meng, Ge, et al.
Published: (2025)
Cross-Scale Pansharpening via ScaleFormer and the PanScale Benchmark
by: Cao, Ke, et al.
Published: (2026)
by: Cao, Ke, et al.
Published: (2026)
Spectral Fidelity and Spatial Enhancement: An Assessment and Cascading of Pan-Sharpening Techniques for Satellite Imagery
by: B, Abdul Aziz A., et al.
Published: (2024)
by: B, Abdul Aziz A., et al.
Published: (2024)
GameGen-X: Interactive Open-world Game Video Generation
by: Che, Haoxuan, et al.
Published: (2024)
by: Che, Haoxuan, et al.
Published: (2024)
Understanding Pan-Sharpening via Generalized Inverse
by: Liu, Shiqi, et al.
Published: (2023)
by: Liu, Shiqi, et al.
Published: (2023)
Shuffle Mamba: State Space Models with Random Shuffle for Multi-Modal Image Fusion
by: Cao, Ke, et al.
Published: (2024)
by: Cao, Ke, et al.
Published: (2024)
CC-Pan: Channel-wise Compression based Diffusion for Efficient Pan-Sharpening
by: Li, Junjie, et al.
Published: (2026)
by: Li, Junjie, et al.
Published: (2026)
SETR: A Two-Stage Semantic-Enhanced Framework for Zero-Shot Composed Image Retrieval
by: Xiao, Yuqi, et al.
Published: (2025)
by: Xiao, Yuqi, et al.
Published: (2025)
Pan-LUT: Efficient Pan-sharpening via Learnable Look-Up Tables
by: Cai, Zhongnan, et al.
Published: (2025)
by: Cai, Zhongnan, et al.
Published: (2025)
SeamlessEdit: Background Noise Aware Zero-Shot Speech Editing with in-Context Enhancement
by: Chen, Kuan-Yu, et al.
Published: (2025)
by: Chen, Kuan-Yu, et al.
Published: (2025)
Pan-Mamba: Effective pan-sharpening with State Space Model
by: He, Xuanhua, et al.
Published: (2024)
by: He, Xuanhua, et al.
Published: (2024)
VisionDirector: Vision-Language Guided Closed-Loop Refinement for Generative Image Synthesis
by: Chu, Meng, et al.
Published: (2025)
by: Chu, Meng, et al.
Published: (2025)
Unsupervised Low-light Image Enhancement with Lookup Tables and Diffusion Priors
by: Lin, Yunlong, et al.
Published: (2024)
by: Lin, Yunlong, et al.
Published: (2024)
IGDNet: Zero-Shot Robust Underexposed Image Enhancement via Illumination-Guided and Denoising
by: Yan, Hailong, et al.
Published: (2025)
by: Yan, Hailong, et al.
Published: (2025)
Troika: Multi-Path Cross-Modal Traction for Compositional Zero-Shot Learning
by: Huang, Siteng, et al.
Published: (2023)
by: Huang, Siteng, et al.
Published: (2023)
InsEdit: Towards Instruction-based Visual Editing via Data-Efficient Video Diffusion Models Adaptation
by: Rao, Zhefan, et al.
Published: (2026)
by: Rao, Zhefan, et al.
Published: (2026)
EmergentBridge: Improving Zero-Shot Cross-Modal Transfer in Unified Multimodal Embedding Models
by: Xie, Jincheng, et al.
Published: (2026)
by: Xie, Jincheng, et al.
Published: (2026)
SalientFusion: Context-Aware Compositional Zero-Shot Food Recognition
by: Song, Jiajun, et al.
Published: (2025)
by: Song, Jiajun, et al.
Published: (2025)
ID-Animator: Zero-Shot Identity-Preserving Human Video Generation
by: He, Xuanhua, et al.
Published: (2024)
by: He, Xuanhua, et al.
Published: (2024)
Separated Inter/Intra-Modal Fusion Prompts for Compositional Zero-Shot Learning
by: Jung, Sua
Published: (2025)
by: Jung, Sua
Published: (2025)
Bidirectional Image-Event Guided Fusion Framework for Low-Light Image Enhancement
by: Liu, Zhanwen, et al.
Published: (2025)
by: Liu, Zhanwen, et al.
Published: (2025)
Zero-Shot Low Light Image Enhancement with Diffusion Prior
by: Cho, Joshua, et al.
Published: (2024)
by: Cho, Joshua, et al.
Published: (2024)
ContextFlow: Training-Free Video Object Editing via Adaptive Context Enrichment
by: Chen, Yiyang, et al.
Published: (2025)
by: Chen, Yiyang, et al.
Published: (2025)
Zero-Shot ECG Classification with Multimodal Learning and Test-time Clinical Knowledge Enhancement
by: Liu, Che, et al.
Published: (2024)
by: Liu, Che, et al.
Published: (2024)
Zero-Shot End-to-End Spoken Language Understanding via Cross-Modal Selective Self-Training
by: He, Jianfeng, et al.
Published: (2023)
by: He, Jianfeng, et al.
Published: (2023)
AGLLDiff: Guiding Diffusion Models Towards Unsupervised Training-free Real-world Low-light Image Enhancement
by: Lin, Yunlong, et al.
Published: (2024)
by: Lin, Yunlong, et al.
Published: (2024)
HyCIR: Boosting Zero-Shot Composed Image Retrieval with Synthetic Labels
by: Jiang, Yingying, et al.
Published: (2024)
by: Jiang, Yingying, et al.
Published: (2024)
Sharpening Kubernetes Audit Logs with Context Awareness
by: Franzil, Matteo, et al.
Published: (2025)
by: Franzil, Matteo, et al.
Published: (2025)
Enhancing Zero-Shot Image Recognition in Vision-Language Models through Human-like Concept Guidance
by: Liu, Hui, et al.
Published: (2025)
by: Liu, Hui, et al.
Published: (2025)
A Chain of Diagnosis Framework for Accurate and Explainable Radiology Report Generation
by: Jin, Haibo, et al.
Published: (2025)
by: Jin, Haibo, et al.
Published: (2025)
LookWise: Knowing When and Where to Look for Fine-Grained Visual Reasoning in Multimodal Large Language Models
by: Shen, Yuxiang, et al.
Published: (2026)
by: Shen, Yuxiang, et al.
Published: (2026)
SynLeaF: A Dual-Stage Multimodal Fusion Framework for Synthetic Lethality Prediction Across Pan- and Single-Cancer Contexts
by: Xing, Zheming, et al.
Published: (2026)
by: Xing, Zheming, et al.
Published: (2026)
Bridging Modalities: Enhancing Cross-Modality Hate Speech Detection with Few-Shot In-Context Learning
by: Hee, Ming Shan, et al.
Published: (2024)
by: Hee, Ming Shan, et al.
Published: (2024)
MRGeo: Robust Cross-View Geo-Localization of Corrupted Images via Spatial and Channel Feature Enhancement
by: Wu, Le, et al.
Published: (2026)
by: Wu, Le, et al.
Published: (2026)
A Training-Free Framework for Video License Plate Tracking and Recognition with Only One-Shot
by: Ding, Haoxuan, et al.
Published: (2024)
by: Ding, Haoxuan, et al.
Published: (2024)
Similar Items
-
Frequency-Adaptive Pan-Sharpening with Mixture of Experts
by: He, Xuanhua, et al.
Published: (2024) -
Hybrid Fusion: One-Minute Efficient Training for Zero-Shot Cross-Domain Image Fusion
by: Zhang, Ran, et al.
Published: (2026) -
Self-supervised Multiplex Consensus Mamba for General Image Fusion
by: Wang, Yingying, et al.
Published: (2025) -
Multigrain-aware Semantic Prototype Scanning and Tri-Token Prompt Learning Embraced High-Order RWKV for Pan-Sharpening
by: Li, Junfeng, et al.
Published: (2026) -
A Representation Sharpening Framework for Zero Shot Dense Retrieval
by: Ashok, Dhananjay, et al.
Published: (2025)