SimMAT: Exploring Transferability from Vision Foundation Models to Any Image Modality
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Lei, Chenyang, Chen, Liyi, Cen, Jun, Chen, Xiao, Lei, Zhen, Heide, Felix, Liu, Ziwei, Chen, Qifeng, Zhang, Zhaoxiang |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
SimCMF: A Simple Cross-modal Fine-tuning Strategy from Vision Foundation Models to Any Imaging Modality
von: Lei, Chenyang, et al.
Veröffentlicht: (2024)
von: Lei, Chenyang, et al.
Veröffentlicht: (2024)
Robust Depth Enhancement via Polarization Prompt Fusion Tuning
von: Ikemura, Kei, et al.
Veröffentlicht: (2024)
von: Ikemura, Kei, et al.
Veröffentlicht: (2024)
General Geometry-aware Weakly Supervised 3D Object Detection
von: Zhang, Guowen, et al.
Veröffentlicht: (2024)
von: Zhang, Guowen, et al.
Veröffentlicht: (2024)
FIRM: Flexible Interactive Reflection reMoval
von: Chen, Xiao, et al.
Veröffentlicht: (2024)
von: Chen, Xiao, et al.
Veröffentlicht: (2024)
Automatic Controllable Colorization via Imagination
von: Cong, Xiaoyan, et al.
Veröffentlicht: (2024)
von: Cong, Xiaoyan, et al.
Veröffentlicht: (2024)
BEVDilation: LiDAR-Centric Multi-Modal Fusion for 3D Object Detection
von: Zhang, Guowen, et al.
Veröffentlicht: (2025)
von: Zhang, Guowen, et al.
Veröffentlicht: (2025)
Adaptive Domain Learning for Cross-domain Image Denoising
von: Qian, Zian, et al.
Veröffentlicht: (2024)
von: Qian, Zian, et al.
Veröffentlicht: (2024)
FreeTuner: Any Subject in Any Style with Training-free Diffusion
von: Xu, Youcan, et al.
Veröffentlicht: (2024)
von: Xu, Youcan, et al.
Veröffentlicht: (2024)
Expanding Scene Graph Boundaries: Fully Open-vocabulary Scene Graph Generation via Visual-Concept Alignment and Retention
von: Chen, Zuyao, et al.
Veröffentlicht: (2023)
von: Chen, Zuyao, et al.
Veröffentlicht: (2023)
GPT4SGG: Synthesizing Scene Graphs from Holistic and Region-specific Narratives
von: Chen, Zuyao, et al.
Veröffentlicht: (2023)
von: Chen, Zuyao, et al.
Veröffentlicht: (2023)
Instruction-based Image Editing with Planning, Reasoning, and Generation
von: Ji, Liya, et al.
Veröffentlicht: (2026)
von: Ji, Liya, et al.
Veröffentlicht: (2026)
MDReID: Modality-Decoupled Learning for Any-to-Any Multi-Modal Object Re-Identification
von: Feng, Yingying, et al.
Veröffentlicht: (2025)
von: Feng, Yingying, et al.
Veröffentlicht: (2025)
Using Left and Right Brains Together: Towards Vision and Language Planning
von: Cen, Jun, et al.
Veröffentlicht: (2024)
von: Cen, Jun, et al.
Veröffentlicht: (2024)
Generalized and Efficient 2D Gaussian Splatting for Arbitrary-scale Super-Resolution
von: Chen, Du, et al.
Veröffentlicht: (2025)
von: Chen, Du, et al.
Veröffentlicht: (2025)
Polarization Wavefront Lidar: Learning Large Scene Reconstruction from Polarized Wavefronts
von: Scheuble, Dominik, et al.
Veröffentlicht: (2024)
von: Scheuble, Dominik, et al.
Veröffentlicht: (2024)
DiT4Edit: Diffusion Transformer for Image Editing
von: Feng, Kunyu, et al.
Veröffentlicht: (2024)
von: Feng, Kunyu, et al.
Veröffentlicht: (2024)
CoCoEdit: Content-Consistent Image Editing via Region Regularized Reinforcement Learning
von: Wu, Yuhui, et al.
Veröffentlicht: (2026)
von: Wu, Yuhui, et al.
Veröffentlicht: (2026)
One2Scene: Geometric Consistent Explorable 3D Scene Generation from a Single Image
von: Wang, Pengfei, et al.
Veröffentlicht: (2026)
von: Wang, Pengfei, et al.
Veröffentlicht: (2026)
SimMLM: A Simple Framework for Multi-modal Learning with Missing Modality
von: Li, Sijie, et al.
Veröffentlicht: (2025)
von: Li, Sijie, et al.
Veröffentlicht: (2025)
PAM: A Propagation-Based Model for Segmenting Any 3D Objects across Multi-Modal Medical Images
von: Chen, Zifan, et al.
Veröffentlicht: (2024)
von: Chen, Zifan, et al.
Veröffentlicht: (2024)
Adapting Vision Foundation Models for Real-time Ultrasound Image Segmentation
von: Zhang, Xiaoran, et al.
Veröffentlicht: (2025)
von: Zhang, Xiaoran, et al.
Veröffentlicht: (2025)
Generative Active Learning for Image Synthesis Personalization
von: Zhang, Xulu, et al.
Veröffentlicht: (2024)
von: Zhang, Xulu, et al.
Veröffentlicht: (2024)
Any2Any: Unified Arbitrary Modality Translation for Remote Sensing
von: Chen, Haoyang, et al.
Veröffentlicht: (2026)
von: Chen, Haoyang, et al.
Veröffentlicht: (2026)
All-in-One: Transferring Vision Foundation Models into Stereo Matching
von: Zhou, Jingyi, et al.
Veröffentlicht: (2024)
von: Zhou, Jingyi, et al.
Veröffentlicht: (2024)
Driving with DINO: Vision Foundation Features as a Unified Bridge for Sim-to-Real Generation in Autonomous Driving
von: Chen, Xuyang, et al.
Veröffentlicht: (2026)
von: Chen, Xuyang, et al.
Veröffentlicht: (2026)
Top-Down Guidance for Learning Object-Centric Representations
von: Zou, Junhong, et al.
Veröffentlicht: (2024)
von: Zou, Junhong, et al.
Veröffentlicht: (2024)
Segment Any 3D Gaussians
von: Cen, Jiazhong, et al.
Veröffentlicht: (2023)
von: Cen, Jiazhong, et al.
Veröffentlicht: (2023)
Transferability Bound Theory: Exploring Relationship between Adversarial Transferability and Flatness
von: Fan, Mingyuan, et al.
Veröffentlicht: (2023)
von: Fan, Mingyuan, et al.
Veröffentlicht: (2023)
Fast Multi-view Consistent 3D Editing with Video Priors
von: Chen, Liyi, et al.
Veröffentlicht: (2025)
von: Chen, Liyi, et al.
Veröffentlicht: (2025)
Omni-3DEdit: Generalized Versatile 3D Editing in One-Pass
von: Liyi, Chen, et al.
Veröffentlicht: (2026)
von: Liyi, Chen, et al.
Veröffentlicht: (2026)
FlowMotion: Training-Free Flow Guidance for Video Motion Transfer
von: Wang, Zhen, et al.
Veröffentlicht: (2026)
von: Wang, Zhen, et al.
Veröffentlicht: (2026)
Improving Large Vision-Language Models' Understanding for Flow Field Data
von: Zhang, Xiaomei, et al.
Veröffentlicht: (2025)
von: Zhang, Xiaomei, et al.
Veröffentlicht: (2025)
Seek for Incantations: Towards Accurate Text-to-Image Diffusion Synthesis through Prompt Engineering
von: Yu, Chang, et al.
Veröffentlicht: (2024)
von: Yu, Chang, et al.
Veröffentlicht: (2024)
RSRefSeg 2: Decoupling Referring Remote Sensing Image Segmentation with Foundation Models
von: Chen, Keyan, et al.
Veröffentlicht: (2025)
von: Chen, Keyan, et al.
Veröffentlicht: (2025)
SPIRE: Semantic Prompt-Driven Image Restoration
von: Qi, Chenyang, et al.
Veröffentlicht: (2023)
von: Qi, Chenyang, et al.
Veröffentlicht: (2023)
AnyAD: Unified Any-Modality Anomaly Detection in Incomplete Multi-Sequence MRI
von: Wu, Changwei, et al.
Veröffentlicht: (2025)
von: Wu, Changwei, et al.
Veröffentlicht: (2025)
Rethinking Cross-Modal Interaction in Multimodal Diffusion Transformers
von: Lv, Zhengyao, et al.
Veröffentlicht: (2025)
von: Lv, Zhengyao, et al.
Veröffentlicht: (2025)
4D Panoptic Scene Graph Generation
von: Yang, Jingkang, et al.
Veröffentlicht: (2024)
von: Yang, Jingkang, et al.
Veröffentlicht: (2024)
Referring to Any Person
von: Jiang, Qing, et al.
Veröffentlicht: (2025)
von: Jiang, Qing, et al.
Veröffentlicht: (2025)
RSRefSeg: Referring Remote Sensing Image Segmentation with Foundation Models
von: Chen, Keyan, et al.
Veröffentlicht: (2025)
von: Chen, Keyan, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
SimCMF: A Simple Cross-modal Fine-tuning Strategy from Vision Foundation Models to Any Imaging Modality
von: Lei, Chenyang, et al.
Veröffentlicht: (2024) -
Robust Depth Enhancement via Polarization Prompt Fusion Tuning
von: Ikemura, Kei, et al.
Veröffentlicht: (2024) -
General Geometry-aware Weakly Supervised 3D Object Detection
von: Zhang, Guowen, et al.
Veröffentlicht: (2024) -
FIRM: Flexible Interactive Reflection reMoval
von: Chen, Xiao, et al.
Veröffentlicht: (2024) -
Automatic Controllable Colorization via Imagination
von: Cong, Xiaoyan, et al.
Veröffentlicht: (2024)