CT-CLIP: A Multi-modal Fusion Framework for Robust Apple Leaf Disease Recognition in Complex Environments
Fuente:
arXiv
Guardado en:
| Autores principales: | Liu, Lemin, Hu, Fangchao, Jiang, Honghua, Chen, Yaru, Liu, Limin, Qiao, Yongliang |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Cross-Camera Cow Identification via Disentangled Representation Learning
por: Wang, Runcheng, et al.
Publicado: (2026)
por: Wang, Runcheng, et al.
Publicado: (2026)
Robust Domain Generalization for Multi-modal Object Recognition
por: Qiao, Yuxin, et al.
Publicado: (2024)
por: Qiao, Yuxin, et al.
Publicado: (2024)
CLIP Multi-modal Hashing for Multimedia Retrieval
por: Zhu, Jian, et al.
Publicado: (2024)
por: Zhu, Jian, et al.
Publicado: (2024)
Multi-view Distillation based on Multi-modal Fusion for Few-shot Action Recognition(CLIP-$\mathrm{M^2}$DF)
por: Guo, Fei, et al.
Publicado: (2024)
por: Guo, Fei, et al.
Publicado: (2024)
LeafLife: An Explainable Deep Learning Framework with Robustness for Grape Leaf Disease Recognition
por: Alam, B. M. Shahria, et al.
Publicado: (2026)
por: Alam, B. M. Shahria, et al.
Publicado: (2026)
CrossTracker: Robust Multi-modal 3D Multi-Object Tracking via Cross Correction
por: Gu, Lipeng, et al.
Publicado: (2024)
por: Gu, Lipeng, et al.
Publicado: (2024)
Building a Multi-modal Spatiotemporal Expert for Zero-shot Action Recognition with CLIP
por: Yu, Yating, et al.
Publicado: (2024)
por: Yu, Yating, et al.
Publicado: (2024)
From CLIP to DINO: Visual Encoders Shout in Multi-modal Large Language Models
por: Jiang, Dongsheng, et al.
Publicado: (2023)
por: Jiang, Dongsheng, et al.
Publicado: (2023)
Bridging the Gap between Multi-focus and Multi-modal: A Focused Integration Framework for Multi-modal Image Fusion
por: Li, Xilai, et al.
Publicado: (2023)
por: Li, Xilai, et al.
Publicado: (2023)
MV-CLIP: Multi-View CLIP for Zero-shot 3D Shape Recognition
por: Song, Dan, et al.
Publicado: (2023)
por: Song, Dan, et al.
Publicado: (2023)
M2-CLIP: A Multimodal, Multi-task Adapting Framework for Video Action Recognition
por: Wang, Mengmeng, et al.
Publicado: (2024)
por: Wang, Mengmeng, et al.
Publicado: (2024)
Robust Light-Weight Facial Affective Behavior Recognition with CLIP
por: Lin, Li, et al.
Publicado: (2024)
por: Lin, Li, et al.
Publicado: (2024)
Mam-App: A Novel Parameter-Efficient Mamba Model for Apple Leaf Disease Classification
por: Mahamood, Md Nadim, et al.
Publicado: (2026)
por: Mahamood, Md Nadim, et al.
Publicado: (2026)
Dynamic Brightness Adaptation for Robust Multi-modal Image Fusion
por: Sun, Yiming, et al.
Publicado: (2024)
por: Sun, Yiming, et al.
Publicado: (2024)
Robust COVID-19 Detection in CT Images with CLIP
por: Lin, Li, et al.
Publicado: (2024)
por: Lin, Li, et al.
Publicado: (2024)
LvBench: A Benchmark for Long-form Video Understanding with Versatile Multi-modal Question Answering
por: Zhang, Hongjie, et al.
Publicado: (2023)
por: Zhang, Hongjie, et al.
Publicado: (2023)
TSCLIP: Robust CLIP Fine-Tuning for Worldwide Cross-Regional Traffic Sign Recognition
por: Zhao, Guoyang, et al.
Publicado: (2024)
por: Zhao, Guoyang, et al.
Publicado: (2024)
BrainMCLIP: Brain Image Decoding with Multi-Layer feature Fusion of CLIP
por: Xia, Tian, et al.
Publicado: (2025)
por: Xia, Tian, et al.
Publicado: (2025)
GaitMA: Pose-guided Multi-modal Feature Fusion for Gait Recognition
por: Min, Fanxu, et al.
Publicado: (2024)
por: Min, Fanxu, et al.
Publicado: (2024)
InterCLIP-MEP: Interactive CLIP and Memory-Enhanced Predictor for Multi-modal Sarcasm Detection
por: Chen, Junjie, et al.
Publicado: (2024)
por: Chen, Junjie, et al.
Publicado: (2024)
The PV-ALE Dataset: Enhancing Apple Leaf Disease Classification Through Transfer Learning with Convolutional Neural Networks
por: Akinyemi, Joseph Damilola, et al.
Publicado: (2024)
por: Akinyemi, Joseph Damilola, et al.
Publicado: (2024)
CIBR: Cross-modal Information Bottleneck Regularization for Robust CLIP Generalization
por: Ji, Yingrui, et al.
Publicado: (2025)
por: Ji, Yingrui, et al.
Publicado: (2025)
Simultaneous Long-tailed Recognition and Multi-modal Fusion for Highly Imbalanced Multi-modal Data
por: Yoon, Heegeon, et al.
Publicado: (2026)
por: Yoon, Heegeon, et al.
Publicado: (2026)
SORCE: Small Object Retrieval in Complex Environments
por: Liu, Chunxu, et al.
Publicado: (2025)
por: Liu, Chunxu, et al.
Publicado: (2025)
Data Augmentation through Background Removal for Apple Leaf Disease Classification Using the MobileNetV2 Model
por: Ferdi, Youcef
Publicado: (2024)
por: Ferdi, Youcef
Publicado: (2024)
MVBench: A Comprehensive Multi-modal Video Understanding Benchmark
por: Li, Kunchang, et al.
Publicado: (2023)
por: Li, Kunchang, et al.
Publicado: (2023)
MultiTSF: Transformer-based Sensor Fusion for Human-Centric Multi-view and Multi-modal Action Recognition
por: Nguyen, Trung Thanh, et al.
Publicado: (2025)
por: Nguyen, Trung Thanh, et al.
Publicado: (2025)
OmniCLIP: Adapting CLIP for Video Recognition with Spatial-Temporal Omni-Scale Feature Learning
por: Liu, Mushui, et al.
Publicado: (2024)
por: Liu, Mushui, et al.
Publicado: (2024)
Cattle-CLIP: A Multimodal Framework for Cattle Behaviour Recognition from Video
por: Liu, Huimin, et al.
Publicado: (2025)
por: Liu, Huimin, et al.
Publicado: (2025)
Multi-modal and Multi-scale Spatial Environment Understanding for Immersive Visual Text-to-Speech
por: Liu, Rui, et al.
Publicado: (2024)
por: Liu, Rui, et al.
Publicado: (2024)
M$^3$amba: CLIP-driven Mamba Model for Multi-modal Remote Sensing Classification
por: Cao, Mingxiang, et al.
Publicado: (2025)
por: Cao, Mingxiang, et al.
Publicado: (2025)
FineCLIPER: Multi-modal Fine-grained CLIP for Dynamic Facial Expression Recognition with AdaptERs
por: Chen, Haodong, et al.
Publicado: (2024)
por: Chen, Haodong, et al.
Publicado: (2024)
TeaLeafVision: An Explainable and Robust Deep Learning Framework for Tea Leaf Disease Classification
por: Ahamed, Rafi, et al.
Publicado: (2026)
por: Ahamed, Rafi, et al.
Publicado: (2026)
Adaptive Weighted Parameter Fusion with CLIP for Class-Incremental Learning
por: Guo, Juncen, et al.
Publicado: (2025)
por: Guo, Juncen, et al.
Publicado: (2025)
Multi-modal Evidential Fusion Network for Trustworthy PET/CT Tumor Segmentation
por: Qi, Yuxuan, et al.
Publicado: (2024)
por: Qi, Yuxuan, et al.
Publicado: (2024)
LeafTrackNet: A Deep Learning Framework for Robust Leaf Tracking in Top-Down Plant Phenotyping
por: Liu, Shanghua, et al.
Publicado: (2025)
por: Liu, Shanghua, et al.
Publicado: (2025)
TACFN: Transformer-based Adaptive Cross-modal Fusion Network for Multimodal Emotion Recognition
por: Liu, Feng, et al.
Publicado: (2025)
por: Liu, Feng, et al.
Publicado: (2025)
Hydra: Accurate Multi-Modal Leaf Wetness Sensing with mm-Wave and Camera Fusion
por: Liu, Yimeng, et al.
Publicado: (2025)
por: Liu, Yimeng, et al.
Publicado: (2025)
MambaFusion: Height-Fidelity Dense Global Fusion for Multi-modal 3D Object Detection
por: Wang, Hanshi, et al.
Publicado: (2025)
por: Wang, Hanshi, et al.
Publicado: (2025)
Infrared and Visible Image Fusion with Language-Driven Loss in CLIP Embedding Space
por: Wang, Yuhao, et al.
Publicado: (2024)
por: Wang, Yuhao, et al.
Publicado: (2024)
Ejemplares similares
-
Cross-Camera Cow Identification via Disentangled Representation Learning
por: Wang, Runcheng, et al.
Publicado: (2026) -
Robust Domain Generalization for Multi-modal Object Recognition
por: Qiao, Yuxin, et al.
Publicado: (2024) -
CLIP Multi-modal Hashing for Multimedia Retrieval
por: Zhu, Jian, et al.
Publicado: (2024) -
Multi-view Distillation based on Multi-modal Fusion for Few-shot Action Recognition(CLIP-$\mathrm{M^2}$DF)
por: Guo, Fei, et al.
Publicado: (2024) -
LeafLife: An Explainable Deep Learning Framework with Robustness for Grape Leaf Disease Recognition
por: Alam, B. M. Shahria, et al.
Publicado: (2026)