CropVLM: A Domain-Adapted Vision-Language Model for Open-Set Crop Analysis
Fuente:
arXiv
Guardado en:
| Autores principales: | Boudiaf, Abderrahmene, Javed, Sajd |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CropVLM: Learning to Zoom for Fine-Grained Vision-Language Perception
por: Carvalho, Miguel, et al.
Publicado: (2025)
por: Carvalho, Miguel, et al.
Publicado: (2025)
AgriChat: A Multimodal Large Language Model for Agriculture Image Understanding
por: Boudiaf, Abderrahmene, et al.
Publicado: (2026)
por: Boudiaf, Abderrahmene, et al.
Publicado: (2026)
SegRAG: Training-Free Retrieval-Augmented Semantic Segmentation
por: Boudiaf, Abderrahmene, et al.
Publicado: (2026)
por: Boudiaf, Abderrahmene, et al.
Publicado: (2026)
Vision-Language Semantic Grounding for Multi-Domain Crop-Weed Segmentation
por: Hossain, Nazia, et al.
Publicado: (2026)
por: Hossain, Nazia, et al.
Publicado: (2026)
Cropper: Vision-Language Model for Image Cropping through In-Context Learning
por: Lee, Seung Hyun, et al.
Publicado: (2024)
por: Lee, Seung Hyun, et al.
Publicado: (2024)
A Modelling and Evaluation Framework for EuroCrops-Driven Sentinel-2 Crop Segmentation
por: Scarlat, Alexandra Nicoleta, et al.
Publicado: (2026)
por: Scarlat, Alexandra Nicoleta, et al.
Publicado: (2026)
AesCrop: Aesthetic-driven Cropping Guided by Composition
por: Wong, Yen-Hong, et al.
Publicado: (2025)
por: Wong, Yen-Hong, et al.
Publicado: (2025)
EOL: Transductive Few-Shot Open-Set Recognition by Enhancing Outlier Logits
por: Ochal, Mateusz, et al.
Publicado: (2024)
por: Ochal, Mateusz, et al.
Publicado: (2024)
Efficient Multi-Crop Saliency Partitioning for Automatic Image Cropping
por: Hamara, Andrew, et al.
Publicado: (2025)
por: Hamara, Andrew, et al.
Publicado: (2025)
Scalable Vision-Guided Crop Yield Estimation
por: Li, Harrison H., et al.
Publicado: (2025)
por: Li, Harrison H., et al.
Publicado: (2025)
Cross Domain Early Crop Mapping using CropSTGAN
por: Wang, Yiqun, et al.
Publicado: (2024)
por: Wang, Yiqun, et al.
Publicado: (2024)
DepthCropSeg++: Scaling a Crop Segmentation Foundation Model With Depth-Labeled Data
por: Zhang, Jiafei, et al.
Publicado: (2026)
por: Zhang, Jiafei, et al.
Publicado: (2026)
CropCraft: Complete Structural Characterization of Crop Plants From Images
por: Zhai, Albert J., et al.
Publicado: (2024)
por: Zhai, Albert J., et al.
Publicado: (2024)
ProCrop: Learning Aesthetic Image Cropping from Professional Compositions
por: Zhang, Ke, et al.
Publicado: (2025)
por: Zhang, Ke, et al.
Publicado: (2025)
Agro-Consensus: Semantic Self-Consistency in Vision-Language Models for Crop Disease Management in Developing Countries
por: Gupta, Mihir, et al.
Publicado: (2025)
por: Gupta, Mihir, et al.
Publicado: (2025)
Self-Consistency in Vision-Language Models for Precision Agriculture: Multi-Response Consensus for Crop Disease Management
por: Gupta, Mihir, et al.
Publicado: (2025)
por: Gupta, Mihir, et al.
Publicado: (2025)
TextureCrop: Enhancing Synthetic Image Detection through Texture-based Cropping
por: Konstantinidou, Despina, et al.
Publicado: (2024)
por: Konstantinidou, Despina, et al.
Publicado: (2024)
MoCrop: Training Free Motion Guided Cropping for Efficient Video Action Recognition
por: Huang, Binhua, et al.
Publicado: (2025)
por: Huang, Binhua, et al.
Publicado: (2025)
CropNeRF: A Neural Radiance Field-Based Framework for Crop Counting
por: Muzaddid, Md Ahmed Al, et al.
Publicado: (2026)
por: Muzaddid, Md Ahmed Al, et al.
Publicado: (2026)
Venus: Benchmarking and Empowering Multimodal Large Language Models for Aesthetic Guidance and Cropping
por: Du, Tianxiang, et al.
Publicado: (2026)
por: Du, Tianxiang, et al.
Publicado: (2026)
Open-Set Recognition in the Age of Vision-Language Models
por: Miller, Dimity, et al.
Publicado: (2024)
por: Miller, Dimity, et al.
Publicado: (2024)
Adapting Vision-Language Model with Fine-grained Semantics for Open-Vocabulary Segmentation
por: Chng, Yong Xien, et al.
Publicado: (2024)
por: Chng, Yong Xien, et al.
Publicado: (2024)
A Two-Stage Multitask Vision-Language Framework for Explainable Crop Disease Visual Question Answering
por: Hossain, Md. Zahid, et al.
Publicado: (2026)
por: Hossain, Md. Zahid, et al.
Publicado: (2026)
Industrial Language-Image Dataset (ILID): Adapting Vision Foundation Models for Industrial Settings
por: Moenck, Keno, et al.
Publicado: (2024)
por: Moenck, Keno, et al.
Publicado: (2024)
Design and Implementation of FourCropNet: A CNN-Based System for Efficient Multi-Crop Disease Detection and Management
por: Khandagale, H. P., et al.
Publicado: (2025)
por: Khandagale, H. P., et al.
Publicado: (2025)
Domain Generalization for Crop Segmentation with Standardized Ensemble Knowledge Distillation
por: Angarano, Simone, et al.
Publicado: (2023)
por: Angarano, Simone, et al.
Publicado: (2023)
MobileVLM : A Fast, Strong and Open Vision Language Assistant for Mobile Devices
por: Chu, Xiangxiang, et al.
Publicado: (2023)
por: Chu, Xiangxiang, et al.
Publicado: (2023)
Adapting Vision-Language Models to Open Classes via Test-Time Prompt Tuning
por: Gao, Zhengqing, et al.
Publicado: (2024)
por: Gao, Zhengqing, et al.
Publicado: (2024)
Multi-Modal Vision Transformers for Crop Mapping from Satellite Image Time Series
por: Follath, Theresa, et al.
Publicado: (2024)
por: Follath, Theresa, et al.
Publicado: (2024)
FloorplanVLM: A Vision-Language Model for Floorplan Vectorization
por: Liu, Yuanqing, et al.
Publicado: (2026)
por: Liu, Yuanqing, et al.
Publicado: (2026)
Fusion of Domain-Adapted Vision and Language Models for Medical Visual Question Answering
por: Ha, Cuong Nhat, et al.
Publicado: (2024)
por: Ha, Cuong Nhat, et al.
Publicado: (2024)
VLM-3D:End-to-End Vision-Language Models for Open-World 3D Perception
por: Chang, Fuhao, et al.
Publicado: (2025)
por: Chang, Fuhao, et al.
Publicado: (2025)
Crossmodal learning for Crop Canopy Trait Estimation
por: Ayanlade, Timilehin T., et al.
Publicado: (2025)
por: Ayanlade, Timilehin T., et al.
Publicado: (2025)
EcoCropsAID: Economic Crops Aerial Image Dataset for Land Use Classification
por: Noppitak, Sangdaow, et al.
Publicado: (2024)
por: Noppitak, Sangdaow, et al.
Publicado: (2024)
Immuno-VLM: Immunizing Large Vision-Language Models via Generative Semantic Antibodies for Open-World Trustworthiness
por: Fang, Xiang, et al.
Publicado: (2026)
por: Fang, Xiang, et al.
Publicado: (2026)
Demeter: A Parametric Model of Crop Plant Morphology from the Real World
por: Cheng, Tianhang, et al.
Publicado: (2025)
por: Cheng, Tianhang, et al.
Publicado: (2025)
On the Generalizability of Foundation Models for Crop Type Mapping
por: Chang, Yi-Chia, et al.
Publicado: (2024)
por: Chang, Yi-Chia, et al.
Publicado: (2024)
BackdoorVLM: A Benchmark for Backdoor Attacks on Vision-Language Models
por: Li, Juncheng, et al.
Publicado: (2025)
por: Li, Juncheng, et al.
Publicado: (2025)
Adapting Vision-Language Models for E-commerce Understanding at Scale
por: Nulli, Matteo, et al.
Publicado: (2026)
por: Nulli, Matteo, et al.
Publicado: (2026)
U-VLM: Hierarchical Vision Language Modeling for Report Generation
por: Shi, Pengcheng, et al.
Publicado: (2026)
por: Shi, Pengcheng, et al.
Publicado: (2026)
Ejemplares similares
-
CropVLM: Learning to Zoom for Fine-Grained Vision-Language Perception
por: Carvalho, Miguel, et al.
Publicado: (2025) -
AgriChat: A Multimodal Large Language Model for Agriculture Image Understanding
por: Boudiaf, Abderrahmene, et al.
Publicado: (2026) -
SegRAG: Training-Free Retrieval-Augmented Semantic Segmentation
por: Boudiaf, Abderrahmene, et al.
Publicado: (2026) -
Vision-Language Semantic Grounding for Multi-Domain Crop-Weed Segmentation
por: Hossain, Nazia, et al.
Publicado: (2026) -
Cropper: Vision-Language Model for Image Cropping through In-Context Learning
por: Lee, Seung Hyun, et al.
Publicado: (2024)