Zero-Shot Refinement of Buildings' Segmentation Models using SAM
Fuente:
arXiv
Guardado en:
| Autores principales: | Mayladan, Ali, Nasrallah, Hasan, Moughnieh, Hasan, Shukor, Mustafa, Ghandour, Ali J. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Efficient Adaptation For Remote Sensing Visual Grounding
por: Moughnieh, Hasan, et al.
Publicado: (2025)
por: Moughnieh, Hasan, et al.
Publicado: (2025)
A Concept-Based Explainability Framework for Large Multimodal Models
por: Parekh, Jayneel, et al.
Publicado: (2024)
por: Parekh, Jayneel, et al.
Publicado: (2024)
Learning to Steer: Input-dependent Steering for Multimodal LLMs
por: Parekh, Jayneel, et al.
Publicado: (2025)
por: Parekh, Jayneel, et al.
Publicado: (2025)
When Prompts Override Vision: Prompt-Induced Hallucinations in LVLMs
por: Khayatan, Pegah, et al.
Publicado: (2026)
por: Khayatan, Pegah, et al.
Publicado: (2026)
ClipSAM: CLIP and SAM Collaboration for Zero-Shot Anomaly Segmentation
por: Li, Shengze, et al.
Publicado: (2024)
por: Li, Shengze, et al.
Publicado: (2024)
Analyzing Finetuning Representation Shift for Multimodal LLMs Steering
por: Khayatan, Pegah, et al.
Publicado: (2025)
por: Khayatan, Pegah, et al.
Publicado: (2025)
Implicit Multimodal Alignment: On the Generalization of Frozen LLMs to Multimodal Inputs
por: Shukor, Mustafa, et al.
Publicado: (2024)
por: Shukor, Mustafa, et al.
Publicado: (2024)
Zero Shot Context-Based Object Segmentation using SLIP (SAM+CLIP)
por: Gundavarapu, Saaketh Koundinya, et al.
Publicado: (2024)
por: Gundavarapu, Saaketh Koundinya, et al.
Publicado: (2024)
FluoroSAM: A Language-promptable Foundation Model for Flexible X-ray Image Segmentation
por: Killeen, Benjamin D., et al.
Publicado: (2024)
por: Killeen, Benjamin D., et al.
Publicado: (2024)
Automated National Urban Map Extraction
por: Nasrallah, Hasan, et al.
Publicado: (2024)
por: Nasrallah, Hasan, et al.
Publicado: (2024)
SAM2Point: Segment Any 3D as Videos in Zero-shot and Promptable Manners
por: Guo, Ziyu, et al.
Publicado: (2024)
por: Guo, Ziyu, et al.
Publicado: (2024)
Zero-Shot Visual Reasoning by Vision-Language Models: Benchmarking and Analysis
por: Nagar, Aishik, et al.
Publicado: (2024)
por: Nagar, Aishik, et al.
Publicado: (2024)
Zero-Shot Segmentation of Eye Features Using the Segment Anything Model (SAM)
por: Maquiling, Virmarie, et al.
Publicado: (2023)
por: Maquiling, Virmarie, et al.
Publicado: (2023)
Benchmarking Zero-Shot Robustness of Multimodal Foundation Models: A Pilot Study
por: Wang, Chenguang, et al.
Publicado: (2024)
por: Wang, Chenguang, et al.
Publicado: (2024)
A Decade of Wheat Mapping for Lebanon
por: Wehbi, Hasan, et al.
Publicado: (2025)
por: Wehbi, Hasan, et al.
Publicado: (2025)
Commonsense for Zero-Shot Natural Language Video Localization
por: Holla, Meghana, et al.
Publicado: (2023)
por: Holla, Meghana, et al.
Publicado: (2023)
Zero-Shot Vehicle Model Recognition via Text-Based Retrieval-Augmented Generation
por: Chang, Wei-Chia, et al.
Publicado: (2025)
por: Chang, Wei-Chia, et al.
Publicado: (2025)
Semantic Segmentation Refiner for Ultrasound Applications with Zero-Shot Foundation Models
por: Indelman, Hedda Cohen, et al.
Publicado: (2024)
por: Indelman, Hedda Cohen, et al.
Publicado: (2024)
Energy-based Models are Zero-Shot Planners for Compositional Scene Rearrangement
por: Gkanatsios, Nikolaos, et al.
Publicado: (2023)
por: Gkanatsios, Nikolaos, et al.
Publicado: (2023)
Parabolic Continual Learning
por: Yang, Haoming, et al.
Publicado: (2025)
por: Yang, Haoming, et al.
Publicado: (2025)
Causal-SAM-LLM: Large Language Models as Causal Reasoners for Robust Medical Segmentation
por: Tang, Tao, et al.
Publicado: (2025)
por: Tang, Tao, et al.
Publicado: (2025)
Zero-Shot Defense Against Toxic Images via Inherent Multimodal Alignment in LVLMs
por: Zhao, Wei, et al.
Publicado: (2025)
por: Zhao, Wei, et al.
Publicado: (2025)
SAM4MLLM: Enhance Multi-Modal Large Language Model for Referring Expression Segmentation
por: Chen, Yi-Chia, et al.
Publicado: (2024)
por: Chen, Yi-Chia, et al.
Publicado: (2024)
Fusing Domain-Specific Content from Large Language Models into Knowledge Graphs for Enhanced Zero Shot Object State Classification
por: Gouidis, Filippos, et al.
Publicado: (2024)
por: Gouidis, Filippos, et al.
Publicado: (2024)
BYO-Eval: Build Your Own Dataset for Fine-Grained Visual Assessment of Multimodal Language Models
por: Arnould, Ludovic, et al.
Publicado: (2025)
por: Arnould, Ludovic, et al.
Publicado: (2025)
SynC: Synthetic Image Caption Dataset Refinement with One-to-many Mapping for Zero-shot Image Captioning
por: Kim, Si-Woo, et al.
Publicado: (2025)
por: Kim, Si-Woo, et al.
Publicado: (2025)
Generative Artificial Intelligence: A Systematic Review and Applications
por: Sengar, Sandeep Singh, et al.
Publicado: (2024)
por: Sengar, Sandeep Singh, et al.
Publicado: (2024)
Beyond Symbolic Solving: Multi Chain-of-Thought Voting for Geometric Reasoning in Large Language Models
por: Siddique, Md. Abu Bakor, et al.
Publicado: (2026)
por: Siddique, Md. Abu Bakor, et al.
Publicado: (2026)
SimSAM: Zero-shot Medical Image Segmentation via Simulated Interaction
por: Towle, Benjamin, et al.
Publicado: (2024)
por: Towle, Benjamin, et al.
Publicado: (2024)
Lorentz Framework for Semantic Segmentation
por: Hasan, Zahid, et al.
Publicado: (2026)
por: Hasan, Zahid, et al.
Publicado: (2026)
SeqSAM: Autoregressive Multiple Hypothesis Prediction for Medical Image Segmentation using SAM
por: Towle, Benjamin, et al.
Publicado: (2025)
por: Towle, Benjamin, et al.
Publicado: (2025)
ProtoSAM: One-Shot Medical Image Segmentation With Foundational Models
por: Ayzenberg, Lev, et al.
Publicado: (2024)
por: Ayzenberg, Lev, et al.
Publicado: (2024)
Exploring Transfer Learning in Medical Image Segmentation using Vision-Language Models
por: Poudel, Kanchan, et al.
Publicado: (2023)
por: Poudel, Kanchan, et al.
Publicado: (2023)
Thinking Like a Botanist: Challenging Multimodal Language Models with Intent-Driven Chain-of-Inquiry
por: Sakib, Syed Nazmus, et al.
Publicado: (2026)
por: Sakib, Syed Nazmus, et al.
Publicado: (2026)
ARB-LLM: Alternating Refined Binarizations for Large Language Models
por: Li, Zhiteng, et al.
Publicado: (2024)
por: Li, Zhiteng, et al.
Publicado: (2024)
Prompting Foundation Models for Zero-Shot Ship Instance Segmentation in SAR Imagery
por: Mansour, Islam, et al.
Publicado: (2026)
por: Mansour, Islam, et al.
Publicado: (2026)
ZeroNLG: Aligning and Autoencoding Domains for Zero-Shot Multimodal and Multilingual Natural Language Generation
por: Yang, Bang, et al.
Publicado: (2023)
por: Yang, Bang, et al.
Publicado: (2023)
Are Video Models Ready as Zero-Shot Reasoners? An Empirical Study with the MME-CoF Benchmark
por: Guo, Ziyu, et al.
Publicado: (2025)
por: Guo, Ziyu, et al.
Publicado: (2025)
Many-Shot In-Context Learning in Multimodal Foundation Models
por: Jiang, Yixing, et al.
Publicado: (2024)
por: Jiang, Yixing, et al.
Publicado: (2024)
Multi-Agent VQA: Exploring Multi-Agent Foundation Models in Zero-Shot Visual Question Answering
por: Jiang, Bowen, et al.
Publicado: (2024)
por: Jiang, Bowen, et al.
Publicado: (2024)
Ejemplares similares
-
Efficient Adaptation For Remote Sensing Visual Grounding
por: Moughnieh, Hasan, et al.
Publicado: (2025) -
A Concept-Based Explainability Framework for Large Multimodal Models
por: Parekh, Jayneel, et al.
Publicado: (2024) -
Learning to Steer: Input-dependent Steering for Multimodal LLMs
por: Parekh, Jayneel, et al.
Publicado: (2025) -
When Prompts Override Vision: Prompt-Induced Hallucinations in LVLMs
por: Khayatan, Pegah, et al.
Publicado: (2026) -
ClipSAM: CLIP and SAM Collaboration for Zero-Shot Anomaly Segmentation
por: Li, Shengze, et al.
Publicado: (2024)