Using Vision Language Models for Safety Hazard Identification in Construction
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Adil, Muhammad, Lee, Gaang, Gonzalez, Vicente A., Mei, Qipei |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Integration of Object Detection and Small VLMs for Construction Safety Hazard Identification
par: Adil, Muhammad, et autres
Publié: (2026)
par: Adil, Muhammad, et autres
Publié: (2026)
TrajGATFormer: A Graph-Based Transformer Approach for Worker and Obstacle Trajectory Prediction in Off-site Construction Environments
par: Alduais, Mohammed, et autres
Publié: (2025)
par: Alduais, Mohammed, et autres
Publié: (2025)
ErgoChat: a Visual Query System for the Ergonomic Risk Assessment of Construction Workers
par: Fan, Chao, et autres
Publié: (2024)
par: Fan, Chao, et autres
Publié: (2024)
Are Large Pre-trained Vision Language Models Effective Construction Safety Inspectors?
par: Chen, Xuezheng, et autres
Publié: (2025)
par: Chen, Xuezheng, et autres
Publié: (2025)
HazardNet: A Small-Scale Vision Language Model for Real-Time Traffic Safety Detection at Edge Devices
par: Tami, Mohammad Abu, et autres
Publié: (2025)
par: Tami, Mohammad Abu, et autres
Publié: (2025)
How Does Vision-Language Adaptation Impact the Safety of Vision Language Models?
par: Lee, Seongyun, et autres
Publié: (2024)
par: Lee, Seongyun, et autres
Publié: (2024)
Multi-Modal Interpretability for Enhanced Localization in Vision-Language Models
par: Imran, Muhammad, et autres
Publié: (2025)
par: Imran, Muhammad, et autres
Publié: (2025)
AR-Facilitated Safety Inspection and Fall Hazard Detection on Construction Sites
par: Liu, Jiazhou, et autres
Publié: (2024)
par: Liu, Jiazhou, et autres
Publié: (2024)
Toward Autonomous Laboratory Safety Monitoring with Vision Language Models: Learning to See Hazards Through Scene Structure
par: Chakraborty, Trishna, et autres
Publié: (2026)
par: Chakraborty, Trishna, et autres
Publié: (2026)
Evaluating Cascaded Methods of Vision-Language Models for Zero-Shot Detection and Association of Hardhats for Increased Construction Safety
par: Choi, Lucas, et autres
Publié: (2024)
par: Choi, Lucas, et autres
Publié: (2024)
INSIGHT: Enhancing Autonomous Driving Safety through Vision-Language Models on Context-Aware Hazard Detection and Edge Case Evaluation
par: Chen, Dianwei, et autres
Publié: (2025)
par: Chen, Dianwei, et autres
Publié: (2025)
HoliSafe: Holistic Safety Benchmarking and Modeling for Vision-Language Model
par: Lee, Youngwan, et autres
Publié: (2025)
par: Lee, Youngwan, et autres
Publié: (2025)
TSHA: A Benchmark for Visual Language Models in Trustworthy Safety Hazard Assessment Scenarios
par: Yu, Qiucheng, et autres
Publié: (2026)
par: Yu, Qiucheng, et autres
Publié: (2026)
SIA: Enhancing Safety via Intent Awareness for Vision-Language Models
par: Na, Youngjin, et autres
Publié: (2025)
par: Na, Youngjin, et autres
Publié: (2025)
Lingua-SafetyBench: A Benchmark for Safety Evaluation of Multilingual Vision-Language Models
par: Shi, Enyi, et autres
Publié: (2026)
par: Shi, Enyi, et autres
Publié: (2026)
A Vision-Language Foundation Model for Leaf Disease Identification
par: Quoc, Khang Nguyen, et autres
Publié: (2025)
par: Quoc, Khang Nguyen, et autres
Publié: (2025)
Towards a Multi-Agent Vision-Language System for Zero-Shot Novel Hazardous Object Detection for Autonomous Driving Safety
par: Shriram, Shashank, et autres
Publié: (2025)
par: Shriram, Shashank, et autres
Publié: (2025)
Safety Alignment for Vision Language Models
par: Liu, Zhendong, et autres
Publié: (2024)
par: Liu, Zhendong, et autres
Publié: (2024)
Beyond-Labels: Advancing Open-Vocabulary Segmentation With Vision-Language Models
par: Rahman, Muhammad Atta ur, et autres
Publié: (2025)
par: Rahman, Muhammad Atta ur, et autres
Publié: (2025)
JailBound: Jailbreaking Internal Safety Boundaries of Vision-Language Models
par: Song, Jiaxin, et autres
Publié: (2025)
par: Song, Jiaxin, et autres
Publié: (2025)
When Large Vision-Language Models Meet Person Re-Identification
par: Wang, Qizao, et autres
Publié: (2024)
par: Wang, Qizao, et autres
Publié: (2024)
VEAttack: Downstream-agnostic Vision Encoder Attack against Large Vision Language Models
par: Mei, Hefei, et autres
Publié: (2025)
par: Mei, Hefei, et autres
Publié: (2025)
Learning to Prompt with Text Only Supervision for Vision-Language Models
par: Khattak, Muhammad Uzair, et autres
Publié: (2024)
par: Khattak, Muhammad Uzair, et autres
Publié: (2024)
ScVLM: Enhancing Vision-Language Model for Safety-Critical Event Understanding
par: Shi, Liang, et autres
Publié: (2024)
par: Shi, Liang, et autres
Publié: (2024)
CLIP-HandID: Vision-Language Model for Hand-Based Person Identification
par: Baisa, Nathanael L., et autres
Publié: (2025)
par: Baisa, Nathanael L., et autres
Publié: (2025)
CILP-FGDI: Exploiting Vision-Language Model for Generalizable Person Re-Identification
par: Zhao, Huazhong, et autres
Publié: (2025)
par: Zhao, Huazhong, et autres
Publié: (2025)
An Application-Agnostic Automatic Target Recognition System Using Vision Language Models
par: Palladino, Anthony, et autres
Publié: (2024)
par: Palladino, Anthony, et autres
Publié: (2024)
Fast Certification of Vision-Language Models Using Incremental Randomized Smoothing
par: Nirala, A K, et autres
Publié: (2023)
par: Nirala, A K, et autres
Publié: (2023)
Contrastive-SDXL: Annotation-Preserving Night-Time Augmentation for Pedestrian Detection
par: George, Franky, et autres
Publié: (2026)
par: George, Franky, et autres
Publié: (2026)
Zero-shot Hazard Identification in Autonomous Driving: A Case Study on the COOOL Benchmark
par: Picek, Lukas, et autres
Publié: (2024)
par: Picek, Lukas, et autres
Publié: (2024)
Color Names in Vision-Language Models
par: Gomez-Villa, Alexandra, et autres
Publié: (2025)
par: Gomez-Villa, Alexandra, et autres
Publié: (2025)
Towards Calibrating Prompt Tuning of Vision-Language Models
par: Sharifdeen, Ashshak, et autres
Publié: (2026)
par: Sharifdeen, Ashshak, et autres
Publié: (2026)
Improving Large Vision and Language Models by Learning from a Panel of Peers
par: Hernandez, Jefferson, et autres
Publié: (2025)
par: Hernandez, Jefferson, et autres
Publié: (2025)
DPA: Dual Prototypes Alignment for Unsupervised Adaptation of Vision-Language Models
par: Ali, Eman, et autres
Publié: (2024)
par: Ali, Eman, et autres
Publié: (2024)
GEOBench-VLM: Benchmarking Vision-Language Models for Geospatial Tasks
par: Danish, Muhammad Sohail, et autres
Publié: (2024)
par: Danish, Muhammad Sohail, et autres
Publié: (2024)
Active Prompt Learning in Vision Language Models
par: Bang, Jihwan, et autres
Publié: (2023)
par: Bang, Jihwan, et autres
Publié: (2023)
DynaSplat: Dynamic-Static Gaussian Splatting with Hierarchical Motion Decomposition for Scene Reconstruction
par: Deng, Junli, et autres
Publié: (2025)
par: Deng, Junli, et autres
Publié: (2025)
GeoVLM: Improving Automated Vehicle Geolocalisation Using Vision-Language Matching
par: Dagda, Barkin, et autres
Publié: (2025)
par: Dagda, Barkin, et autres
Publié: (2025)
When Language Model Guides Vision: Grounding DINO for Cattle Muzzle Detection
par: Dulal, Rabin, et autres
Publié: (2025)
par: Dulal, Rabin, et autres
Publié: (2025)
O-TPT: Orthogonality Constraints for Calibrating Test-time Prompt Tuning in Vision-Language Models
par: Sharifdeen, Ashshak, et autres
Publié: (2025)
par: Sharifdeen, Ashshak, et autres
Publié: (2025)
Documents similaires
-
Integration of Object Detection and Small VLMs for Construction Safety Hazard Identification
par: Adil, Muhammad, et autres
Publié: (2026) -
TrajGATFormer: A Graph-Based Transformer Approach for Worker and Obstacle Trajectory Prediction in Off-site Construction Environments
par: Alduais, Mohammed, et autres
Publié: (2025) -
ErgoChat: a Visual Query System for the Ergonomic Risk Assessment of Construction Workers
par: Fan, Chao, et autres
Publié: (2024) -
Are Large Pre-trained Vision Language Models Effective Construction Safety Inspectors?
par: Chen, Xuezheng, et autres
Publié: (2025) -
HazardNet: A Small-Scale Vision Language Model for Real-Time Traffic Safety Detection at Edge Devices
par: Tami, Mohammad Abu, et autres
Publié: (2025)