Passive Construction Site Safety Monitoring via Persona-Scaffolded Adversarial Chain-of-Thought VLM Verification
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Sriram, Ananth, Mokaria, Neel, Singh, Rajveer |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Safety Assessment of Scaffolding on Construction Site using AI
par: Prabhu, Sameer, et autres
Publié: (2025)
par: Prabhu, Sameer, et autres
Publié: (2025)
VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought
par: Jiang, Chaoya, et autres
Publié: (2025)
par: Jiang, Chaoya, et autres
Publié: (2025)
MonitorVLM:A Vision Language Framework for Safety Violation Detection in Mining Operations
par: Wu, Jiang, et autres
Publié: (2025)
par: Wu, Jiang, et autres
Publié: (2025)
GTR: Guided Thought Reinforcement Prevents Thought Collapse in RL-based VLM Agent Training
par: Wei, Tong, et autres
Publié: (2025)
par: Wei, Tong, et autres
Publié: (2025)
PRIMEDrive-CoT: A Precognitive Chain-of-Thought Framework for Uncertainty-Aware Object Interaction in Driving Scene Scenario
par: Mandalika, Sriram, et autres
Publié: (2025)
par: Mandalika, Sriram, et autres
Publié: (2025)
Construction Site Scaffolding Completeness Detection Based on Mask R-CNN and Hough Transform
par: Lin, Pei-Hsin, et autres
Publié: (2025)
par: Lin, Pei-Hsin, et autres
Publié: (2025)
Imitation Game for Adversarial Disillusion with Chain-of-Thought Reasoning in Generative AI
par: Chang, Ching-Chun, et autres
Publié: (2025)
par: Chang, Ching-Chun, et autres
Publié: (2025)
Better Eyes, Better Thoughts: Why Vision Chain-of-Thought Fails in Medicine
par: Wu, Yuan, et autres
Publié: (2026)
par: Wu, Yuan, et autres
Publié: (2026)
RSVP: Reasoning Segmentation via Visual Prompting and Multi-modal Chain-of-Thought
par: Lu, Yi, et autres
Publié: (2025)
par: Lu, Yi, et autres
Publié: (2025)
VG-CoT: Towards Trustworthy Visual Reasoning via Grounded Chain-of-Thought
par: Lim, Byeonggeuk, et autres
Publié: (2026)
par: Lim, Byeonggeuk, et autres
Publié: (2026)
Generative Adversarial Perturbations with Cross-paradigm Transferability on Localized Crowd Counting
par: Anisha, Alabi Mehzabin, et autres
Publié: (2026)
par: Anisha, Alabi Mehzabin, et autres
Publié: (2026)
DUET-VLM: Dual stage Unified Efficient Token reduction for VLM Training and Inference
par: Singh, Aditya Kumar, et autres
Publié: (2026)
par: Singh, Aditya Kumar, et autres
Publié: (2026)
Visual Self-Fulfilling Alignment: Shaping Safety-Oriented Personas via Threat-Related Images
par: Yang, Qishun, et autres
Publié: (2026)
par: Yang, Qishun, et autres
Publié: (2026)
Reinforcing Structured Chain-of-Thought for Video Understanding
par: Wang, Peiyao, et autres
Publié: (2026)
par: Wang, Peiyao, et autres
Publié: (2026)
An Organic Weed Control Prototype using Directed Energy and Deep Learning
par: Cao, Deng, et autres
Publié: (2024)
par: Cao, Deng, et autres
Publié: (2024)
Controllable Navigation Instruction Generation with Chain of Thought Prompting
par: Kong, Xianghao, et autres
Publié: (2024)
par: Kong, Xianghao, et autres
Publié: (2024)
Enhancing Construction Site Safety: A Lightweight Convolutional Network for Effective Helmet Detection
par: Alif, Mujadded Al Rabbani
Publié: (2024)
par: Alif, Mujadded Al Rabbani
Publié: (2024)
Let's Think with Images Efficiently! An Interleaved-Modal Chain-of-Thought Reasoning Framework with Dynamic and Precise Visual Thoughts
par: Liu, Xu, et autres
Publié: (2026)
par: Liu, Xu, et autres
Publié: (2026)
Can Segmentation Models Understand the World? Towards Proactive Affordance Reasoning via Visual Chain-of-Thought
par: Guo, Yuchen, et autres
Publié: (2026)
par: Guo, Yuchen, et autres
Publié: (2026)
VISTA: Mitigating Semantic Inertia in Video-LLMs via Training-Free Dynamic Chain-of-Thought Routing
par: Jin, Hongbo, et autres
Publié: (2025)
par: Jin, Hongbo, et autres
Publié: (2025)
Theorem-Validated Reverse Chain-of-Thought Problem Generation for Geometric Reasoning
par: Deng, Linger, et autres
Publié: (2024)
par: Deng, Linger, et autres
Publié: (2024)
Revisiting the Necessity of Lengthy Chain-of-Thought in Vision-centric Reasoning Generalization
par: Du, Yifan, et autres
Publié: (2025)
par: Du, Yifan, et autres
Publié: (2025)
Chain-of-Thought Degrades Visual Spatial Reasoning Capabilities of Multimodal LLMs
par: Kancheti, Sai Srinivas, et autres
Publié: (2026)
par: Kancheti, Sai Srinivas, et autres
Publié: (2026)
Thought-For-Food: Reasoning Chain Induced Food Visual Question Answering
par: Jain, Riddhi, et autres
Publié: (2025)
par: Jain, Riddhi, et autres
Publié: (2025)
Multimodal Chain-of-Thought Reasoning in Language Models
par: Zhang, Zhuosheng, et autres
Publié: (2023)
par: Zhang, Zhuosheng, et autres
Publié: (2023)
Interleaved-Modal Chain-of-Thought
par: Gao, Jun, et autres
Publié: (2024)
par: Gao, Jun, et autres
Publié: (2024)
VLM Agents Generate Their Own Memories: Distilling Experience into Embodied Programs of Thought
par: Sarch, Gabriel, et autres
Publié: (2024)
par: Sarch, Gabriel, et autres
Publié: (2024)
VLM-AutoDrive: Post-Training Vision-Language Models for Safety-Critical Autonomous Driving Events
par: Bhat, Mohammad Qazim, et autres
Publié: (2026)
par: Bhat, Mohammad Qazim, et autres
Publié: (2026)
PSA-VLM: Enhancing Vision-Language Model Safety through Progressive Concept-Bottleneck-Driven Alignment
par: Liu, Zhendong, et autres
Publié: (2024)
par: Liu, Zhendong, et autres
Publié: (2024)
VLM-Guard: Safeguarding Vision-Language Models via Fulfilling Safety Alignment Gap
par: Liu, Qin, et autres
Publié: (2025)
par: Liu, Qin, et autres
Publié: (2025)
GeoChain: Multimodal Chain-of-Thought for Geographic Reasoning
par: Yerramilli, Sahiti, et autres
Publié: (2025)
par: Yerramilli, Sahiti, et autres
Publié: (2025)
MultiMorph: On-demand Atlas Construction
par: Abulnaga, S. Mazdak, et autres
Publié: (2025)
par: Abulnaga, S. Mazdak, et autres
Publié: (2025)
Beyond Static Visual Tokens: Structured Sequential Visual Chain-of-Thought Reasoning
par: Guo, Guangfu, et autres
Publié: (2026)
par: Guo, Guangfu, et autres
Publié: (2026)
CoRGI: Verified Chain-of-Thought Reasoning with Post-hoc Visual Grounding
par: Yi, Shixin, et autres
Publié: (2025)
par: Yi, Shixin, et autres
Publié: (2025)
SceneCOT: Eliciting Grounded Chain-of-Thought Reasoning in 3D Scenes
par: Linghu, Xiongkun, et autres
Publié: (2025)
par: Linghu, Xiongkun, et autres
Publié: (2025)
Diversity Over Frequency: Rethinking Tool Use in Visual Chain-of-Thought Agents
par: Kim, Dong-Hee, et autres
Publié: (2026)
par: Kim, Dong-Hee, et autres
Publié: (2026)
Retrieval-Based Interleaved Visual Chain-of-Thought in Real-World Driving Scenarios
par: Corbière, Charles, et autres
Publié: (2025)
par: Corbière, Charles, et autres
Publié: (2025)
Chart-R1: Chain-of-Thought Supervision and Reinforcement for Advanced Chart Reasoner
par: Chen, Lei, et autres
Publié: (2025)
par: Chen, Lei, et autres
Publié: (2025)
SeqVLM: Proposal-Guided Multi-View Sequences Reasoning via VLM for Zero-Shot 3D Visual Grounding
par: Lin, Jiawen, et autres
Publié: (2025)
par: Lin, Jiawen, et autres
Publié: (2025)
Few-Shot VLM-Based G-Code and HMI Verification in CNC Machining
par: Pour, Yasaman Hashem, et autres
Publié: (2025)
par: Pour, Yasaman Hashem, et autres
Publié: (2025)
Documents similaires
-
Safety Assessment of Scaffolding on Construction Site using AI
par: Prabhu, Sameer, et autres
Publié: (2025) -
VLM-R$^3$: Region Recognition, Reasoning, and Refinement for Enhanced Multimodal Chain-of-Thought
par: Jiang, Chaoya, et autres
Publié: (2025) -
MonitorVLM:A Vision Language Framework for Safety Violation Detection in Mining Operations
par: Wu, Jiang, et autres
Publié: (2025) -
GTR: Guided Thought Reinforcement Prevents Thought Collapse in RL-based VLM Agent Training
par: Wei, Tong, et autres
Publié: (2025) -
PRIMEDrive-CoT: A Precognitive Chain-of-Thought Framework for Uncertainty-Aware Object Interaction in Driving Scene Scenario
par: Mandalika, Sriram, et autres
Publié: (2025)