Safe-Construct: Redefining Construction Safety Violation Recognition as 3D Multi-View Engagement Task
Fuente:
arXiv
Salvato in:
| Autori principali: | Chharia, Aviral, Ren, Tianyu, Furuhata, Tomotake, Shimada, Kenji |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MV-SSM: Multi-View State Space Modeling for 3D Human Pose Estimation
di: Chharia, Aviral, et al.
Pubblicazione: (2025)
di: Chharia, Aviral, et al.
Pubblicazione: (2025)
Multi-view Consistent 3D Gaussian Head Avatars 'without' Multi-view Generation
di: Chharia, Aviral, et al.
Pubblicazione: (2026)
di: Chharia, Aviral, et al.
Pubblicazione: (2026)
Hamba: Single-view 3D Hand Reconstruction with Graph-guided Bi-Scanning Mamba
di: Dong, Haoye, et al.
Pubblicazione: (2024)
di: Dong, Haoye, et al.
Pubblicazione: (2024)
Mono-Hydra++: Real-Time Monocular Scene Graph Construction with Multi-Task Learning for 3D Indoor Mapping
di: Udugama, U. V. B. L., et al.
Pubblicazione: (2026)
di: Udugama, U. V. B. L., et al.
Pubblicazione: (2026)
Human-VDM: Learning Single-Image 3D Human Gaussian Splatting from Video Diffusion Models
di: Liu, Zhibin, et al.
Pubblicazione: (2024)
di: Liu, Zhibin, et al.
Pubblicazione: (2024)
A Computer Vision Approach for Autonomous Cars to Drive Safe at Construction Zone
di: Ahammed, Abu Shad, et al.
Pubblicazione: (2024)
di: Ahammed, Abu Shad, et al.
Pubblicazione: (2024)
DVPE: Divided View Position Embedding for Multi-View 3D Object Detection
di: Wang, Jiasen, et al.
Pubblicazione: (2024)
di: Wang, Jiasen, et al.
Pubblicazione: (2024)
DSM: Constructing a Diverse Semantic Map for 3D Visual Grounding
di: Xie, Qinghongbing, et al.
Pubblicazione: (2025)
di: Xie, Qinghongbing, et al.
Pubblicazione: (2025)
UniScale: Unified Scale-Aware 3D Reconstruction for Multi-View Understanding via Prior Injection for Robotic Perception
di: Mahdavian, Mohammad, et al.
Pubblicazione: (2026)
di: Mahdavian, Mohammad, et al.
Pubblicazione: (2026)
SparseGrasp: Robotic Grasping via 3D Semantic Gaussian Splatting from Sparse Multi-View RGB Images
di: Yu, Junqiu, et al.
Pubblicazione: (2024)
di: Yu, Junqiu, et al.
Pubblicazione: (2024)
LS-HAR: Language Supervised Human Action Recognition with Salient Fusion, Construction Sites as a Use-Case
di: Mahdavian, Mohammad, et al.
Pubblicazione: (2024)
di: Mahdavian, Mohammad, et al.
Pubblicazione: (2024)
MM-Nav: Multi-View VLA Model for Robust Visual Navigation via Multi-Expert Learning
di: Xu, Tianyu, et al.
Pubblicazione: (2025)
di: Xu, Tianyu, et al.
Pubblicazione: (2025)
MAG-VLAQ: Multi-modal Aerial-Ground Query Aggregation for Cross-View Place Recognition
di: Xu, Zhengyi, et al.
Pubblicazione: (2026)
di: Xu, Zhengyi, et al.
Pubblicazione: (2026)
SToRe3D: Sparse Token Relevance in ViTs for Efficient Multi-View 3D Object Detection
di: Papais, Sandro, et al.
Pubblicazione: (2026)
di: Papais, Sandro, et al.
Pubblicazione: (2026)
Segmentation Dataset for Reinforced Concrete Construction
di: Schmidt, Patrick, et al.
Pubblicazione: (2024)
di: Schmidt, Patrick, et al.
Pubblicazione: (2024)
Robotic Arm Platform for Multi-View Image Acquisition and 3D Reconstruction in Minimally Invasive Surgery
di: Saikia, Alexander, et al.
Pubblicazione: (2024)
di: Saikia, Alexander, et al.
Pubblicazione: (2024)
Bridging Text and Vision: A Multi-View Text-Vision Registration Approach for Cross-Modal Place Recognition
di: Shang, Tianyi, et al.
Pubblicazione: (2025)
di: Shang, Tianyi, et al.
Pubblicazione: (2025)
LiDAR-EVS: Enhance Extrapolated View Synthesis for 3D Gaussian Splatting with Pseudo-LiDAR Supervision
di: Huang, Yiming, et al.
Pubblicazione: (2026)
di: Huang, Yiming, et al.
Pubblicazione: (2026)
FastOcc: Accelerating 3D Occupancy Prediction by Fusing the 2D Bird's-Eye View and Perspective View
di: Hou, Jiawei, et al.
Pubblicazione: (2024)
di: Hou, Jiawei, et al.
Pubblicazione: (2024)
Systematic Evaluation of Novel View Synthesis for Video Place Recognition
di: Mahmud, Muhammad Zawad, et al.
Pubblicazione: (2026)
di: Mahmud, Muhammad Zawad, et al.
Pubblicazione: (2026)
Multi-View Video Diffusion Policy: A 3D Spatio-Temporal-Aware Video Action Model
di: Li, Peiyan, et al.
Pubblicazione: (2026)
di: Li, Peiyan, et al.
Pubblicazione: (2026)
SLAM for Indoor Mapping of Wide Area Construction Environments
di: Ress, Vincent, et al.
Pubblicazione: (2024)
di: Ress, Vincent, et al.
Pubblicazione: (2024)
LM-MCVT: A Lightweight Multi-modal Multi-view Convolutional-Vision Transformer Approach for 3D Object Recognition
di: Xiong, Songsong, et al.
Pubblicazione: (2025)
di: Xiong, Songsong, et al.
Pubblicazione: (2025)
Efficient Multi-Task Scene Analysis with RGB-D Transformers
di: Fischedick, Söhnke Benedikt, et al.
Pubblicazione: (2023)
di: Fischedick, Söhnke Benedikt, et al.
Pubblicazione: (2023)
MrGS: Multi-modal Radiance Fields with 3D Gaussian Splatting for RGB-Thermal Novel View Synthesis
di: Kweon, Minseong, et al.
Pubblicazione: (2025)
di: Kweon, Minseong, et al.
Pubblicazione: (2025)
DreamGrasp: Zero-Shot 3D Multi-Object Reconstruction from Partial-View Images for Robotic Manipulation
di: Kim, Young Hun, et al.
Pubblicazione: (2025)
di: Kim, Young Hun, et al.
Pubblicazione: (2025)
Monocular Visual Place Recognition in LiDAR Maps via Cross-Modal State Space Model and Multi-View Matching
di: Yao, Gongxin, et al.
Pubblicazione: (2024)
di: Yao, Gongxin, et al.
Pubblicazione: (2024)
InspecSafe-V1: A Multimodal Benchmark for Safety Assessment in Industrial Inspection Scenarios
di: Liu, Zeyi, et al.
Pubblicazione: (2026)
di: Liu, Zeyi, et al.
Pubblicazione: (2026)
LiDAR-BEVMTN: Real-Time LiDAR Bird's-Eye View Multi-Task Perception Network for Autonomous Driving
di: Mohapatra, Sambit, et al.
Pubblicazione: (2023)
di: Mohapatra, Sambit, et al.
Pubblicazione: (2023)
When LLMs step into the 3D World: A Survey and Meta-Analysis of 3D Tasks via Multi-modal Large Language Models
di: Ma, Xianzheng, et al.
Pubblicazione: (2024)
di: Ma, Xianzheng, et al.
Pubblicazione: (2024)
DuoSpaceNet: Leveraging Both Bird's-Eye-View and Perspective View Representations for 3D Object Detection
di: Huang, Zhe, et al.
Pubblicazione: (2024)
di: Huang, Zhe, et al.
Pubblicazione: (2024)
Scalable 3D Registration via Truncated Entry-wise Absolute Residuals
di: Huang, Tianyu, et al.
Pubblicazione: (2024)
di: Huang, Tianyu, et al.
Pubblicazione: (2024)
Are Open-Vocabulary Models Ready for Detection of MEP Elements on Construction Sites
di: Abdalwhab, Abdalwhab, et al.
Pubblicazione: (2025)
di: Abdalwhab, Abdalwhab, et al.
Pubblicazione: (2025)
GrowSplat: Constructing Temporal Digital Twins of Plants with Gaussian Splats
di: Adebola, Simeon, et al.
Pubblicazione: (2025)
di: Adebola, Simeon, et al.
Pubblicazione: (2025)
BIM-Constrained Optimization for Accurate Localization and Deviation Correction in Construction Monitoring
di: Bikandi-Noya, Asier, et al.
Pubblicazione: (2025)
di: Bikandi-Noya, Asier, et al.
Pubblicazione: (2025)
Direct Robot Configuration Space Construction using Convolutional Encoder-Decoders
di: Benka, Christopher, et al.
Pubblicazione: (2023)
di: Benka, Christopher, et al.
Pubblicazione: (2023)
Impact of Localization Errors on Label Quality for Online HD Map Construction
di: Blumberg, Alexander, et al.
Pubblicazione: (2026)
di: Blumberg, Alexander, et al.
Pubblicazione: (2026)
Active 6D Pose Estimation for Textureless Objects using Multi-View RGB Frames
di: Yang, Jun, et al.
Pubblicazione: (2025)
di: Yang, Jun, et al.
Pubblicazione: (2025)
Learning to See and Act: Task-Aware Virtual View Exploration for Robotic Manipulation
di: Bai, Yongjie, et al.
Pubblicazione: (2025)
di: Bai, Yongjie, et al.
Pubblicazione: (2025)
Boundary Exploration of Next Best View Policy in 3D Robotic Scanning
di: Li, Leihui, et al.
Pubblicazione: (2024)
di: Li, Leihui, et al.
Pubblicazione: (2024)
Documenti analoghi
-
MV-SSM: Multi-View State Space Modeling for 3D Human Pose Estimation
di: Chharia, Aviral, et al.
Pubblicazione: (2025) -
Multi-view Consistent 3D Gaussian Head Avatars 'without' Multi-view Generation
di: Chharia, Aviral, et al.
Pubblicazione: (2026) -
Hamba: Single-view 3D Hand Reconstruction with Graph-guided Bi-Scanning Mamba
di: Dong, Haoye, et al.
Pubblicazione: (2024) -
Mono-Hydra++: Real-Time Monocular Scene Graph Construction with Multi-Task Learning for 3D Indoor Mapping
di: Udugama, U. V. B. L., et al.
Pubblicazione: (2026) -
Human-VDM: Learning Single-Image 3D Human Gaussian Splatting from Video Diffusion Models
di: Liu, Zhibin, et al.
Pubblicazione: (2024)