Building Safer Sites: A Large-Scale Multi-Level Dataset for Construction Safety Research
Fuente:
arXiv
Guardado en:
| Autores principales: | Ou, Zhenhui, Li, Dawei, Tan, Zhen, Li, Wenlin, Liu, Huan, Song, Siyuan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Safety Representations for Safer Policy Learning
por: Mani, Kaustubh, et al.
Publicado: (2025)
por: Mani, Kaustubh, et al.
Publicado: (2025)
BTS: Building Timeseries Dataset: Empowering Large-Scale Building Analytics
por: Prabowo, Arian, et al.
Publicado: (2024)
por: Prabowo, Arian, et al.
Publicado: (2024)
To See is Not to Learn: Protecting Multimodal Data from Unauthorized Fine-Tuning of Large Vision-Language Model
por: Zhao, Chengshuai, et al.
Publicado: (2026)
por: Zhao, Chengshuai, et al.
Publicado: (2026)
BuildingsBench: A Large-Scale Dataset of 900K Buildings and Benchmark for Short-Term Load Forecasting
por: Emami, Patrick, et al.
Publicado: (2023)
por: Emami, Patrick, et al.
Publicado: (2023)
GraphNet: A Large-Scale Computational Graph Dataset for Tensor Compiler Research
por: Li, Xinqi, et al.
Publicado: (2025)
por: Li, Xinqi, et al.
Publicado: (2025)
Safer by Diffusion, Broken by Context: Diffusion LLM's Safety Blessing and Its Failure Mode
por: He, Zeyuan, et al.
Publicado: (2026)
por: He, Zeyuan, et al.
Publicado: (2026)
M$^{3}$-20M: A Large-Scale Multi-Modal Molecule Dataset for AI-driven Drug Design and Discovery
por: Guo, Siyuan, et al.
Publicado: (2024)
por: Guo, Siyuan, et al.
Publicado: (2024)
A Large-Scale Dataset and Benchmark: Do Protein-Ligand Models Learn Binding Sites or Just Binding Likelihood?
por: Meng, Zhaohan, et al.
Publicado: (2026)
por: Meng, Zhaohan, et al.
Publicado: (2026)
GraphRCG: Self-Conditioned Graph Generation
por: Wang, Song, et al.
Publicado: (2024)
por: Wang, Song, et al.
Publicado: (2024)
Is Chain-of-Thought Reasoning of LLMs a Mirage? A Data Distribution Lens
por: Zhao, Chengshuai, et al.
Publicado: (2025)
por: Zhao, Chengshuai, et al.
Publicado: (2025)
Network Level Evaluation of Hangup Susceptibility of HRGCs using Deep Learning and Sensing Techniques: A Goal Towards Safer Future
por: Chatterjee, Kaustav, et al.
Publicado: (2025)
por: Chatterjee, Kaustav, et al.
Publicado: (2025)
Learning Recursive Multi-Scale Representations for Irregular Multivariate Time Series Forecasting
por: Li, Boyuan, et al.
Publicado: (2026)
por: Li, Boyuan, et al.
Publicado: (2026)
Are We Merely Justifying Results ex Post Facto? Quantifying Explanatory Inversion in Post-Hoc Model Explanations
por: Tan, Zhen, et al.
Publicado: (2025)
por: Tan, Zhen, et al.
Publicado: (2025)
The Quest for Efficient Reasoning: A Data-Centric Benchmark to CoT Distillation
por: Zhang, Ruichen, et al.
Publicado: (2025)
por: Zhang, Ruichen, et al.
Publicado: (2025)
Modeling Inverse Ellipsometry Problem via Flow Matching with a Large-Scale Dataset
por: Ma, Yiming, et al.
Publicado: (2024)
por: Ma, Yiming, et al.
Publicado: (2024)
Adaptive Multi-Scale Decomposition Framework for Time Series Forecasting
por: Hu, Yifan, et al.
Publicado: (2024)
por: Hu, Yifan, et al.
Publicado: (2024)
Soundness-Aware Level: A Microscopic Signature that Predicts LLM Reasoning Potential
por: Wu, Xuansheng, et al.
Publicado: (2025)
por: Wu, Xuansheng, et al.
Publicado: (2025)
Probing to Refine: Reinforcement Distillation of LLMs via Explanatory Inversion
por: Tan, Zhen, et al.
Publicado: (2026)
por: Tan, Zhen, et al.
Publicado: (2026)
Multi-Level GNN Preconditioner for Solving Large Scale Problems
por: Nastorg, Matthieu, et al.
Publicado: (2024)
por: Nastorg, Matthieu, et al.
Publicado: (2024)
Fairness in Multi-modal Medical Diagnosis with Demonstration Selection
por: Li, Dawei, et al.
Publicado: (2025)
por: Li, Dawei, et al.
Publicado: (2025)
Plan and Budget: Effective and Efficient Test-Time Scaling on Reasoning Large Language Models
por: Lin, Junhong, et al.
Publicado: (2025)
por: Lin, Junhong, et al.
Publicado: (2025)
The 'Sure' Trap: Multi-Scale Poisoning Analysis of Stealthy Compliance-Only Backdoors in Fine-Tuned Large Language Models
por: Tan, Yuting, et al.
Publicado: (2025)
por: Tan, Yuting, et al.
Publicado: (2025)
Virtual Fashion Photo-Shoots: Building a Large-Scale Garment-Lookbook Dataset
por: Hauri, Yannick, et al.
Publicado: (2025)
por: Hauri, Yannick, et al.
Publicado: (2025)
GV-Rep: A Large-Scale Dataset for Genetic Variant Representation Learning
por: Li, Zehui, et al.
Publicado: (2024)
por: Li, Zehui, et al.
Publicado: (2024)
Wukong: Towards a Scaling Law for Large-Scale Recommendation
por: Zhang, Buyun, et al.
Publicado: (2024)
por: Zhang, Buyun, et al.
Publicado: (2024)
Inference-Time Scaling of Discrete Diffusion Models via Importance Weighting and Optimal Proposal Design
por: Ou, Zijing, et al.
Publicado: (2025)
por: Ou, Zijing, et al.
Publicado: (2025)
Variance-Adaptive Muon: Accelerating LLM Pretraining with NSR-Modulated and Variance-Scaled Momentum
por: Li, Jingru, et al.
Publicado: (2026)
por: Li, Jingru, et al.
Publicado: (2026)
EQA-RM: A Generative Embodied Reward Model with Test-time Scaling
por: Chen, Yuhang, et al.
Publicado: (2025)
por: Chen, Yuhang, et al.
Publicado: (2025)
An End-to-End Framework for Building Large Language Models for Software Operations
por: He, Jingkai, et al.
Publicado: (2026)
por: He, Jingkai, et al.
Publicado: (2026)
Modeling Robotics Dataset Construction as an Artifact-Based Build Process
por: Pohl, Leon, et al.
Publicado: (2026)
por: Pohl, Leon, et al.
Publicado: (2026)
Yambda-5B -- A Large-Scale Multi-modal Dataset for Ranking And Retrieval
por: Ploshkin, A., et al.
Publicado: (2025)
por: Ploshkin, A., et al.
Publicado: (2025)
SafeNeuron: Neuron-Level Safety Alignment for Large Language Models
por: Wang, Zhaoxin, et al.
Publicado: (2026)
por: Wang, Zhaoxin, et al.
Publicado: (2026)
Multi-Level Safety Continual Projection for Fine-Tuned Large Language Models without Retraining
por: Han, Bing, et al.
Publicado: (2025)
por: Han, Bing, et al.
Publicado: (2025)
Pruning Unsafe Tickets: A Resource-Efficient Framework for Safer and More Robust LLMs
por: Si, Wai Man, et al.
Publicado: (2026)
por: Si, Wai Man, et al.
Publicado: (2026)
Beyond Redundancy: Diverse and Specialized Multi-Expert Sparse Autoencoder
por: Xu, Zhen, et al.
Publicado: (2025)
por: Xu, Zhen, et al.
Publicado: (2025)
Generative Models for Synthetic Data: Transforming Data Mining in the GenAI Era
por: Li, Dawei, et al.
Publicado: (2025)
por: Li, Dawei, et al.
Publicado: (2025)
Exploring Large Language Models for Feature Selection: A Data-centric Perspective
por: Li, Dawei, et al.
Publicado: (2024)
por: Li, Dawei, et al.
Publicado: (2024)
CEB: Compositional Evaluation Benchmark for Fairness in Large Language Models
por: Wang, Song, et al.
Publicado: (2024)
por: Wang, Song, et al.
Publicado: (2024)
Larger Datasets Can Be Repeated More: A Theoretical Analysis of Multi-Epoch Scaling in Linear Regression
por: Yan, Tingkai, et al.
Publicado: (2025)
por: Yan, Tingkai, et al.
Publicado: (2025)
SimVPv2: Towards Simple yet Powerful Spatiotemporal Predictive Learning
por: Tan, Cheng, et al.
Publicado: (2022)
por: Tan, Cheng, et al.
Publicado: (2022)
Ejemplares similares
-
Safety Representations for Safer Policy Learning
por: Mani, Kaustubh, et al.
Publicado: (2025) -
BTS: Building Timeseries Dataset: Empowering Large-Scale Building Analytics
por: Prabowo, Arian, et al.
Publicado: (2024) -
To See is Not to Learn: Protecting Multimodal Data from Unauthorized Fine-Tuning of Large Vision-Language Model
por: Zhao, Chengshuai, et al.
Publicado: (2026) -
BuildingsBench: A Large-Scale Dataset of 900K Buildings and Benchmark for Short-Term Load Forecasting
por: Emami, Patrick, et al.
Publicado: (2023) -
GraphNet: A Large-Scale Computational Graph Dataset for Tensor Compiler Research
por: Li, Xinqi, et al.
Publicado: (2025)