Classification of Safety Events at Nuclear Sites using Large Language Models
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | de Costa, Mishca, Anwar, Muhammad, Lau, Daniel, Hammad, Issam |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Towards Secure and Private Language Models for Nuclear Power Plants
von: Anwar, Muhammad, et al.
Veröffentlicht: (2025)
von: Anwar, Muhammad, et al.
Veröffentlicht: (2025)
Unlocking the Potential of Large Language Models in the Nuclear Industry with Synthetic Data
von: Anwar, Muhammad, et al.
Veröffentlicht: (2025)
von: Anwar, Muhammad, et al.
Veröffentlicht: (2025)
Enhancing Accuracy and Maintainability in Nuclear Plant Data Retrieval: A Function-Calling LLM Approach Over NL-to-SQL
von: de Costa, Mishca, et al.
Veröffentlicht: (2025)
von: de Costa, Mishca, et al.
Veröffentlicht: (2025)
Evaluating ChatGPT on Nuclear Domain-Specific Data
von: Anwar, Muhammad, et al.
Veröffentlicht: (2024)
von: Anwar, Muhammad, et al.
Veröffentlicht: (2024)
Lightweight Safety Classification Using Pruned Language Models
von: Sawtell, Mason, et al.
Veröffentlicht: (2024)
von: Sawtell, Mason, et al.
Veröffentlicht: (2024)
Training Large Language Models to Predict Clinical Events
von: Turtel, Benjamin, et al.
Veröffentlicht: (2026)
von: Turtel, Benjamin, et al.
Veröffentlicht: (2026)
Foundational Challenges in Assuring Alignment and Safety of Large Language Models
von: Anwar, Usman, et al.
Veröffentlicht: (2024)
von: Anwar, Usman, et al.
Veröffentlicht: (2024)
Large Language Model Enhanced Clustering for News Event Detection
von: Tarekegn, Adane Nega
Veröffentlicht: (2024)
von: Tarekegn, Adane Nega
Veröffentlicht: (2024)
SPIN: Sparsifying and Integrating Internal Neurons in Large Language Models for Text Classification
von: Jiao, Difan, et al.
Veröffentlicht: (2023)
von: Jiao, Difan, et al.
Veröffentlicht: (2023)
Improving Large Language Model Safety with Contrastive Representation Learning
von: Simko, Samuel, et al.
Veröffentlicht: (2025)
von: Simko, Samuel, et al.
Veröffentlicht: (2025)
Adversarial Reinforcement Learning for Large Language Model Agent Safety
von: Wang, Zizhao, et al.
Veröffentlicht: (2025)
von: Wang, Zizhao, et al.
Veröffentlicht: (2025)
AraLingBench A Human-Annotated Benchmark for Evaluating Arabic Linguistic Capabilities of Large Language Models
von: Zbeeb, Mohammad, et al.
Veröffentlicht: (2025)
von: Zbeeb, Mohammad, et al.
Veröffentlicht: (2025)
Emulated Disalignment: Safety Alignment for Large Language Models May Backfire!
von: Zhou, Zhanhui, et al.
Veröffentlicht: (2024)
von: Zhou, Zhanhui, et al.
Veröffentlicht: (2024)
Semi-Supervised Learning for Large Language Models Safety and Content Moderation
von: Dinuta, Eduard Stefan, et al.
Veröffentlicht: (2025)
von: Dinuta, Eduard Stefan, et al.
Veröffentlicht: (2025)
Noise Injection Systemically Degrades Large Language Model Safety Guardrails
von: Shahani, Prithviraj Singh, et al.
Veröffentlicht: (2025)
von: Shahani, Prithviraj Singh, et al.
Veröffentlicht: (2025)
Reducing Large Language Model Safety Risks in Women's Health using Semantic Entropy
von: Penny-Dimri, Jahan C., et al.
Veröffentlicht: (2025)
von: Penny-Dimri, Jahan C., et al.
Veröffentlicht: (2025)
Remember This Event That Year? Assessing Temporal Information and Reasoning in Large Language Models
von: Beniwal, Himanshu, et al.
Veröffentlicht: (2024)
von: Beniwal, Himanshu, et al.
Veröffentlicht: (2024)
Data Advisor: Dynamic Data Curation for Safety Alignment of Large Language Models
von: Wang, Fei, et al.
Veröffentlicht: (2024)
von: Wang, Fei, et al.
Veröffentlicht: (2024)
A Single Neuron Is Sufficient to Bypass Safety Alignment in Large Language Models
von: Kazemi, Hamid, et al.
Veröffentlicht: (2026)
von: Kazemi, Hamid, et al.
Veröffentlicht: (2026)
Fundamental Safety-Capability Trade-offs in Fine-tuning Large Language Models
von: Chen, Pin-Yu, et al.
Veröffentlicht: (2025)
von: Chen, Pin-Yu, et al.
Veröffentlicht: (2025)
Paraphrase and Aggregate with Large Language Models for Minimizing Intent Classification Errors
von: Yadav, Vikas, et al.
Veröffentlicht: (2024)
von: Yadav, Vikas, et al.
Veröffentlicht: (2024)
Label-free Node Classification on Graphs with Large Language Models (LLMS)
von: Chen, Zhikai, et al.
Veröffentlicht: (2023)
von: Chen, Zhikai, et al.
Veröffentlicht: (2023)
Automated ICD Classification of Psychiatric Diagnoses: From Classical NLP to Large Language Models
von: Ortega, Fernando, et al.
Veröffentlicht: (2026)
von: Ortega, Fernando, et al.
Veröffentlicht: (2026)
Qalb: Largest State-of-the-Art Urdu Large Language Model for 230M Speakers with Systematic Continued Pre-training
von: Hassan, Muhammad Taimoor, et al.
Veröffentlicht: (2026)
von: Hassan, Muhammad Taimoor, et al.
Veröffentlicht: (2026)
LAMPO: Large Language Models as Preference Machines for Few-shot Ordinal Classification
von: Qin, Zhen, et al.
Veröffentlicht: (2024)
von: Qin, Zhen, et al.
Veröffentlicht: (2024)
Iterative Learning of Computable Phenotypes for Treatment Resistant Hypertension using Large Language Models
von: Aldeia, Guilherme Seidyo Imai, et al.
Veröffentlicht: (2025)
von: Aldeia, Guilherme Seidyo Imai, et al.
Veröffentlicht: (2025)
UniGuard: Towards Universal Safety Guardrails for Jailbreak Attacks on Multimodal Large Language Models
von: Oh, Sejoon, et al.
Veröffentlicht: (2024)
von: Oh, Sejoon, et al.
Veröffentlicht: (2024)
Causality Extraction from Nuclear Licensee Event Reports Using a Hybrid Framework
von: Sohag, Shahidur Rahoman, et al.
Veröffentlicht: (2024)
von: Sohag, Shahidur Rahoman, et al.
Veröffentlicht: (2024)
Revisiting Prompt Sensitivity in Large Language Models for Text Classification: The Role of Prompt Underspecification
von: Pecher, Branislav, et al.
Veröffentlicht: (2026)
von: Pecher, Branislav, et al.
Veröffentlicht: (2026)
Advancing Event Forecasting through Massive Training of Large Language Models: Challenges, Solutions, and Broader Impacts
von: Lee, Sang-Woo, et al.
Veröffentlicht: (2025)
von: Lee, Sang-Woo, et al.
Veröffentlicht: (2025)
QLESS: A Quantized Approach for Data Valuation and Selection in Large Language Model Fine-Tuning
von: Ananta, Moses, et al.
Veröffentlicht: (2025)
von: Ananta, Moses, et al.
Veröffentlicht: (2025)
Demystifying Embedding Spaces using Large Language Models
von: Tennenholtz, Guy, et al.
Veröffentlicht: (2023)
von: Tennenholtz, Guy, et al.
Veröffentlicht: (2023)
Evaluating the Factuality of Large Language Models using Large-Scale Knowledge Graphs
von: Liu, Xiaoze, et al.
Veröffentlicht: (2024)
von: Liu, Xiaoze, et al.
Veröffentlicht: (2024)
Multilingual Hate Speech Detection in Social Media Using Translation-Based Approaches with Large Language Models
von: Usman, Muhammad, et al.
Veröffentlicht: (2025)
von: Usman, Muhammad, et al.
Veröffentlicht: (2025)
On the Role of Attention Heads in Large Language Model Safety
von: Zhou, Zhenhong, et al.
Veröffentlicht: (2024)
von: Zhou, Zhenhong, et al.
Veröffentlicht: (2024)
Fine-tuning Language Models with Generative Adversarial Reward Modelling
von: Yu, Zhang Ze, et al.
Veröffentlicht: (2023)
von: Yu, Zhang Ze, et al.
Veröffentlicht: (2023)
Large Language Models for Automating Clinical Data Standardization: HL7 FHIR Use Case
von: Riquelme, Alvaro, et al.
Veröffentlicht: (2025)
von: Riquelme, Alvaro, et al.
Veröffentlicht: (2025)
ResumeAtlas: Revisiting Resume Classification with Large-Scale Datasets and Large Language Models
von: Heakl, Ahmed, et al.
Veröffentlicht: (2024)
von: Heakl, Ahmed, et al.
Veröffentlicht: (2024)
Neurons Speak in Ranges: Breaking Free from Discrete Neuronal Attribution
von: Haider, Muhammad Umair, et al.
Veröffentlicht: (2025)
von: Haider, Muhammad Umair, et al.
Veröffentlicht: (2025)
Explingo: Explaining AI Predictions using Large Language Models
von: Zytek, Alexandra, et al.
Veröffentlicht: (2024)
von: Zytek, Alexandra, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Towards Secure and Private Language Models for Nuclear Power Plants
von: Anwar, Muhammad, et al.
Veröffentlicht: (2025) -
Unlocking the Potential of Large Language Models in the Nuclear Industry with Synthetic Data
von: Anwar, Muhammad, et al.
Veröffentlicht: (2025) -
Enhancing Accuracy and Maintainability in Nuclear Plant Data Retrieval: A Function-Calling LLM Approach Over NL-to-SQL
von: de Costa, Mishca, et al.
Veröffentlicht: (2025) -
Evaluating ChatGPT on Nuclear Domain-Specific Data
von: Anwar, Muhammad, et al.
Veröffentlicht: (2024) -
Lightweight Safety Classification Using Pruned Language Models
von: Sawtell, Mason, et al.
Veröffentlicht: (2024)