Prompt-and-Check: Using Large Language Models to Evaluate Communication Protocol Compliance in Simulation-Based Training
Fuente:
arXiv
Saved in:
| Main Authors: | Lall, Vishakha, Liu, Yisi |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
AI Meets Maritime Training: Precision Analytics for Enhanced Safety and Performance
by: Lall, Vishakha, et al.
Published: (2025)
by: Lall, Vishakha, et al.
Published: (2025)
Contextual Biasing to Improve Domain-specific Custom Vocabulary Audio Transcription without Explicit Fine-Tuning of Whisper Model
by: Lall, Vishakha, et al.
Published: (2024)
by: Lall, Vishakha, et al.
Published: (2024)
Dynamic Stress Detection: A Study of Temporal Progression Modelling of Stress in Speech
by: Lall, Vishakha, et al.
Published: (2025)
by: Lall, Vishakha, et al.
Published: (2025)
Eyes on Target: Gaze-Aware Object Detection in Egocentric Video
by: Lall, Vishakha, et al.
Published: (2025)
by: Lall, Vishakha, et al.
Published: (2025)
Large Language Model-Driven Code Compliance Checking in Building Information Modeling
by: Madireddy, Soumya, et al.
Published: (2025)
by: Madireddy, Soumya, et al.
Published: (2025)
Prompt Codebooks: Discrete Compositional Optimization for Language Model Instruction Refinement
by: Nath, Jyotirmoy, et al.
Published: (2026)
by: Nath, Jyotirmoy, et al.
Published: (2026)
Evaluating Compliance with Visualization Guidelines in Diagrams for Scientific Publications Using Large Vision Language Models
by: Rückert, Johannes, et al.
Published: (2025)
by: Rückert, Johannes, et al.
Published: (2025)
Automated Facility Enumeration for Building Compliance Checking using Door Detection and Large Language Models
by: Zhang, Licheng, et al.
Published: (2025)
by: Zhang, Licheng, et al.
Published: (2025)
Legal Compliance Evaluation of Smart Contracts Generated By Large Language Models
by: Wijayakoon, Chanuka, et al.
Published: (2025)
by: Wijayakoon, Chanuka, et al.
Published: (2025)
Application and Optimization of Large Models Based on Prompt Tuning for Fact-Check-Worthiness Estimation
by: Yu, Yinglong, et al.
Published: (2025)
by: Yu, Yinglong, et al.
Published: (2025)
Rationality Check! Benchmarking the Rationality of Large Language Models
by: Zhou, Zhilun, et al.
Published: (2025)
by: Zhou, Zhilun, et al.
Published: (2025)
Bounded PCTL Model Checking of Large Language Model Outputs
by: Gross, Dennis, et al.
Published: (2025)
by: Gross, Dennis, et al.
Published: (2025)
Continual Learning Using Only Large Language Model Prompting
by: Qiu, Jiabao, et al.
Published: (2024)
by: Qiu, Jiabao, et al.
Published: (2024)
From Prompt to Protocol: Fast Charging Batteries with Large Language Models
by: Lei, Ge, et al.
Published: (2026)
by: Lei, Ge, et al.
Published: (2026)
TierCheck: Tiered Checkpointing for Fault Tolerance in Large Language Model Training
by: Han, Shujie, et al.
Published: (2026)
by: Han, Shujie, et al.
Published: (2026)
An Evaluation of Large Language Models on Text Summarization Tasks Using Prompt Engineering Techniques
by: Aly, Walid Mohamed, et al.
Published: (2025)
by: Aly, Walid Mohamed, et al.
Published: (2025)
Evaluating Named Entity Recognition Using Few-Shot Prompting with Large Language Models
by: Zeghidi, Hédi, et al.
Published: (2024)
by: Zeghidi, Hédi, et al.
Published: (2024)
Rule Encoding and Compliance in Large Language Models: An Information-Theoretic Analysis
by: Diederich, Joachim
Published: (2025)
by: Diederich, Joachim
Published: (2025)
Deconstructing Instruction-Following: A New Benchmark for Granular Evaluation of Large Language Model Instruction Compliance Abilities
by: Purpura, Alberto, et al.
Published: (2026)
by: Purpura, Alberto, et al.
Published: (2026)
LEAF: Learning and Evaluation Augmented by Fact-Checking to Improve Factualness in Large Language Models
by: Tran, Hieu, et al.
Published: (2024)
by: Tran, Hieu, et al.
Published: (2024)
Evaluating the Prompt Steerability of Large Language Models
by: Miehling, Erik, et al.
Published: (2024)
by: Miehling, Erik, et al.
Published: (2024)
Evaluation of Prompt Injection Defenses in Large Language Models
by: Deep, Priyal, et al.
Published: (2026)
by: Deep, Priyal, et al.
Published: (2026)
SoK: Taxonomy and Evaluation of Prompt Security in Large Language Models
by: Hong, Hanbin, et al.
Published: (2025)
by: Hong, Hanbin, et al.
Published: (2025)
PromptBridge: Cross-Model Prompt Transfer for Large Language Models
by: Wang, Yaxuan, et al.
Published: (2025)
by: Wang, Yaxuan, et al.
Published: (2025)
The Refusal--Compliance Tradeoff: A Large-Scale Safety Behavior Audit of Large Language Models
by: Hasan, Alif Al, et al.
Published: (2026)
by: Hasan, Alif Al, et al.
Published: (2026)
DePrompt: Desensitization and Evaluation of Personal Identifiable Information in Large Language Model Prompts
by: Sun, Xiongtao, et al.
Published: (2024)
by: Sun, Xiongtao, et al.
Published: (2024)
Compliance versus Sensibility: On the Reasoning Controllability in Large Language Models
by: Tan, Xingwei, et al.
Published: (2026)
by: Tan, Xingwei, et al.
Published: (2026)
Enhancing Legal Compliance and Regulation Analysis with Large Language Models
by: Hassani, Shabnam
Published: (2024)
by: Hassani, Shabnam
Published: (2024)
TrumorGPT: Graph-Based Retrieval-Augmented Large Language Model for Fact-Checking
by: Hang, Ching Nam, et al.
Published: (2025)
by: Hang, Ching Nam, et al.
Published: (2025)
Representing Normative Regulations in OWL DL for Automated Compliance Checking Supported by Text Annotation
by: Baimuratov, Ildar, et al.
Published: (2025)
by: Baimuratov, Ildar, et al.
Published: (2025)
From COBIT to ISO 42001: Evaluating Cybersecurity Frameworks for Opportunities, Risks, and Regulatory Compliance in Commercializing Large Language Models
by: McIntosh, Timothy R., et al.
Published: (2024)
by: McIntosh, Timothy R., et al.
Published: (2024)
Prompt-Based Value Steering of Large Language Models
by: Abbo, Giulio Antonio, et al.
Published: (2025)
by: Abbo, Giulio Antonio, et al.
Published: (2025)
Prompting Large Language Models for Training-Free Non-Intrusive Load Monitoring
by: Xue, Junyu, et al.
Published: (2025)
by: Xue, Junyu, et al.
Published: (2025)
The Prompt Canvas: A Literature-Based Practitioner Guide for Creating Effective Prompts in Large Language Models
by: Hewing, Michael, et al.
Published: (2024)
by: Hewing, Michael, et al.
Published: (2024)
Brain Surgery: Ensuring GDPR Compliance in Large Language Models via Concept Erasure
by: Laurelli, Michele
Published: (2024)
by: Laurelli, Michele
Published: (2024)
Hallucination to Truth: A Review of Fact-Checking and Factuality Evaluation in Large Language Models
by: Rahman, Subhey Sadi, et al.
Published: (2025)
by: Rahman, Subhey Sadi, et al.
Published: (2025)
RealFactBench: A Benchmark for Evaluating Large Language Models in Real-World Fact-Checking
by: Yang, Shuo, et al.
Published: (2025)
by: Yang, Shuo, et al.
Published: (2025)
See&Trek: Training-Free Spatial Prompting for Multimodal Large Language Model
by: Li, Pengteng, et al.
Published: (2025)
by: Li, Pengteng, et al.
Published: (2025)
Responsible AI in Construction Safety: Systematic Evaluation of Large Language Models and Prompt Engineering
by: Sammour, Farouq, et al.
Published: (2024)
by: Sammour, Farouq, et al.
Published: (2024)
Embedding with Large Language Models for Classification of HIPAA Safeguard Compliance Rules
by: Rahman, Md Abdur, et al.
Published: (2024)
by: Rahman, Md Abdur, et al.
Published: (2024)
Similar Items
-
AI Meets Maritime Training: Precision Analytics for Enhanced Safety and Performance
by: Lall, Vishakha, et al.
Published: (2025) -
Contextual Biasing to Improve Domain-specific Custom Vocabulary Audio Transcription without Explicit Fine-Tuning of Whisper Model
by: Lall, Vishakha, et al.
Published: (2024) -
Dynamic Stress Detection: A Study of Temporal Progression Modelling of Stress in Speech
by: Lall, Vishakha, et al.
Published: (2025) -
Eyes on Target: Gaze-Aware Object Detection in Egocentric Video
by: Lall, Vishakha, et al.
Published: (2025) -
Large Language Model-Driven Code Compliance Checking in Building Information Modeling
by: Madireddy, Soumya, et al.
Published: (2025)