Explainable Compliance Detection with Multi-Hop Natural Language Inference on Assurance Case Structure
Fuente:
arXiv
Saved in:
| Main Authors: | Ikhwantri, Fariz, Marijan, Dusica |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Evaluating Assurance Cases as Text-Attributed Graphs for Structure and Provenance Analysis
by: Ikhwantri, Fariz, et al.
Published: (2026)
by: Ikhwantri, Fariz, et al.
Published: (2026)
Cross-Domain Data Selection and Augmentation for Automatic Compliance Detection
by: Ikhwantri, Fariz, et al.
Published: (2026)
by: Ikhwantri, Fariz, et al.
Published: (2026)
Cross-Lingual Transfer for Distantly Supervised and Low-resources Indonesian NER
by: Ikhwantri, Fariz
Published: (2019)
by: Ikhwantri, Fariz
Published: (2019)
Lessons from the Use of Natural Language Inference (NLI) in Requirements Engineering Tasks
by: Fazelnia, Mohamad, et al.
Published: (2024)
by: Fazelnia, Mohamad, et al.
Published: (2024)
NLPerturbator: Studying the Robustness of Code LLMs to Natural Language Variations
by: Chen, Junkai, et al.
Published: (2024)
by: Chen, Junkai, et al.
Published: (2024)
SpecMind: Cognitively Inspired, Interactive Multi-Turn Framework for Postcondition Inference
by: Le, Cuong Chi, et al.
Published: (2026)
by: Le, Cuong Chi, et al.
Published: (2026)
Execution-Based Evaluation of Natural Language to Bash and PowerShell for Incident Remediation
by: Vo, Ngoc Phuoc An, et al.
Published: (2024)
by: Vo, Ngoc Phuoc An, et al.
Published: (2024)
DI-BENCH: Benchmarking Large Language Models on Dependency Inference with Testable Repositories at Scale
by: Zhang, Linghao, et al.
Published: (2025)
by: Zhang, Linghao, et al.
Published: (2025)
CodeS: Natural Language to Code Repository via Multi-Layer Sketch
by: Zan, Daoguang, et al.
Published: (2024)
by: Zan, Daoguang, et al.
Published: (2024)
Model Based System Assurance Using the Structured Assurance Case Metamodel
by: Wei, Ran, et al.
Published: (2019)
by: Wei, Ran, et al.
Published: (2019)
Multi-Programming Language Sandbox for LLMs
by: Dou, Shihan, et al.
Published: (2024)
by: Dou, Shihan, et al.
Published: (2024)
LLM-as-a-Judge for Reference-less Automatic Code Validation and Refinement for Natural Language to Bash in IT Automation
by: Vo, Ngoc Phuoc An, et al.
Published: (2025)
by: Vo, Ngoc Phuoc An, et al.
Published: (2025)
Evaluating Plan Compliance in Autonomous Programming Agents
by: Liu, Shuyang, et al.
Published: (2026)
by: Liu, Shuyang, et al.
Published: (2026)
Vulnerability Detection with Code Language Models: How Far Are We?
by: Ding, Yangruibo, et al.
Published: (2024)
by: Ding, Yangruibo, et al.
Published: (2024)
Glitch Tokens in Large Language Models: Categorization Taxonomy and Effective Detection
by: Li, Yuxi, et al.
Published: (2024)
by: Li, Yuxi, et al.
Published: (2024)
Prompting Large Language Models to Tackle the Full Software Development Lifecycle: A Case Study
by: Li, Bowen, et al.
Published: (2024)
by: Li, Bowen, et al.
Published: (2024)
Structural Code Search using Natural Language Queries
by: Limpanukorn, Ben, et al.
Published: (2025)
by: Limpanukorn, Ben, et al.
Published: (2025)
Using Large Language Models for Student-Code Guided Test Case Generation in Computer Science Education
by: Kumar, Nischal Ashok, et al.
Published: (2024)
by: Kumar, Nischal Ashok, et al.
Published: (2024)
Formal Evidence Generation for Assurance Cases for Robotic Software Models
by: Yan, Fang, et al.
Published: (2026)
by: Yan, Fang, et al.
Published: (2026)
Co-Learning: Code Learning for Multi-Agent Reinforcement Collaborative Framework with Conversational Natural Language Interfaces
by: Yu, Jiapeng, et al.
Published: (2024)
by: Yu, Jiapeng, et al.
Published: (2024)
HumanEval-XL: A Multilingual Code Generation Benchmark for Cross-lingual Natural Language Generalization
by: Peng, Qiwei, et al.
Published: (2024)
by: Peng, Qiwei, et al.
Published: (2024)
EnStack: An Ensemble Stacking Framework of Large Language Models for Enhanced Vulnerability Detection in Source Code
by: Ridoy, Shahriyar Zaman, et al.
Published: (2024)
by: Ridoy, Shahriyar Zaman, et al.
Published: (2024)
SV-TrustEval-C: Evaluating Structure and Semantic Reasoning in Large Language Models for Source Code Vulnerability Analysis
by: Li, Yansong, et al.
Published: (2025)
by: Li, Yansong, et al.
Published: (2025)
Developing Assurance Cases for Adversarial Robustness and Regulatory Compliance in LLMs
by: Momcilovic, Tomas Bueno, et al.
Published: (2024)
by: Momcilovic, Tomas Bueno, et al.
Published: (2024)
Can LLMs Generate High-Quality Test Cases for Algorithm Problems? TestCase-Eval: A Systematic Evaluation of Fault Coverage and Exposure
by: Yang, Zheyuan, et al.
Published: (2025)
by: Yang, Zheyuan, et al.
Published: (2025)
Evaluating Program Semantics Reasoning with Type Inference in System F
by: He, Yifeng, et al.
Published: (2025)
by: He, Yifeng, et al.
Published: (2025)
Knowledge-Augmented Reasoning for EUAIA Compliance and Adversarial Robustness of LLMs
by: Momcilovic, Tomas Bueno, et al.
Published: (2024)
by: Momcilovic, Tomas Bueno, et al.
Published: (2024)
CodeContests+: High-Quality Test Case Generation for Competitive Programming
by: Wang, Zihan, et al.
Published: (2025)
by: Wang, Zihan, et al.
Published: (2025)
Skill over Scale: The Case for Medium, Domain-Specific Models for SE
by: Mukherjee, Manisha, et al.
Published: (2023)
by: Mukherjee, Manisha, et al.
Published: (2023)
AutoIOT: LLM-Driven Automated Natural Language Programming for AIoT Applications
by: Shen, Leming, et al.
Published: (2025)
by: Shen, Leming, et al.
Published: (2025)
ChartMark: A Structured Grammar for Chart Annotation
by: Chen, Yiyu, et al.
Published: (2025)
by: Chen, Yiyu, et al.
Published: (2025)
Measuring LLM Code Generation Stability via Structural Entropy
by: Song, Yewei, et al.
Published: (2025)
by: Song, Yewei, et al.
Published: (2025)
MultiFileTest: A Multi-File-Level LLM Unit Test Generation Benchmark and Impact of Error Fixing Mechanisms
by: Wang, Yibo, et al.
Published: (2025)
by: Wang, Yibo, et al.
Published: (2025)
AutoTestForge: A Multidimensional Automated Testing Framework for Natural Language Processing Models
by: Xing, Hengrui, et al.
Published: (2025)
by: Xing, Hengrui, et al.
Published: (2025)
Evaluating Retrieval-Augmented Generation Variants for Natural Language-Based SQL and API Call Generation
by: Marketsmüller, Michael, et al.
Published: (2026)
by: Marketsmüller, Michael, et al.
Published: (2026)
kRAIG: A Natural Language-Driven Agent for Automated DataOps Pipeline Generation
by: Siva, Rohan, et al.
Published: (2026)
by: Siva, Rohan, et al.
Published: (2026)
Benchmarking Failures in Tool-Augmented Language Models
by: Treviño, Eduardo, et al.
Published: (2025)
by: Treviño, Eduardo, et al.
Published: (2025)
M, Toolchain and Language for Reusable Model Compilation
by: Trinh, Hiep Hong, et al.
Published: (2025)
by: Trinh, Hiep Hong, et al.
Published: (2025)
Towards a Middleware for Large Language Models
by: Guran, Narcisa, et al.
Published: (2024)
by: Guran, Narcisa, et al.
Published: (2024)
Calibration of Large Language Models on Code Summarization
by: Virk, Yuvraj, et al.
Published: (2024)
by: Virk, Yuvraj, et al.
Published: (2024)
Similar Items
-
Evaluating Assurance Cases as Text-Attributed Graphs for Structure and Provenance Analysis
by: Ikhwantri, Fariz, et al.
Published: (2026) -
Cross-Domain Data Selection and Augmentation for Automatic Compliance Detection
by: Ikhwantri, Fariz, et al.
Published: (2026) -
Cross-Lingual Transfer for Distantly Supervised and Low-resources Indonesian NER
by: Ikhwantri, Fariz
Published: (2019) -
Lessons from the Use of Natural Language Inference (NLI) in Requirements Engineering Tasks
by: Fazelnia, Mohamad, et al.
Published: (2024) -
NLPerturbator: Studying the Robustness of Code LLMs to Natural Language Variations
by: Chen, Junkai, et al.
Published: (2024)