Assessing Large Language Models in Comprehending and Verifying Concurrent Programs across Memory Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Jain, Ridhi, Purandare, Rahul |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Verify Linearizability of Concurrent Stacks
por: Wen, Tangliu
Publicado: (2021)
por: Wen, Tangliu
Publicado: (2021)
Vulnerability Detection: From Formal Verification to Large Language Models and Hybrid Approaches: A Comprehensive Overview
por: Tihanyi, Norbert, et al.
Publicado: (2025)
por: Tihanyi, Norbert, et al.
Publicado: (2025)
Securing Tomorrow's Smart Cities: Investigating Software Security in Internet of Vehicles and Deep Learning Technologies
por: Jain, Ridhi, et al.
Publicado: (2024)
por: Jain, Ridhi, et al.
Publicado: (2024)
When is Generated Code Difficult to Comprehend? Assessing AI Agent Python Code Proficiency in the Wild
por: Temkulkiat, Nanthit, et al.
Publicado: (2026)
por: Temkulkiat, Nanthit, et al.
Publicado: (2026)
Verify Implementation Equivalence of Large Models
por: Zhan, Qi, et al.
Publicado: (2026)
por: Zhan, Qi, et al.
Publicado: (2026)
ASSERTIFY: Utilizing Large Language Models to Generate Assertions for Production Code
por: Torkamani, Mohammad Jalili, et al.
Publicado: (2024)
por: Torkamani, Mohammad Jalili, et al.
Publicado: (2024)
Streamlining Security Vulnerability Triage with Large Language Models
por: Torkamani, Mohammad Jalili, et al.
Publicado: (2025)
por: Torkamani, Mohammad Jalili, et al.
Publicado: (2025)
Can Large Language Models Model Programs Formally?
por: Chen, Zhiyong, et al.
Publicado: (2026)
por: Chen, Zhiyong, et al.
Publicado: (2026)
Does SWE-Bench-Verified Test Agent Ability or Model Memory?
por: Prathifkumar, Thanosan, et al.
Publicado: (2025)
por: Prathifkumar, Thanosan, et al.
Publicado: (2025)
Reimagining Self-Adaptation in the Age of Large Language Models
por: Donakanti, Raghav, et al.
Publicado: (2024)
por: Donakanti, Raghav, et al.
Publicado: (2024)
Program Slicing in the Era of Large Language Models
por: Shahandashti, Kimya Khakzad, et al.
Publicado: (2024)
por: Shahandashti, Kimya Khakzad, et al.
Publicado: (2024)
Rethinking Legal Compliance Automation: Opportunities with Large Language Models
por: Hassani, Shabnam, et al.
Publicado: (2024)
por: Hassani, Shabnam, et al.
Publicado: (2024)
VeCoGen: Automating Generation of Formally Verified C Code with Large Language Models
por: Sevenhuijsen, Merlijn, et al.
Publicado: (2024)
por: Sevenhuijsen, Merlijn, et al.
Publicado: (2024)
Assessing Coherency and Consistency of Code Execution Reasoning by Large Language Models
por: Liu, Changshu, et al.
Publicado: (2025)
por: Liu, Changshu, et al.
Publicado: (2025)
Reality Bites: Assessing the Realism of Driving Scenarios with Large Language Models
por: Wu, Jiahui, et al.
Publicado: (2024)
por: Wu, Jiahui, et al.
Publicado: (2024)
Assessing Large Language Models for Stabilizing Numerical Expressions in Scientific Software
por: Nguyen, Tien, et al.
Publicado: (2026)
por: Nguyen, Tien, et al.
Publicado: (2026)
Hybrid Automated Program Repair by Combining Large Language Models and Program Analysis
por: Li, Fengjie, et al.
Publicado: (2024)
por: Li, Fengjie, et al.
Publicado: (2024)
Memory-Efficient Large Language Models for Program Repair with Semantic-Guided Patch Generation
por: Le-Cong, Thanh, et al.
Publicado: (2024)
por: Le-Cong, Thanh, et al.
Publicado: (2024)
Automated Repair of C Programs Using Large Language Models
por: Farzandway, Mahdi, et al.
Publicado: (2025)
por: Farzandway, Mahdi, et al.
Publicado: (2025)
Exploring Generalizable Automated Program Repair with Large Language Models
por: Campos, Viola, et al.
Publicado: (2025)
por: Campos, Viola, et al.
Publicado: (2025)
Empirical Evaluation of Large Language Models in Automated Program Repair
por: Sun, Jiajun, et al.
Publicado: (2025)
por: Sun, Jiajun, et al.
Publicado: (2025)
Assessing and Advancing Benchmarks for Evaluating Large Language Models in Software Engineering Tasks
por: Hu, Xing, et al.
Publicado: (2025)
por: Hu, Xing, et al.
Publicado: (2025)
A Multi-Language Object-Oriented Programming Benchmark for Large Language Models
por: Wang, Shuai, et al.
Publicado: (2025)
por: Wang, Shuai, et al.
Publicado: (2025)
Assessing the Business Process Modeling Competences of Large Language Models
por: Lauer, Chantale, et al.
Publicado: (2026)
por: Lauer, Chantale, et al.
Publicado: (2026)
A New Era in Software Security: Towards Self-Healing Software via Large Language Models and Formal Verification
por: Tihanyi, Norbert, et al.
Publicado: (2023)
por: Tihanyi, Norbert, et al.
Publicado: (2023)
Enchanting Program Specification Synthesis by Large Language Models using Static Analysis and Program Verification
por: Wen, Cheng, et al.
Publicado: (2024)
por: Wen, Cheng, et al.
Publicado: (2024)
Revisiting Unnaturalness for Automated Program Repair in the Era of Large Language Models
por: Yang, Aidan Z. H., et al.
Publicado: (2024)
por: Yang, Aidan Z. H., et al.
Publicado: (2024)
Practical Program Repair in the Era of Large Pre-trained Language Models
por: Xia, Chunqiu Steven, et al.
Publicado: (2022)
por: Xia, Chunqiu Steven, et al.
Publicado: (2022)
Are Large Language Models a Threat to Programming Platforms? An Exploratory Study
por: Billah, Md Mustakim, et al.
Publicado: (2024)
por: Billah, Md Mustakim, et al.
Publicado: (2024)
Advancing Code Coverage: Incorporating Program Analysis with Large Language Models
por: Yang, Chen, et al.
Publicado: (2024)
por: Yang, Chen, et al.
Publicado: (2024)
A Tool for Benchmarking Large Language Models' Robustness in Assessing the Realism of Driving Scenarios
por: Wu, Jiahui, et al.
Publicado: (2025)
por: Wu, Jiahui, et al.
Publicado: (2025)
Beyond Strict Rules: Assessing the Effectiveness of Large Language Models for Code Smell Detection
por: Souza, Saymon, et al.
Publicado: (2026)
por: Souza, Saymon, et al.
Publicado: (2026)
Exploring the Potential and Limitations of Large Language Models for Novice Program Fault Localization
por: Xu, Hexiang, et al.
Publicado: (2025)
por: Xu, Hexiang, et al.
Publicado: (2025)
A Systematic Literature Review on Large Language Models for Automated Program Repair
por: Zhang, Quanjun, et al.
Publicado: (2024)
por: Zhang, Quanjun, et al.
Publicado: (2024)
Isolating Compiler Bugs by Generating Effective Witness Programs with Large Language Models
por: Tu, Haoxin, et al.
Publicado: (2023)
por: Tu, Haoxin, et al.
Publicado: (2023)
Large Language Models-Aided Program Debloating
por: Lin, Bo, et al.
Publicado: (2025)
por: Lin, Bo, et al.
Publicado: (2025)
Challenges in Comparing Code Maintainability across Different Programming Languages
por: Ponsard, Christophe, et al.
Publicado: (2024)
por: Ponsard, Christophe, et al.
Publicado: (2024)
VERT: Verified Equivalent Rust Transpilation with Large Language Models as Few-Shot Learners
por: Yang, Aidan Z. H., et al.
Publicado: (2024)
por: Yang, Aidan Z. H., et al.
Publicado: (2024)
Assessing Large Language Models for Automated Feedback Generation in Learning Programming Problem Solving
por: Silva, Priscylla, et al.
Publicado: (2025)
por: Silva, Priscylla, et al.
Publicado: (2025)
Automated Program Repair Based on REST API Specifications Using Large Language Models
por: Yamagishi, Katsuki, et al.
Publicado: (2025)
por: Yamagishi, Katsuki, et al.
Publicado: (2025)
Ejemplares similares
-
Verify Linearizability of Concurrent Stacks
por: Wen, Tangliu
Publicado: (2021) -
Vulnerability Detection: From Formal Verification to Large Language Models and Hybrid Approaches: A Comprehensive Overview
por: Tihanyi, Norbert, et al.
Publicado: (2025) -
Securing Tomorrow's Smart Cities: Investigating Software Security in Internet of Vehicles and Deep Learning Technologies
por: Jain, Ridhi, et al.
Publicado: (2024) -
When is Generated Code Difficult to Comprehend? Assessing AI Agent Python Code Proficiency in the Wild
por: Temkulkiat, Nanthit, et al.
Publicado: (2026) -
Verify Implementation Equivalence of Large Models
por: Zhan, Qi, et al.
Publicado: (2026)