SEVerA: Verified Synthesis of Self-Evolving Agents
Fuente:
arXiv
Saved in:
| Main Authors: | Banerjee, Debangshu, Xu, Changming, Ie, Eugene, Zhang, Ming, Peng, Daiyi, Lin, Chu-Cheng, Singh, Gagandeep |
|---|---|
| Format: | Preprint |
| Published: |
2026
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
DINGO: Constrained Inference for Diffusion LLMs
by: Suresh, Tarun, et al.
Published: (2025)
by: Suresh, Tarun, et al.
Published: (2025)
Evolving Abstract Transformers for Gradient-Guided, Adaptable Abstract Interpretation
by: Gomber, Shaurya, et al.
Published: (2025)
by: Gomber, Shaurya, et al.
Published: (2025)
Towards AI-Assisted Synthesis of Verified Dafny Methods
by: Misu, Md Rakib Hossain, et al.
Published: (2024)
by: Misu, Md Rakib Hossain, et al.
Published: (2024)
Functional Consistency of LLM Code Embeddings: A Self-Evolving Data Synthesis Framework for Benchmarking
by: Li, Zhuohao, et al.
Published: (2025)
by: Li, Zhuohao, et al.
Published: (2025)
IterGen: Iterative Semantic-aware Structured LLM Generation with Backtracking
by: Ugare, Shubham, et al.
Published: (2024)
by: Ugare, Shubham, et al.
Published: (2024)
Certified Program Synthesis with a Multi-Modal Verifier
by: Feng, Yueyang, et al.
Published: (2026)
by: Feng, Yueyang, et al.
Published: (2026)
Verifying a Realistic Mutable Hash Table
by: Chassot, Samuel, et al.
Published: (2021)
by: Chassot, Samuel, et al.
Published: (2021)
Verified invertible lexer using regular expressions and DFAs
by: Chassot, Samuel, et al.
Published: (2024)
by: Chassot, Samuel, et al.
Published: (2024)
Generating Verifiable Chain of Thoughts from Exection-Traces
by: Thakur, Shailja, et al.
Published: (2025)
by: Thakur, Shailja, et al.
Published: (2025)
Formally Verifiable Generated ASN.1/ACN Encoders and Decoders: A Case Study
by: Bucev, Mario, et al.
Published: (2024)
by: Bucev, Mario, et al.
Published: (2024)
VERT: Verified Equivalent Rust Transpilation with Large Language Models as Few-Shot Learners
by: Yang, Aidan Z. H., et al.
Published: (2024)
by: Yang, Aidan Z. H., et al.
Published: (2024)
SuperCoder: Assembly Program Superoptimization with Large Language Models
by: Wei, Anjiang, et al.
Published: (2025)
by: Wei, Anjiang, et al.
Published: (2025)
SynCode: LLM Generation with Grammar Augmentation
by: Ugare, Shubham, et al.
Published: (2024)
by: Ugare, Shubham, et al.
Published: (2024)
Conditional Execution of Transpiler Passes Based on Per-Script Feature Detection
by: Bhatia, Rishipal Singh
Published: (2026)
by: Bhatia, Rishipal Singh
Published: (2026)
LLM-Guided Compositional Program Synthesis
by: Khan, Ruhma, et al.
Published: (2025)
by: Khan, Ruhma, et al.
Published: (2025)
KAIJU: An Executive Kernel for Intent-Gated Execution of LLM Agents
by: Guerin, Cormac, et al.
Published: (2026)
by: Guerin, Cormac, et al.
Published: (2026)
ReSyn: A Generalized Recursive Regular Expression Synthesis Framework
by: Kim, Seongmin, et al.
Published: (2026)
by: Kim, Seongmin, et al.
Published: (2026)
Toward Programming Languages for Reasoning: Humans, Symbolic Systems, and AI Agents
by: Marron, Mark
Published: (2024)
by: Marron, Mark
Published: (2024)
FlashSyn: Flash Loan Attack Synthesis via Counter Example Driven Approximation
by: Chen, Zhiyang, et al.
Published: (2022)
by: Chen, Zhiyang, et al.
Published: (2022)
Dual-Language General-Purpose Self-Hosted Visual Language and new Textual Programming Language for Applications
by: Fayed, Mahmoud Samir
Published: (2025)
by: Fayed, Mahmoud Samir
Published: (2025)
Flow Sensitivity without Control Flow Graph: An Efficient Andersen-Style Flow-Sensitive Pointer Analysis
by: Zhang, Jiahao, et al.
Published: (2025)
by: Zhang, Jiahao, et al.
Published: (2025)
Self-Improving Code Generation via Semantic Entropy and Behavioral Consensus
by: Zhang, Huan, et al.
Published: (2026)
by: Zhang, Huan, et al.
Published: (2026)
A Trace-based Approach for Code Safety Analysis
by: Xu, Hui
Published: (2025)
by: Xu, Hui
Published: (2025)
LPO: Discovering Missed Peephole Optimizations with Large Language Models
by: Xu, Zhenyang, et al.
Published: (2025)
by: Xu, Zhenyang, et al.
Published: (2025)
DRReduce: Enhancing Syntax-Guided Program Reduction with Dependency Reconstruction
by: Feng, Qiong, et al.
Published: (2026)
by: Feng, Qiong, et al.
Published: (2026)
Towards a Transpiler for C/C++ to Safer Rust
by: Tripuramallu, Dhiren, et al.
Published: (2024)
by: Tripuramallu, Dhiren, et al.
Published: (2024)
Generating Equivalent Representations of Code By A Self-Reflection Approach
by: Li, Jia, et al.
Published: (2024)
by: Li, Jia, et al.
Published: (2024)
Finding Compiler Bugs through Cross-Language Code Generator and Differential Testing
by: Feng, Qiong, et al.
Published: (2025)
by: Feng, Qiong, et al.
Published: (2025)
Characterizing Unsafe Code Encapsulation In Real-world Rust Systems
by: Rao, Zihao, et al.
Published: (2024)
by: Rao, Zihao, et al.
Published: (2024)
Hidden in Plain Sight: Where Developers Confess Self-Admitted Technical Debt
by: Sridharan, Murali, et al.
Published: (2025)
by: Sridharan, Murali, et al.
Published: (2025)
TypePro: Boosting LLM-Based Type Inference via Inter-Procedural Slicing
by: Lin, Teyu, et al.
Published: (2026)
by: Lin, Teyu, et al.
Published: (2026)
DafnyPro: LLM-Assisted Automated Verification for Dafny Programs
by: Banerjee, Debangshu, et al.
Published: (2026)
by: Banerjee, Debangshu, et al.
Published: (2026)
BugLens: Leveraging Bisection for Lightweight Compiler Bug Deduplication
by: Zhou, Xintong, et al.
Published: (2025)
by: Zhou, Xintong, et al.
Published: (2025)
HumanEval-XL: A Multilingual Code Generation Benchmark for Cross-lingual Natural Language Generalization
by: Peng, Qiwei, et al.
Published: (2024)
by: Peng, Qiwei, et al.
Published: (2024)
WDD: Weighted Delta Debugging
by: Zhou, Xintong, et al.
Published: (2024)
by: Zhou, Xintong, et al.
Published: (2024)
SALT4Decompile: Inferring Source-level Abstract Logic Tree for LLM-Based Binary Decompilation
by: Wang, Yongpan, et al.
Published: (2025)
by: Wang, Yongpan, et al.
Published: (2025)
CodeFuse-Query: A Data-Centric Static Code Analysis System for Large-Scale Organizations
by: Xie, Xiaoheng, et al.
Published: (2024)
by: Xie, Xiaoheng, et al.
Published: (2024)
LPR: Large Language Models-Aided Program Reduction
by: Zhang, Mengxiao, et al.
Published: (2023)
by: Zhang, Mengxiao, et al.
Published: (2023)
Top Leaderboard Ranking = Top Coding Proficiency, Always? EvoEval: Evolving Coding Benchmarks via LLM
by: Xia, Chunqiu Steven, et al.
Published: (2024)
by: Xia, Chunqiu Steven, et al.
Published: (2024)
Large Language Models for Multilingual Code Intelligence: A Survey
by: Jiang, Chao, et al.
Published: (2026)
by: Jiang, Chao, et al.
Published: (2026)
Similar Items
-
DINGO: Constrained Inference for Diffusion LLMs
by: Suresh, Tarun, et al.
Published: (2025) -
Evolving Abstract Transformers for Gradient-Guided, Adaptable Abstract Interpretation
by: Gomber, Shaurya, et al.
Published: (2025) -
Towards AI-Assisted Synthesis of Verified Dafny Methods
by: Misu, Md Rakib Hossain, et al.
Published: (2024) -
Functional Consistency of LLM Code Embeddings: A Self-Evolving Data Synthesis Framework for Benchmarking
by: Li, Zhuohao, et al.
Published: (2025) -
IterGen: Iterative Semantic-aware Structured LLM Generation with Backtracking
by: Ugare, Shubham, et al.
Published: (2024)