EnCompass: Enhancing Agent Programming with Search Over Program Execution Paths
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Zhening, Solar-Lezama, Armando, Yue, Yisong, Zheng, Stephan |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
When Do Skills Help Reinforcement Learning? A Theoretical Analysis of Temporal Abstractions
di: Li, Zhening, et al.
Pubblicazione: (2024)
di: Li, Zhening, et al.
Pubblicazione: (2024)
AIOS Compiler: LLM as Interpreter for Natural Language Programming and Flow Programming of AI Agents
di: Xu, Shuyuan, et al.
Pubblicazione: (2024)
di: Xu, Shuyuan, et al.
Pubblicazione: (2024)
The Path Not Taken: Duality in Reasoning about Program Execution
di: Hasanov, Eshgin, et al.
Pubblicazione: (2026)
di: Hasanov, Eshgin, et al.
Pubblicazione: (2026)
EcoSearch: A Constant-Delay Best-First Search Algorithm for Program Synthesis
di: Matricon, Théo, et al.
Pubblicazione: (2024)
di: Matricon, Théo, et al.
Pubblicazione: (2024)
What I cannot execute, I do not understand: Training and Evaluating LLMs on Program Execution Traces
di: Armengol-Estapé, Jordi, et al.
Pubblicazione: (2025)
di: Armengol-Estapé, Jordi, et al.
Pubblicazione: (2025)
An Enigma of Artificial Reason: Investigating the Production-Evaluation Gap in Large Reasoning Models
di: Sun, Mingzhong, et al.
Pubblicazione: (2026)
di: Sun, Mingzhong, et al.
Pubblicazione: (2026)
Program Synthesis using Inductive Logic Programming for the Abstraction and Reasoning Corpus
di: Rocha, Filipe Marinho, et al.
Pubblicazione: (2024)
di: Rocha, Filipe Marinho, et al.
Pubblicazione: (2024)
The Elements of Differentiable Programming
di: Blondel, Mathieu, et al.
Pubblicazione: (2024)
di: Blondel, Mathieu, et al.
Pubblicazione: (2024)
CodeARC: Benchmarking Reasoning Capabilities of LLM Agents for Inductive Program Synthesis
di: Wei, Anjiang, et al.
Pubblicazione: (2025)
di: Wei, Anjiang, et al.
Pubblicazione: (2025)
Emergent Representations of Program Semantics in Language Models Trained on Programs
di: Jin, Charles, et al.
Pubblicazione: (2023)
di: Jin, Charles, et al.
Pubblicazione: (2023)
APPL: A Prompt Programming Language for Harmonious Integration of Programs and Large Language Model Prompts
di: Dong, Honghua, et al.
Pubblicazione: (2024)
di: Dong, Honghua, et al.
Pubblicazione: (2024)
Probabilistic Programming with Programmable Variational Inference
di: Becker, McCoy R., et al.
Pubblicazione: (2024)
di: Becker, McCoy R., et al.
Pubblicazione: (2024)
Prism: Symbolic Superoptimization of Tensor Programs
di: Wu, Mengdi, et al.
Pubblicazione: (2026)
di: Wu, Mengdi, et al.
Pubblicazione: (2026)
A Fast, Reliable, and Secure Programming Language for LLM Agents with Code Actions
di: Mell, Stephen, et al.
Pubblicazione: (2025)
di: Mell, Stephen, et al.
Pubblicazione: (2025)
Program Semantic Inequivalence Game with Large Language Models
di: Miceli-Barone, Antonio Valerio, et al.
Pubblicazione: (2025)
di: Miceli-Barone, Antonio Valerio, et al.
Pubblicazione: (2025)
Generating Pragmatic Examples to Train Neural Program Synthesizers
di: Vaduguru, Saujas, et al.
Pubblicazione: (2023)
di: Vaduguru, Saujas, et al.
Pubblicazione: (2023)
Mirage: A Multi-Level Superoptimizer for Tensor Programs
di: Wu, Mengdi, et al.
Pubblicazione: (2024)
di: Wu, Mengdi, et al.
Pubblicazione: (2024)
Program Machine Policy: Addressing Long-Horizon Tasks by Integrating Program Synthesis and State Machines
di: Lin, Yu-An, et al.
Pubblicazione: (2023)
di: Lin, Yu-An, et al.
Pubblicazione: (2023)
Is Programming by Example solved by LLMs?
di: Li, Wen-Ding, et al.
Pubblicazione: (2024)
di: Li, Wen-Ding, et al.
Pubblicazione: (2024)
Hexcute: A Compiler Framework for Automating Layout Synthesis in GPU Programs
di: Zhang, Xiao, et al.
Pubblicazione: (2025)
di: Zhang, Xiao, et al.
Pubblicazione: (2025)
Beyond Numeric Rewards: In-Context Dueling Bandits with LLM Agents
di: Xia, Fanzeng, et al.
Pubblicazione: (2024)
di: Xia, Fanzeng, et al.
Pubblicazione: (2024)
Tilus: A Tile-Level GPGPU Programming Language for Low-Precision Computation
di: Ding, Yaoyao, et al.
Pubblicazione: (2025)
di: Ding, Yaoyao, et al.
Pubblicazione: (2025)
Quokka: Accelerating Program Verification with LLMs via Invariant Synthesis
di: Wei, Anjiang, et al.
Pubblicazione: (2025)
di: Wei, Anjiang, et al.
Pubblicazione: (2025)
Chain of Execution Supervision Promotes General Reasoning in Large Language Models
di: Chen, Nuo, et al.
Pubblicazione: (2025)
di: Chen, Nuo, et al.
Pubblicazione: (2025)
Bridging the Knowledge Void: Inference-time Acquisition of Unfamiliar Programming Languages for Coding Tasks
di: Shen, Chen, et al.
Pubblicazione: (2026)
di: Shen, Chen, et al.
Pubblicazione: (2026)
A Joint Learning Model with Variational Interaction for Multilingual Program Translation
di: Du, Yali, et al.
Pubblicazione: (2024)
di: Du, Yali, et al.
Pubblicazione: (2024)
Neural Task Synthesis for Visual Programming
di: Pădurean, Victor-Alexandru, et al.
Pubblicazione: (2023)
di: Pădurean, Victor-Alexandru, et al.
Pubblicazione: (2023)
Can LLMs Compress (and Decompress)? Evaluating Code Understanding and Execution via Invertibility
di: Maveli, Nickil, et al.
Pubblicazione: (2026)
di: Maveli, Nickil, et al.
Pubblicazione: (2026)
SGLang: Efficient Execution of Structured Language Model Programs
di: Zheng, Lianmin, et al.
Pubblicazione: (2023)
di: Zheng, Lianmin, et al.
Pubblicazione: (2023)
ReGAL: Refactoring Programs to Discover Generalizable Abstractions
di: Stengel-Eskin, Elias, et al.
Pubblicazione: (2024)
di: Stengel-Eskin, Elias, et al.
Pubblicazione: (2024)
CRUXEval: A Benchmark for Code Reasoning, Understanding and Execution
di: Gu, Alex, et al.
Pubblicazione: (2024)
di: Gu, Alex, et al.
Pubblicazione: (2024)
Searching for Programmatic Policies in Semantic Spaces
di: Moraes, Rubens O., et al.
Pubblicazione: (2024)
di: Moraes, Rubens O., et al.
Pubblicazione: (2024)
ScenicNL: Generating Probabilistic Scenario Programs from Natural Language
di: Elmaaroufi, Karim, et al.
Pubblicazione: (2024)
di: Elmaaroufi, Karim, et al.
Pubblicazione: (2024)
Executable Functional Abstractions: Inferring Generative Programs for Advanced Math Problems
di: Khan, Zaid, et al.
Pubblicazione: (2025)
di: Khan, Zaid, et al.
Pubblicazione: (2025)
Do Large Code Models Understand Programming Concepts? Counterfactual Analysis for Code Predicates
di: Hooda, Ashish, et al.
Pubblicazione: (2024)
di: Hooda, Ashish, et al.
Pubblicazione: (2024)
EquiBench: Benchmarking Large Language Models' Reasoning about Program Semantics via Equivalence Checking
di: Wei, Anjiang, et al.
Pubblicazione: (2025)
di: Wei, Anjiang, et al.
Pubblicazione: (2025)
Is Self-Repair a Silver Bullet for Code Generation?
di: Olausson, Theo X., et al.
Pubblicazione: (2023)
di: Olausson, Theo X., et al.
Pubblicazione: (2023)
Lobster: A GPU-Accelerated Framework for Neurosymbolic Programming
di: Biberstein, Paul, et al.
Pubblicazione: (2025)
di: Biberstein, Paul, et al.
Pubblicazione: (2025)
Synthesizing Programmatic Reinforcement Learning Policies with Large Language Model Guided Search
di: Liu, Max, et al.
Pubblicazione: (2024)
di: Liu, Max, et al.
Pubblicazione: (2024)
AutoPDL: Automatic Prompt Optimization for LLM Agents
di: Spiess, Claudio, et al.
Pubblicazione: (2025)
di: Spiess, Claudio, et al.
Pubblicazione: (2025)
Documenti analoghi
-
When Do Skills Help Reinforcement Learning? A Theoretical Analysis of Temporal Abstractions
di: Li, Zhening, et al.
Pubblicazione: (2024) -
AIOS Compiler: LLM as Interpreter for Natural Language Programming and Flow Programming of AI Agents
di: Xu, Shuyuan, et al.
Pubblicazione: (2024) -
The Path Not Taken: Duality in Reasoning about Program Execution
di: Hasanov, Eshgin, et al.
Pubblicazione: (2026) -
EcoSearch: A Constant-Delay Best-First Search Algorithm for Program Synthesis
di: Matricon, Théo, et al.
Pubblicazione: (2024) -
What I cannot execute, I do not understand: Training and Evaluating LLMs on Program Execution Traces
di: Armengol-Estapé, Jordi, et al.
Pubblicazione: (2025)