Programmatic Reinforcement Learning: Navigating Gridworlds
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Shabadi, Guruprerana, Fijalkow, Nathanaël, Matricon, Théo |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
EcoSearch: A Constant-Delay Best-First Search Algorithm for Program Synthesis
par: Matricon, Théo, et autres
Publié: (2024)
par: Matricon, Théo, et autres
Publié: (2024)
LTL$_f$ Learning Meets Boolean Set Cover
par: Bathie, Gabriel, et autres
Publié: (2025)
par: Bathie, Gabriel, et autres
Publié: (2025)
Optimization Modulo Integer Linear-Exponential Programs
par: Hitarth, S, et autres
Publié: (2025)
par: Hitarth, S, et autres
Publié: (2025)
GPU accelerated program synthesis: Enumerate semantics, not syntax!
par: Berger, Martin, et autres
Publié: (2025)
par: Berger, Martin, et autres
Publié: (2025)
Boosting Few-Pixel Robustness Verification via Covering Verification Designs
par: Shapira, Yuval, et autres
Publié: (2024)
par: Shapira, Yuval, et autres
Publié: (2024)
Loop Invariant Generation: A Hybrid Framework of Reasoning optimised LLMs and SMT Solvers
par: Bharti, Varun, et autres
Publié: (2025)
par: Bharti, Varun, et autres
Publié: (2025)
Smart Choices and the Selection Monad
par: Abadi, Martin, et autres
Publié: (2020)
par: Abadi, Martin, et autres
Publié: (2020)
Mini-Batch Robustness Verification of Deep Neural Networks
par: Tzour-Shaday, Saar, et autres
Publié: (2025)
par: Tzour-Shaday, Saar, et autres
Publié: (2025)
Towards a Certified Proof Checker for Deep Neural Network Verification
par: Desmartin, Remi, et autres
Publié: (2023)
par: Desmartin, Remi, et autres
Publié: (2023)
Floating-Point Neural Networks Are Provably Robust Universal Approximators
par: Hwang, Geonho, et autres
Publié: (2025)
par: Hwang, Geonho, et autres
Publié: (2025)
Neural Network Verification is a Programming Language Challenge
par: Cordeiro, Lucas C., et autres
Publié: (2025)
par: Cordeiro, Lucas C., et autres
Publié: (2025)
Probabilistic unifying relations for modelling epistemic and aleatoric uncertainty: semantics and automated reasoning with theorem proving
par: Ye, Kangfeng, et autres
Publié: (2023)
par: Ye, Kangfeng, et autres
Publié: (2023)
MiniF2F in Rocq: Automatic Translation Between Proof Assistants -- A Case Study
par: Viennot, Jules, et autres
Publié: (2025)
par: Viennot, Jules, et autres
Publié: (2025)
An In-Context Learning Agent for Formal Theorem-Proving
par: Thakur, Amitayush, et autres
Publié: (2023)
par: Thakur, Amitayush, et autres
Publié: (2023)
ScenicProver: A Framework for Compositional Probabilistic Verification of Learning-Enabled Systems
par: Vin, Eric, et autres
Publié: (2025)
par: Vin, Eric, et autres
Publié: (2025)
Do We Need Frontier Models to Verify Mathematical Proofs?
par: Naik, Aaditya, et autres
Publié: (2026)
par: Naik, Aaditya, et autres
Publié: (2026)
GPU-Accelerated Synthesis of Mixed-Boolean Arithmetic: Beyond Caching
par: Bathie, Gabriel, et autres
Publié: (2026)
par: Bathie, Gabriel, et autres
Publié: (2026)
Chronosymbolic Learning: Efficient CHC Solving with Symbolic Reasoning and Inductive Learning
par: Luo, Ziyan, et autres
Publié: (2023)
par: Luo, Ziyan, et autres
Publié: (2023)
PutnamBench: Evaluating Neural Theorem-Provers on the Putnam Mathematical Competition
par: Tsoukalas, George, et autres
Publié: (2024)
par: Tsoukalas, George, et autres
Publié: (2024)
From Symbolic Tasks to Code Generation: Diversification Yields Better Task Performers
par: Zhang, Dylan, et autres
Publié: (2024)
par: Zhang, Dylan, et autres
Publié: (2024)
NLP Verification: Towards a General Methodology for Certifying Robustness
par: Casadio, Marco, et autres
Publié: (2024)
par: Casadio, Marco, et autres
Publié: (2024)
Lattice Annotated Temporal (LAT) Logic for Non-Markovian Reasoning
par: Mukherji, Kaustuv, et autres
Publié: (2025)
par: Mukherji, Kaustuv, et autres
Publié: (2025)
ProofWala: A Framework for Multilingual Proof Data Synthesis and Theorem-Proving
par: Thakur, Amitayush, et autres
Publié: (2025)
par: Thakur, Amitayush, et autres
Publié: (2025)
Decidable By Construction: Design-Time Verification for Trustworthy AI
par: Haynes, Houston
Publié: (2026)
par: Haynes, Houston
Publié: (2026)
Compile to Compress: Boosting Formal Theorem Provers by Compiler Outputs
par: Li, Guchan, et autres
Publié: (2026)
par: Li, Guchan, et autres
Publié: (2026)
Verification Modulo Tested Library Contracts
par: Uppar, Abhishek, et autres
Publié: (2026)
par: Uppar, Abhishek, et autres
Publié: (2026)
Towards Regulated Deep Learning
par: García-Camino, Andrés
Publié: (2019)
par: García-Camino, Andrés
Publié: (2019)
Auction-Based Online Policy Adaptation for Evolving Objectives
par: Shabadi, Guruprerana, et autres
Publié: (2026)
par: Shabadi, Guruprerana, et autres
Publié: (2026)
Risk-Sensitive Agent Compositions
par: Shabadi, Guruprerana, et autres
Publié: (2025)
par: Shabadi, Guruprerana, et autres
Publié: (2025)
Learning to Estimate System Specifications in Linear Temporal Logic using Transformers and Mamba
par: Işık, İlker, et autres
Publié: (2024)
par: Işık, İlker, et autres
Publié: (2024)
Probabilistic programming interfaces for random graphs: Markov categories, graphons, and nominal sets
par: Ackerman, Nathanael L., et autres
Publié: (2023)
par: Ackerman, Nathanael L., et autres
Publié: (2023)
From Muller to Parity and Rabin Automata: Optimal Transformations Preserving (History) Determinism
par: Casares, Antonio, et autres
Publié: (2023)
par: Casares, Antonio, et autres
Publié: (2023)
DeepSeek-Prover-V1.5: Harnessing Proof Assistant Feedback for Reinforcement Learning and Monte-Carlo Tree Search
par: Xin, Huajian, et autres
Publié: (2024)
par: Xin, Huajian, et autres
Publié: (2024)
VerMCTS: Synthesizing Multi-Step Programs using a Verifier, a Large Language Model, and Tree Search
par: Brandfonbrener, David, et autres
Publié: (2024)
par: Brandfonbrener, David, et autres
Publié: (2024)
VERINA: Benchmarking Verifiable Code Generation
par: Ye, Zhe, et autres
Publié: (2025)
par: Ye, Zhe, et autres
Publié: (2025)
CLEVER: A Curated Benchmark for Formally Verified Code Generation
par: Thakur, Amitayush, et autres
Publié: (2025)
par: Thakur, Amitayush, et autres
Publié: (2025)
Intent-aligned Formal Specification Synthesis via Traceable Refinement
par: Ye, Zhe, et autres
Publié: (2026)
par: Ye, Zhe, et autres
Publié: (2026)
Kleene algebra with commutativity conditions is undecidable
par: de Amorim, Arthur Azevedo, et autres
Publié: (2024)
par: de Amorim, Arthur Azevedo, et autres
Publié: (2024)
Process-Driven Autoformalization in Lean 4
par: Lu, Jianqiao, et autres
Publié: (2024)
par: Lu, Jianqiao, et autres
Publié: (2024)
Interchangeable Token Embeddings for Extendable Vocabulary and Alpha-Equivalence
par: Işık, İlker, et autres
Publié: (2024)
par: Işık, İlker, et autres
Publié: (2024)
Documents similaires
-
EcoSearch: A Constant-Delay Best-First Search Algorithm for Program Synthesis
par: Matricon, Théo, et autres
Publié: (2024) -
LTL$_f$ Learning Meets Boolean Set Cover
par: Bathie, Gabriel, et autres
Publié: (2025) -
Optimization Modulo Integer Linear-Exponential Programs
par: Hitarth, S, et autres
Publié: (2025) -
GPU accelerated program synthesis: Enumerate semantics, not syntax!
par: Berger, Martin, et autres
Publié: (2025) -
Boosting Few-Pixel Robustness Verification via Covering Verification Designs
par: Shapira, Yuval, et autres
Publié: (2024)