A Reinforcement Learning based Reset Policy for CDCL SAT Solvers
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Chunxiao, Liu, Charlie, Chung, Jonathan, Lu, Zhengyang, Jha, Piyush, Ganesh, Vijay |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
MathConstraint: Automated Generation of Verified Combinatorial Reasoning Instances for LLMs
di: Pati, Viresh, et al.
Pubblicazione: (2026)
di: Pati, Viresh, et al.
Pubblicazione: (2026)
RLSF: Fine-tuning LLMs via Symbolic Feedback
di: Jha, Piyush, et al.
Pubblicazione: (2024)
di: Jha, Piyush, et al.
Pubblicazione: (2024)
Can Transformers Reason Logically? A Study in SAT Solving
di: Pan, Leyan, et al.
Pubblicazione: (2024)
di: Pan, Leyan, et al.
Pubblicazione: (2024)
Understanding CDCL Solvers via Scalability Studies and Proofdoors
di: Zhang, Shimin, et al.
Pubblicazione: (2026)
di: Zhang, Shimin, et al.
Pubblicazione: (2026)
Layered and Staged Monte Carlo Tree Search for SMT Strategy Synthesis
di: Lu, Zhengyang, et al.
Pubblicazione: (2024)
di: Lu, Zhengyang, et al.
Pubblicazione: (2024)
Proofdoors and Efficiency of CDCL Solvers
di: Singh, Sunidhi, et al.
Pubblicazione: (2026)
di: Singh, Sunidhi, et al.
Pubblicazione: (2026)
Rethinking Clause Management for CDCL SAT Solvers
di: Cai, Yalun, et al.
Pubblicazione: (2026)
di: Cai, Yalun, et al.
Pubblicazione: (2026)
AlphaMapleSAT: An MCTS-based Cube-and-Conquer SAT Solver for Hard Combinatorial Problems
di: Jha, Piyush, et al.
Pubblicazione: (2024)
di: Jha, Piyush, et al.
Pubblicazione: (2024)
Transfer Learning from Foundational Optimization Embeddings to Unsupervised SAT Representations
di: Pal, Koyena, et al.
Pubblicazione: (2026)
di: Pal, Koyena, et al.
Pubblicazione: (2026)
Learning to Rank the Initial Branching Order of SAT Solvers
di: Eriksson, Arvid, et al.
Pubblicazione: (2026)
di: Eriksson, Arvid, et al.
Pubblicazione: (2026)
Deeply Optimizing the SAT Solver for the IC3 Algorithm
di: Su, Yuheng, et al.
Pubblicazione: (2025)
di: Su, Yuheng, et al.
Pubblicazione: (2025)
Dsat: A Native SAT Solver for Discrete Logic
di: Zhang, Yaofang, et al.
Pubblicazione: (2026)
di: Zhang, Yaofang, et al.
Pubblicazione: (2026)
Robust Shielding for Safe Reinforcement Learning
di: Court, Edwin Hamel-De le, et al.
Pubblicazione: (2026)
di: Court, Edwin Hamel-De le, et al.
Pubblicazione: (2026)
Evaluating SAT and SMT Solvers on Large-Scale Sudoku Puzzles
di: Davis, Liam, et al.
Pubblicazione: (2025)
di: Davis, Liam, et al.
Pubblicazione: (2025)
Inductive Generalization in Reinforcement Learning from Specifications
di: Subramanian, Vignesh, et al.
Pubblicazione: (2024)
di: Subramanian, Vignesh, et al.
Pubblicazione: (2024)
Compositional Shielding and Reinforcement Learning for Multi-Agent Systems
di: Brorholt, Asger Horn, et al.
Pubblicazione: (2024)
di: Brorholt, Asger Horn, et al.
Pubblicazione: (2024)
Thinking Out of the Box: Hybrid SAT Solving by Unconstrained Continuous Optimization
di: Zhang, Zhiwei, et al.
Pubblicazione: (2025)
di: Zhang, Zhiwei, et al.
Pubblicazione: (2025)
Learning Logic Specifications for Policy Guidance in POMDPs: an Inductive Logic Programming Approach
di: Meli, Daniele, et al.
Pubblicazione: (2024)
di: Meli, Daniele, et al.
Pubblicazione: (2024)
Neural DNF-MT: A Neuro-symbolic Approach for Learning Interpretable and Editable Policies
di: Baugh, Kexin Gu, et al.
Pubblicazione: (2025)
di: Baugh, Kexin Gu, et al.
Pubblicazione: (2025)
Value Function Initialization for Knowledge Transfer and Jump-start in Deep Reinforcement Learning
di: Mehimeh, Soumia
Pubblicazione: (2025)
di: Mehimeh, Soumia
Pubblicazione: (2025)
Do It for HER: First-Order Temporal Logic Reward Specification in Reinforcement Learning (Extended Version)
di: Olivieri, Pierriccardo, et al.
Pubblicazione: (2026)
di: Olivieri, Pierriccardo, et al.
Pubblicazione: (2026)
TurboSAT: Gradient-Guided Boolean Satisfiability Accelerated on GPU-CPU Hybrid System
di: Dai, Steve, et al.
Pubblicazione: (2025)
di: Dai, Steve, et al.
Pubblicazione: (2025)
SATBench: Benchmarking LLMs' Logical Reasoning via Automated Puzzle Generation from SAT Formulas
di: Wei, Anjiang, et al.
Pubblicazione: (2025)
di: Wei, Anjiang, et al.
Pubblicazione: (2025)
Integrating LTL Constraints into PPO for Safe Reinforcement Learning
di: Zhang, Maifang, et al.
Pubblicazione: (2026)
di: Zhang, Maifang, et al.
Pubblicazione: (2026)
Multitask Kernel-based Learning with First-Order Logic Constraints
di: Diligenti, Michelangelo, et al.
Pubblicazione: (2023)
di: Diligenti, Michelangelo, et al.
Pubblicazione: (2023)
An Incremental MaxSAT-based Model to Learn Interpretable and Balanced Classification Rules
di: Júnior, Antônio Carlos Souza Ferreira, et al.
Pubblicazione: (2024)
di: Júnior, Antônio Carlos Souza Ferreira, et al.
Pubblicazione: (2024)
Feasibility-Guided Fair Adaptive Offline Reinforcement Learning for Medicaid Care Management
di: Basu, Sanjay, et al.
Pubblicazione: (2025)
di: Basu, Sanjay, et al.
Pubblicazione: (2025)
Think Locally, Explain Globally: Graph-Guided LLM Investigations via Local Reasoning and Belief Propagation
di: Jha, Saurabh, et al.
Pubblicazione: (2026)
di: Jha, Saurabh, et al.
Pubblicazione: (2026)
Towards Safe Autonomous Driving Policies using a Neuro-Symbolic Deep Reinforcement Learning Approach
di: Sharifi, Iman, et al.
Pubblicazione: (2023)
di: Sharifi, Iman, et al.
Pubblicazione: (2023)
SATQuest: A Verifier for Logical Reasoning Evaluation and Reinforcement Fine-Tuning of LLMs
di: Zhao, Yanxiao, et al.
Pubblicazione: (2025)
di: Zhao, Yanxiao, et al.
Pubblicazione: (2025)
Formally Verified Neurosymbolic Trajectory Learning via Tensor-based Linear Temporal Logic on Finite Traces
di: Chevallier, Mark, et al.
Pubblicazione: (2025)
di: Chevallier, Mark, et al.
Pubblicazione: (2025)
Hyperproperty-Constrained Secure Reinforcement Learning
di: Bonnah, Ernest, et al.
Pubblicazione: (2025)
di: Bonnah, Ernest, et al.
Pubblicazione: (2025)
SATformer: Transformer-Based UNSAT Core Learning
di: Shi, Zhengyuan, et al.
Pubblicazione: (2022)
di: Shi, Zhengyuan, et al.
Pubblicazione: (2022)
Munkres' General Topology Autoformalized in Isabelle/HOL
di: Bryant, Dustin, et al.
Pubblicazione: (2026)
di: Bryant, Dustin, et al.
Pubblicazione: (2026)
Diverse Controllable Diffusion Policy with Signal Temporal Logic
di: Meng, Yue, et al.
Pubblicazione: (2025)
di: Meng, Yue, et al.
Pubblicazione: (2025)
DeepSeek-Prover-V1.5: Harnessing Proof Assistant Feedback for Reinforcement Learning and Monte-Carlo Tree Search
di: Xin, Huajian, et al.
Pubblicazione: (2024)
di: Xin, Huajian, et al.
Pubblicazione: (2024)
Comparing Neural Network Encodings for Logic-based Explainability
di: Carvalho, Levi Cordeiro, et al.
Pubblicazione: (2025)
di: Carvalho, Levi Cordeiro, et al.
Pubblicazione: (2025)
TGPO: Temporal Grounded Policy Optimization for Signal Temporal Logic Tasks
di: Meng, Yue, et al.
Pubblicazione: (2025)
di: Meng, Yue, et al.
Pubblicazione: (2025)
Learning to Solve and Optimize by Evolving Code
di: Semmelrock, Veronika, et al.
Pubblicazione: (2026)
di: Semmelrock, Veronika, et al.
Pubblicazione: (2026)
Machine Learning for Quantifier Selection in cvc5
di: Jakubův, Jan, et al.
Pubblicazione: (2024)
di: Jakubův, Jan, et al.
Pubblicazione: (2024)
Documenti analoghi
-
MathConstraint: Automated Generation of Verified Combinatorial Reasoning Instances for LLMs
di: Pati, Viresh, et al.
Pubblicazione: (2026) -
RLSF: Fine-tuning LLMs via Symbolic Feedback
di: Jha, Piyush, et al.
Pubblicazione: (2024) -
Can Transformers Reason Logically? A Study in SAT Solving
di: Pan, Leyan, et al.
Pubblicazione: (2024) -
Understanding CDCL Solvers via Scalability Studies and Proofdoors
di: Zhang, Shimin, et al.
Pubblicazione: (2026) -
Layered and Staged Monte Carlo Tree Search for SMT Strategy Synthesis
di: Lu, Zhengyang, et al.
Pubblicazione: (2024)