SpecRLBench: A Benchmark for Generalization in Specification-Guided Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Guo, Zijian, Işık, İlker, Ahmad, H. M. Sabbir, Li, Wenchao |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2026
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
One Subgoal at a Time: Zero-Shot Generalization to Arbitrary Linear Temporal Logic Requirements in Multi-Task Reinforcement Learning
di: Guo, Zijian, et al.
Pubblicazione: (2025)
di: Guo, Zijian, et al.
Pubblicazione: (2025)
Names Don't Matter: Symbol-Invariant Transformer for Open-Vocabulary Learning
di: Işık, İlker, et al.
Pubblicazione: (2026)
di: Işık, İlker, et al.
Pubblicazione: (2026)
Temporal Logic Specification-Conditioned Decision Transformer for Offline Safe Reinforcement Learning
di: Guo, Zijian, et al.
Pubblicazione: (2024)
di: Guo, Zijian, et al.
Pubblicazione: (2024)
RLBenchNet: The Right Network for the Right Reinforcement Learning Task
di: Smirnov, Ivan, et al.
Pubblicazione: (2025)
di: Smirnov, Ivan, et al.
Pubblicazione: (2025)
Hierarchical Multi-Agent Reinforcement Learning with Control Barrier Functions for Safety-Critical Autonomous Systems
di: Ahmad, H. M. Sabbir, et al.
Pubblicazione: (2025)
di: Ahmad, H. M. Sabbir, et al.
Pubblicazione: (2025)
Learning to Estimate System Specifications in Linear Temporal Logic using Transformers and Mamba
di: Işık, İlker, et al.
Pubblicazione: (2024)
di: Işık, İlker, et al.
Pubblicazione: (2024)
PAGAR: Taming Reward Misalignment in Inverse Reinforcement Learning-Based Imitation Learning with Protagonist Antagonist Guided Adversarial Reward
di: Zhou, Weichao, et al.
Pubblicazione: (2023)
di: Zhou, Weichao, et al.
Pubblicazione: (2023)
AutoSpec: Automated Generation of Neural Network Specifications
di: Jin, Shuowei, et al.
Pubblicazione: (2024)
di: Jin, Shuowei, et al.
Pubblicazione: (2024)
SpecMER: Fast Protein Generation with K-mer Guided Speculative Decoding
di: Walton, Thomas, et al.
Pubblicazione: (2025)
di: Walton, Thomas, et al.
Pubblicazione: (2025)
Rethinking Inverse Reinforcement Learning: from Data Alignment to Task Alignment
di: Zhou, Weichao, et al.
Pubblicazione: (2024)
di: Zhou, Weichao, et al.
Pubblicazione: (2024)
Interchangeable Token Embeddings for Extendable Vocabulary and Alpha-Equivalence
di: Işık, İlker, et al.
Pubblicazione: (2024)
di: Işık, İlker, et al.
Pubblicazione: (2024)
ReSpec: Towards Optimizing Speculative Decoding in Reinforcement Learning Systems
di: Chen, Qiaoling, et al.
Pubblicazione: (2025)
di: Chen, Qiaoling, et al.
Pubblicazione: (2025)
BubbleSpec: Turning Long-Tail Bubbles into Speculative Rollout Drafts for Synchronous Reinforcement Learning
di: Xu, Yuhang, et al.
Pubblicazione: (2026)
di: Xu, Yuhang, et al.
Pubblicazione: (2026)
Learning First Integrals via Backward-Generated Data and Guided Reinforcement Learning
di: Zhong, Jingfeng, et al.
Pubblicazione: (2026)
di: Zhong, Jingfeng, et al.
Pubblicazione: (2026)
VLM-UQBench: A Benchmark for Modality-Specific and Cross-Modality Uncertainties in Vision Language Models
di: Wang, Chenyu, et al.
Pubblicazione: (2026)
di: Wang, Chenyu, et al.
Pubblicazione: (2026)
Reinforcement Learning-Guided Semi-Supervised Learning
di: Heidari, Marzi, et al.
Pubblicazione: (2024)
di: Heidari, Marzi, et al.
Pubblicazione: (2024)
PepSpecBench: A Unified Evaluation Benchmark for Peptide Tandem Mass Spectrometry Prediction
di: Yang, Zhiwen, et al.
Pubblicazione: (2026)
di: Yang, Zhiwen, et al.
Pubblicazione: (2026)
SpecXMaster Technical Report
di: Ge, Yutang, et al.
Pubblicazione: (2026)
di: Ge, Yutang, et al.
Pubblicazione: (2026)
Behavioral Entropy-Guided Dataset Generation for Offline Reinforcement Learning
di: Suttle, Wesley A., et al.
Pubblicazione: (2025)
di: Suttle, Wesley A., et al.
Pubblicazione: (2025)
SpecMol: A Spectroscopy-Grounded Foundation Model for Multi-Task Molecular Learning
di: Shen, Shuaike, et al.
Pubblicazione: (2025)
di: Shen, Shuaike, et al.
Pubblicazione: (2025)
On The Expressivity of Objective-Specification Formalisms in Reinforcement Learning
di: Subramani, Rohan, et al.
Pubblicazione: (2023)
di: Subramani, Rohan, et al.
Pubblicazione: (2023)
Effective Reward Specification in Deep Reinforcement Learning
di: Roy, Julien
Pubblicazione: (2024)
di: Roy, Julien
Pubblicazione: (2024)
Inductive Generalization in Reinforcement Learning from Specifications
di: Subramanian, Vignesh, et al.
Pubblicazione: (2024)
di: Subramanian, Vignesh, et al.
Pubblicazione: (2024)
Reinforcement Learning for Game-Theoretic Resource Allocation on Graphs
di: An, Zijian, et al.
Pubblicazione: (2025)
di: An, Zijian, et al.
Pubblicazione: (2025)
ReSpec: Relevance and Specificity Grounded Online Filtering for Learning on Video-Text Data Streams
di: Kim, Chris Dongjoo, et al.
Pubblicazione: (2025)
di: Kim, Chris Dongjoo, et al.
Pubblicazione: (2025)
Benchmark Success, Clinical Failure: When Reinforcement Learning Optimizes for Benchmarks, Not Patients
di: Berger, Armin, et al.
Pubblicazione: (2025)
di: Berger, Armin, et al.
Pubblicazione: (2025)
Preference-Guided Reinforcement Learning for Efficient Exploration
di: Wang, Guojian, et al.
Pubblicazione: (2024)
di: Wang, Guojian, et al.
Pubblicazione: (2024)
Cross-Domain Energy-Guided Diffusion Generation for Off-Dynamics Reinforcement Learning
di: Yang, Yu, et al.
Pubblicazione: (2026)
di: Yang, Yu, et al.
Pubblicazione: (2026)
Reinforcement Learning by Guided Safe Exploration
di: Yang, Qisong, et al.
Pubblicazione: (2023)
di: Yang, Qisong, et al.
Pubblicazione: (2023)
DeLF: Designing Learning Environments with Foundation Models
di: Afshar, Aida, et al.
Pubblicazione: (2024)
di: Afshar, Aida, et al.
Pubblicazione: (2024)
SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning
di: Li, Na, et al.
Pubblicazione: (2025)
di: Li, Na, et al.
Pubblicazione: (2025)
Self-Supervised Curriculum Generation for Autonomous Reinforcement Learning without Task-Specific Knowledge
di: Lee, Sang-Hyun, et al.
Pubblicazione: (2023)
di: Lee, Sang-Hyun, et al.
Pubblicazione: (2023)
FormalSpecCpp: A Dataset of C++ Formal Specifications created using LLMs
di: Chakraborty, Madhurima, et al.
Pubblicazione: (2025)
di: Chakraborty, Madhurima, et al.
Pubblicazione: (2025)
Learning with Subset Stacking
di: Birbil, Ş. İlker, et al.
Pubblicazione: (2021)
di: Birbil, Ş. İlker, et al.
Pubblicazione: (2021)
Generating Samples to Probe Trained Models
di: Kıral, Eren Mehmet, et al.
Pubblicazione: (2025)
di: Kıral, Eren Mehmet, et al.
Pubblicazione: (2025)
Inferring Behavior-Specific Context Improves Zero-Shot Generalization in Reinforcement Learning
di: Ndir, Tidiane Camaret, et al.
Pubblicazione: (2024)
di: Ndir, Tidiane Camaret, et al.
Pubblicazione: (2024)
Learning An Interpretable Risk Scoring System for Maximizing Decision Net Benefit
di: Chi, Wenhao, et al.
Pubblicazione: (2026)
di: Chi, Wenhao, et al.
Pubblicazione: (2026)
MoE-Spec: Expert Budgeting for Efficient Speculative Decoding
di: McDanel, Bradley, et al.
Pubblicazione: (2026)
di: McDanel, Bradley, et al.
Pubblicazione: (2026)
Position: Benchmarking is Limited in Reinforcement Learning Research
di: Jordan, Scott M., et al.
Pubblicazione: (2024)
di: Jordan, Scott M., et al.
Pubblicazione: (2024)
Guiding Diffusion Models with Reinforcement Learning for Stable Molecule Generation
di: Zhou, Zhijian, et al.
Pubblicazione: (2025)
di: Zhou, Zhijian, et al.
Pubblicazione: (2025)
Documenti analoghi
-
One Subgoal at a Time: Zero-Shot Generalization to Arbitrary Linear Temporal Logic Requirements in Multi-Task Reinforcement Learning
di: Guo, Zijian, et al.
Pubblicazione: (2025) -
Names Don't Matter: Symbol-Invariant Transformer for Open-Vocabulary Learning
di: Işık, İlker, et al.
Pubblicazione: (2026) -
Temporal Logic Specification-Conditioned Decision Transformer for Offline Safe Reinforcement Learning
di: Guo, Zijian, et al.
Pubblicazione: (2024) -
RLBenchNet: The Right Network for the Right Reinforcement Learning Task
di: Smirnov, Ivan, et al.
Pubblicazione: (2025) -
Hierarchical Multi-Agent Reinforcement Learning with Control Barrier Functions for Safety-Critical Autonomous Systems
di: Ahmad, H. M. Sabbir, et al.
Pubblicazione: (2025)