Efficient Reward Identification In Max Entropy Reinforcement Learning with Sparsity and Rank Priors
Fuente:
arXiv
Saved in:
| Main Authors: | Shehab, Mohamad Louai, Tercan, Alperen, Ozay, Necmiye |
|---|---|
| Format: | Preprint |
| Published: |
2025
|
| Subjects: | |
| Online Access: | |
| Tags: |
Add Tag
No Tags, Be the first to tag this record!
|
Similar Items
Learning Reward Machines from Partially Observed Policies
by: Shehab, Mohamad Louai, et al.
Published: (2025)
by: Shehab, Mohamad Louai, et al.
Published: (2025)
Initial Distribution Sensitivity of Constrained Markov Decision Processes
by: Tercan, Alperen, et al.
Published: (2025)
by: Tercan, Alperen, et al.
Published: (2025)
Active Reward Machine Inference From Raw State Trajectories
by: Shehab, Mohamad Louai, et al.
Published: (2026)
by: Shehab, Mohamad Louai, et al.
Published: (2026)
Thresholded Lexicographic Ordered Multiobjective Reinforcement Learning
by: Tercan, Alperen, et al.
Published: (2024)
by: Tercan, Alperen, et al.
Published: (2024)
Can Transformers Learn Optimal Filtering for Unknown Systems?
by: Balim, Haldun, et al.
Published: (2023)
by: Balim, Haldun, et al.
Published: (2023)
To the Max: Reinventing Reward in Reinforcement Learning
by: Veviurko, Grigorii, et al.
Published: (2024)
by: Veviurko, Grigorii, et al.
Published: (2024)
Identification and Adaptive Control of Markov Jump Systems: Sample Complexity and Regret Bounds
by: Sattar, Yahya, et al.
Published: (2021)
by: Sattar, Yahya, et al.
Published: (2021)
MaxCode: A Max-Reward Reinforcement Learning Framework for Automated Code Optimization
by: Ou, Jiefu, et al.
Published: (2026)
by: Ou, Jiefu, et al.
Published: (2026)
Reward-Punishment Reinforcement Learning with Maximum Entropy
by: Wang, Jiexin, et al.
Published: (2024)
by: Wang, Jiexin, et al.
Published: (2024)
Max-Entropy Reinforcement Learning with Flow Matching and A Case Study on LQR
by: Zhang, Yuyang, et al.
Published: (2025)
by: Zhang, Yuyang, et al.
Published: (2025)
R-Sparse: Rank-Aware Activation Sparsity for Efficient LLM Inference
by: Zhang, Zhenyu, et al.
Published: (2025)
by: Zhang, Zhenyu, et al.
Published: (2025)
Exploiting Subgradient Sparsity in Max-Plus Neural Networks
by: Enaieh, Ikhlas, et al.
Published: (2026)
by: Enaieh, Ikhlas, et al.
Published: (2026)
Sparsity Forcing: Reinforcing Token Sparsity of MLLMs
by: Chen, Feng, et al.
Published: (2025)
by: Chen, Feng, et al.
Published: (2025)
Reinforcement Learning for Power-Flow Network Analysis
by: Ergur, Alperen, et al.
Published: (2026)
by: Ergur, Alperen, et al.
Published: (2026)
Provable Multi-Task Reinforcement Learning: A Representation Learning Framework with Low Rank Rewards
by: Guo, Yaoze, et al.
Published: (2026)
by: Guo, Yaoze, et al.
Published: (2026)
R^3: Replay, Reflection, and Ranking Rewards for LLM Reinforcement Learning
by: Jiang, Zhizheng, et al.
Published: (2026)
by: Jiang, Zhizheng, et al.
Published: (2026)
Reward Distance Comparisons Under Transition Sparsity
by: Nyanhongo, Clement, et al.
Published: (2025)
by: Nyanhongo, Clement, et al.
Published: (2025)
Average-Reward Maximum Entropy Reinforcement Learning for Underactuated Double Pendulum Tasks
by: Choe, Jean Seong Bjorn, et al.
Published: (2024)
by: Choe, Jean Seong Bjorn, et al.
Published: (2024)
Efficient Reinforcement Learning with Large Language Model Priors
by: Yan, Xue, et al.
Published: (2024)
by: Yan, Xue, et al.
Published: (2024)
ResponseRank: Data-Efficient Reward Modeling through Preference Strength Learning
by: Kaufmann, Timo, et al.
Published: (2025)
by: Kaufmann, Timo, et al.
Published: (2025)
Efficient Reinforcement Learning in Probabilistic Reward Machines
by: Lin, Xiaofeng, et al.
Published: (2024)
by: Lin, Xiaofeng, et al.
Published: (2024)
System Identification Under Bounded Noise: Optimal Rates Beyond Least Squares
by: Zeng, Xiong, et al.
Published: (2025)
by: Zeng, Xiong, et al.
Published: (2025)
Task Weighting through Gradient Projection for Multitask Learning
by: Bohn, Christian, et al.
Published: (2024)
by: Bohn, Christian, et al.
Published: (2024)
schlably: A Python Framework for Deep Reinforcement Learning Based Scheduling Experiments
by: de Puiseau, Constantin Waubert, et al.
Published: (2023)
by: de Puiseau, Constantin Waubert, et al.
Published: (2023)
Provably Sample-Efficient Robust Reinforcement Learning with Average Reward
by: Roch, Zachary, et al.
Published: (2025)
by: Roch, Zachary, et al.
Published: (2025)
Contextual Pre-planning on Reward Machine Abstractions for Enhanced Transfer in Deep Reinforcement Learning
by: Azran, Guy, et al.
Published: (2023)
by: Azran, Guy, et al.
Published: (2023)
LLM Sparsity Prior for Robust Feature Selection
by: Skinner, Caleb, et al.
Published: (2026)
by: Skinner, Caleb, et al.
Published: (2026)
Oracle-Efficient Reinforcement Learning for Max Value Ensembles
by: Hussing, Marcel, et al.
Published: (2024)
by: Hussing, Marcel, et al.
Published: (2024)
Max-Rank: Efficient Multiple Testing for Conformal Prediction
by: Timans, Alexander, et al.
Published: (2023)
by: Timans, Alexander, et al.
Published: (2023)
RewardRank: Optimizing True Learning-to-Rank Utility
by: Bhatt, Gaurav, et al.
Published: (2025)
by: Bhatt, Gaurav, et al.
Published: (2025)
Conservative and Risk-Aware Offline Multi-Agent Reinforcement Learning
by: Eldeeb, Eslam, et al.
Published: (2024)
by: Eldeeb, Eslam, et al.
Published: (2024)
Safe, Efficient, and Robust Reinforcement Learning for Ranking and Diffusion Models
by: Gupta, Shashank
Published: (2025)
by: Gupta, Shashank
Published: (2025)
Beyond Training: Optimizing Reinforcement Learning Based Job Shop Scheduling Through Adaptive Action Sampling
by: de Puiseau, Constantin Waubert, et al.
Published: (2024)
by: de Puiseau, Constantin Waubert, et al.
Published: (2024)
A Simulation Preorder for Koopman-like Lifted Control Systems
by: Aspeel, Antoine, et al.
Published: (2024)
by: Aspeel, Antoine, et al.
Published: (2024)
Reward-Conditioned Reinforcement Learning
by: Nauman, Michal, et al.
Published: (2026)
by: Nauman, Michal, et al.
Published: (2026)
Boosting Robustness in Preference-Based Reinforcement Learning with Dynamic Sparsity
by: Muslimani, Calarina, et al.
Published: (2024)
by: Muslimani, Calarina, et al.
Published: (2024)
Revisiting Sparsity Constraint Under High-Rank Property in Partial Multi-Label Learning
by: Si, Chongjie, et al.
Published: (2025)
by: Si, Chongjie, et al.
Published: (2025)
Activity Sparsity Complements Weight Sparsity for Efficient RNN Inference
by: Mukherji, Rishav, et al.
Published: (2023)
by: Mukherji, Rishav, et al.
Published: (2023)
Learning to Correct: Calibrated Reinforcement Learning for Multi-Attempt Chain-of-Thought
by: Ildiz, Muhammed Emrullah, et al.
Published: (2026)
by: Ildiz, Muhammed Emrullah, et al.
Published: (2026)
Highly Efficient Self-Adaptive Reward Shaping for Reinforcement Learning
by: Ma, Haozhe, et al.
Published: (2024)
by: Ma, Haozhe, et al.
Published: (2024)
Similar Items
-
Learning Reward Machines from Partially Observed Policies
by: Shehab, Mohamad Louai, et al.
Published: (2025) -
Initial Distribution Sensitivity of Constrained Markov Decision Processes
by: Tercan, Alperen, et al.
Published: (2025) -
Active Reward Machine Inference From Raw State Trajectories
by: Shehab, Mohamad Louai, et al.
Published: (2026) -
Thresholded Lexicographic Ordered Multiobjective Reinforcement Learning
by: Tercan, Alperen, et al.
Published: (2024) -
Can Transformers Learn Optimal Filtering for Unknown Systems?
by: Balim, Haldun, et al.
Published: (2023)