Enregistré dans:
| Auteurs principaux: | Zhang, Yangchun, Zhou, Wang, Zhou, Yirui |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2410.07643 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Rethinking Adversarial Inverse Reinforcement Learning: Policy Imitation, Transferable Reward Recovery and Algebraic Equilibrium Proof
par: Zhang, Yangchun, et autres
Publié: (2024)
par: Zhang, Yangchun, et autres
Publié: (2024)
On Generalization and Distributional Update for Mimicking Observations with Adequate Exploration
par: Zhou, Yirui, et autres
Publié: (2025)
par: Zhou, Yirui, et autres
Publié: (2025)
PAGAR: Taming Reward Misalignment in Inverse Reinforcement Learning-Based Imitation Learning with Protagonist Antagonist Guided Adversarial Reward
par: Zhou, Weichao, et autres
Publié: (2023)
par: Zhou, Weichao, et autres
Publié: (2023)
Reward Transfer from Inverse Reinforcement Learning: A Coupled Minimax Approach
par: Hao, Guang-Yuan, et autres
Publié: (2026)
par: Hao, Guang-Yuan, et autres
Publié: (2026)
Learning Rewards, Not Labels: Adversarial Inverse Reinforcement Learning for Machinery Fault Detection
par: Neupane, Dhiraj, et autres
Publié: (2026)
par: Neupane, Dhiraj, et autres
Publié: (2026)
Towards the Transferability of Rewards Recovered via Regularized Inverse Reinforcement Learning
par: Schlaginhaufen, Andreas, et autres
Publié: (2024)
par: Schlaginhaufen, Andreas, et autres
Publié: (2024)
Adversarial Inverse Reinforcement Learning for Mean Field Games
par: Chen, Yang, et autres
Publié: (2021)
par: Chen, Yang, et autres
Publié: (2021)
On Feasible Rewards in Multi-Agent Inverse Reinforcement Learning
par: Freihaut, Till, et autres
Publié: (2024)
par: Freihaut, Till, et autres
Publié: (2024)
Bayesian Inverse Reinforcement Learning for Non-Markovian Rewards
par: Topper, Noah, et autres
Publié: (2024)
par: Topper, Noah, et autres
Publié: (2024)
Enhancing Security in Deep Reinforcement Learning: A Comprehensive Survey on Adversarial Attacks and Defenses
par: Yichao, Wu, et autres
Publié: (2025)
par: Yichao, Wu, et autres
Publié: (2025)
Multi Task Inverse Reinforcement Learning for Common Sense Reward
par: Glazer, Neta, et autres
Publié: (2024)
par: Glazer, Neta, et autres
Publié: (2024)
Reward-Relevance-Filtered Linear Offline Reinforcement Learning
par: Zhou, Angela
Publié: (2024)
par: Zhou, Angela
Publié: (2024)
IR$^3$: Contrastive Inverse Reinforcement Learning for Interpretable Detection and Mitigation of Reward Hacking
par: Beigi, Mohammad, et autres
Publié: (2026)
par: Beigi, Mohammad, et autres
Publié: (2026)
Unveiling the Role of Randomization in Multiclass Adversarial Classification: Insights from Graph Theory
par: Gnecco-Heredia, Lucas, et autres
Publié: (2025)
par: Gnecco-Heredia, Lucas, et autres
Publié: (2025)
Optimal Transfer Learning for Missing Not-at-Random Matrix Completion
par: Jalan, Akhil, et autres
Publié: (2025)
par: Jalan, Akhil, et autres
Publié: (2025)
Inverse Reinforcement Learning with Dynamic Reward Scaling for LLM Alignment
par: Cheng, Ruoxi, et autres
Publié: (2025)
par: Cheng, Ruoxi, et autres
Publié: (2025)
Enhancing Inverse Reinforcement Learning through Encoding Dynamic Information in Reward Shaping
par: Zhan, Simon Sinong, et autres
Publié: (2024)
par: Zhan, Simon Sinong, et autres
Publié: (2024)
Beyond Binary: Turning Partial Success into Dense Verifiable Rewards for Reinforcement Learning in Code Generation
par: Wang, Longwen, et autres
Publié: (2026)
par: Wang, Longwen, et autres
Publié: (2026)
Inverse Reinforcement Learning with Switching Rewards and History Dependency for Characterizing Animal Behaviors
par: Ke, Jingyang, et autres
Publié: (2025)
par: Ke, Jingyang, et autres
Publié: (2025)
Focal Reward: Balanced Reinforcement Learning under Rubric-Based Rewards
par: Huang, Yu, et autres
Publié: (2026)
par: Huang, Yu, et autres
Publié: (2026)
Maximizing the Potential of Synthetic Data: Insights from Random Matrix Theory
par: Firdoussi, Aymane El, et autres
Publié: (2024)
par: Firdoussi, Aymane El, et autres
Publié: (2024)
Rethinking Inverse Reinforcement Learning: from Data Alignment to Task Alignment
par: Zhou, Weichao, et autres
Publié: (2024)
par: Zhou, Weichao, et autres
Publié: (2024)
Inverse Reinforcement Learning without an Optimal Demonstrator: A Feasible Reward Set Approach
par: Kim, Kihyun, et autres
Publié: (2026)
par: Kim, Kihyun, et autres
Publié: (2026)
Enhancing Accuracy in Deep Learning Using Random Matrix Theory
par: Berlyand, Leonid, et autres
Publié: (2023)
par: Berlyand, Leonid, et autres
Publié: (2023)
Shrinking the Variance: Shrinkage Baselines for Reinforcement Learning with Verifiable Rewards
par: Zeng, Guanning, et autres
Publié: (2025)
par: Zeng, Guanning, et autres
Publié: (2025)
Transferability Bound Theory: Exploring Relationship between Adversarial Transferability and Flatness
par: Fan, Mingyuan, et autres
Publié: (2023)
par: Fan, Mingyuan, et autres
Publié: (2023)
On the Generalization of SFT: A Reinforcement Learning Perspective with Reward Rectification
par: Wu, Yongliang, et autres
Publié: (2025)
par: Wu, Yongliang, et autres
Publié: (2025)
Provably Efficient Reward Transfer in Reinforcement Learning with Discrete Markov Decision Processes
par: Vora, Kevin, et autres
Publié: (2025)
par: Vora, Kevin, et autres
Publié: (2025)
Certifiably-Robust Federated Adversarial Learning via Randomized Smoothing
par: Chen, Cheng, et autres
Publié: (2021)
par: Chen, Cheng, et autres
Publié: (2021)
TW-CRL: Time-Weighted Contrastive Reward Learning for Efficient Inverse Reinforcement Learning
par: Li, Yuxuan, et autres
Publié: (2025)
par: Li, Yuxuan, et autres
Publié: (2025)
Generalizing Behavior via Inverse Reinforcement Learning with Closed-Form Reward Centroids
par: Lazzati, Filippo, et autres
Publié: (2025)
par: Lazzati, Filippo, et autres
Publié: (2025)
Multi-Objective and Mixed-Reward Reinforcement Learning via Reward-Decorrelated Policy Optimization
par: Bai, Yang, et autres
Publié: (2026)
par: Bai, Yang, et autres
Publié: (2026)
Decision-Focused Model-based Reinforcement Learning for Reward Transfer
par: Sharma, Abhishek, et autres
Publié: (2023)
par: Sharma, Abhishek, et autres
Publié: (2023)
Multi-Agent Reinforcement Learning with Submodular Reward
par: Chen, Wenjing, et autres
Publié: (2026)
par: Chen, Wenjing, et autres
Publié: (2026)
Towards High Data Efficiency in Reinforcement Learning with Verifiable Reward
par: Tang, Xinyu, et autres
Publié: (2025)
par: Tang, Xinyu, et autres
Publié: (2025)
Non-Adversarial Inverse Reinforcement Learning via Successor Feature Matching
par: Jain, Arnav Kumar, et autres
Publié: (2024)
par: Jain, Arnav Kumar, et autres
Publié: (2024)
Trajectory Modeling via Random Utility Inverse Reinforcement Learning
par: Pitombeira-Neto, Anselmo R., et autres
Publié: (2021)
par: Pitombeira-Neto, Anselmo R., et autres
Publié: (2021)
Random Matrix Theory for Deep Learning: Beyond Eigenvalues of Linear Models
par: Liao, Zhenyu, et autres
Publié: (2025)
par: Liao, Zhenyu, et autres
Publié: (2025)
Diffusion-Reward Adversarial Imitation Learning
par: Lai, Chun-Mao, et autres
Publié: (2024)
par: Lai, Chun-Mao, et autres
Publié: (2024)
Towards Generalized Inverse Reinforcement Learning
par: Dong, Chaosheng, et autres
Publié: (2024)
par: Dong, Chaosheng, et autres
Publié: (2024)
Documents similaires
-
Rethinking Adversarial Inverse Reinforcement Learning: Policy Imitation, Transferable Reward Recovery and Algebraic Equilibrium Proof
par: Zhang, Yangchun, et autres
Publié: (2024) -
On Generalization and Distributional Update for Mimicking Observations with Adequate Exploration
par: Zhou, Yirui, et autres
Publié: (2025) -
PAGAR: Taming Reward Misalignment in Inverse Reinforcement Learning-Based Imitation Learning with Protagonist Antagonist Guided Adversarial Reward
par: Zhou, Weichao, et autres
Publié: (2023) -
Reward Transfer from Inverse Reinforcement Learning: A Coupled Minimax Approach
par: Hao, Guang-Yuan, et autres
Publié: (2026) -
Learning Rewards, Not Labels: Adversarial Inverse Reinforcement Learning for Machinery Fault Detection
par: Neupane, Dhiraj, et autres
Publié: (2026)