Cooperative Inverse Reinforcement Learning
Fuente:
arXiv
Salvato in:
| Autori principali: | Hadfield-Menell, Dylan, Dragan, Anca, Abbeel, Pieter, Russell, Stuart |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2016
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Alignment Tampering: How Reinforcement Learning from Human Feedback Is Exploited to Optimize Misaligned Biases
di: Hahm, Dongyoon, et al.
Pubblicazione: (2026)
di: Hahm, Dongyoon, et al.
Pubblicazione: (2026)
Distributional Preference Learning: Understanding and Accounting for Hidden Context in RLHF
di: Siththaranjan, Anand, et al.
Pubblicazione: (2023)
di: Siththaranjan, Anand, et al.
Pubblicazione: (2023)
Distributional Process Reward Models: Calibrated Prediction of Future Rewards via Conditional Optimal Transport
di: Ma, Rachel, et al.
Pubblicazione: (2026)
di: Ma, Rachel, et al.
Pubblicazione: (2026)
Disjoint Processing Mechanisms of Hierarchical and Linear Grammars in Large Language Models
di: Sankaranarayanan, Aruna, et al.
Pubblicazione: (2025)
di: Sankaranarayanan, Aruna, et al.
Pubblicazione: (2025)
Prompt Injection as Role Confusion
di: Ye, Charles, et al.
Pubblicazione: (2026)
di: Ye, Charles, et al.
Pubblicazione: (2026)
When Your AIs Deceive You: Challenges of Partial Observability in Reinforcement Learning from Human Feedback
di: Lang, Leon, et al.
Pubblicazione: (2024)
di: Lang, Leon, et al.
Pubblicazione: (2024)
The Effective Horizon Explains Deep RL Performance in Stochastic Environments
di: Laidlaw, Cassidy, et al.
Pubblicazione: (2023)
di: Laidlaw, Cassidy, et al.
Pubblicazione: (2023)
Goal Inference from Open-Ended Dialog
di: Ma, Rachel, et al.
Pubblicazione: (2024)
di: Ma, Rachel, et al.
Pubblicazione: (2024)
Learning to Model the World with Language
di: Lin, Jessy, et al.
Pubblicazione: (2023)
di: Lin, Jessy, et al.
Pubblicazione: (2023)
Defending Against Unforeseen Failure Modes with Latent Adversarial Training
di: Casper, Stephen, et al.
Pubblicazione: (2024)
di: Casper, Stephen, et al.
Pubblicazione: (2024)
Coarse-to-fine Q-Network with Action Sequence for Data-Efficient Reinforcement Learning
di: Seo, Younggyo, et al.
Pubblicazione: (2024)
di: Seo, Younggyo, et al.
Pubblicazione: (2024)
Flexible Agent Alignment with Goal Inference from Open-Ended Dialog
di: Ma, Rachel, et al.
Pubblicazione: (2025)
di: Ma, Rachel, et al.
Pubblicazione: (2025)
AI Alignment with Changing and Influenceable Reward Functions
di: Carroll, Micah, et al.
Pubblicazione: (2024)
di: Carroll, Micah, et al.
Pubblicazione: (2024)
A Generalized Acquisition Function for Preference-based Reward Learning
di: Ellis, Evan, et al.
Pubblicazione: (2024)
di: Ellis, Evan, et al.
Pubblicazione: (2024)
DreamSmooth: Improving Model-based Reinforcement Learning via Reward Smoothing
di: Lee, Vint, et al.
Pubblicazione: (2023)
di: Lee, Vint, et al.
Pubblicazione: (2023)
AssistanceZero: Scalably Solving Assistance Games
di: Laidlaw, Cassidy, et al.
Pubblicazione: (2025)
di: Laidlaw, Cassidy, et al.
Pubblicazione: (2025)
Benchmarking and Improving Monitors for Out-Of-Distribution Alignment Failure in LLMs
di: Feng, Dylan, et al.
Pubblicazione: (2026)
di: Feng, Dylan, et al.
Pubblicazione: (2026)
Accelerating Reinforcement Learning with Value-Conditional State Entropy Exploration
di: Kim, Dongyoung, et al.
Pubblicazione: (2023)
di: Kim, Dongyoung, et al.
Pubblicazione: (2023)
Unsupervised Zero-Shot Reinforcement Learning via Functional Reward Encodings
di: Frans, Kevin, et al.
Pubblicazione: (2024)
di: Frans, Kevin, et al.
Pubblicazione: (2024)
Interactive Dialogue Agents via Reinforcement Learning on Hindsight Regenerations
di: Hong, Joey, et al.
Pubblicazione: (2024)
di: Hong, Joey, et al.
Pubblicazione: (2024)
Offline Imitation Learning Through Graph Search and Retrieval
di: Yin, Zhao-Heng, et al.
Pubblicazione: (2024)
di: Yin, Zhao-Heng, et al.
Pubblicazione: (2024)
Formal Contracts Mitigate Social Dilemmas in Multi-Agent RL
di: Haupt, Andreas A., et al.
Pubblicazione: (2022)
di: Haupt, Andreas A., et al.
Pubblicazione: (2022)
When Does Non-Uniform Replay Matter in Reinforcement Learning?
di: Korniak, Michal, et al.
Pubblicazione: (2026)
di: Korniak, Michal, et al.
Pubblicazione: (2026)
Q-SFT: Q-Learning for Language Models via Supervised Fine-Tuning
di: Hong, Joey, et al.
Pubblicazione: (2024)
di: Hong, Joey, et al.
Pubblicazione: (2024)
Coprocessor Actor Critic: A Model-Based Reinforcement Learning Approach For Adaptive Brain Stimulation
di: Pan, Michelle, et al.
Pubblicazione: (2024)
di: Pan, Michelle, et al.
Pubblicazione: (2024)
Planning without Search: Refining Frontier LLMs with Offline Goal-Conditioned RL
di: Hong, Joey, et al.
Pubblicazione: (2025)
di: Hong, Joey, et al.
Pubblicazione: (2025)
Correlated Proxies: A New Definition and Improved Mitigation for Reward Hacking
di: Laidlaw, Cassidy, et al.
Pubblicazione: (2024)
di: Laidlaw, Cassidy, et al.
Pubblicazione: (2024)
Reinforcement Learning for Versatile, Dynamic, and Robust Bipedal Locomotion Control
di: Li, Zhongyu, et al.
Pubblicazione: (2024)
di: Li, Zhongyu, et al.
Pubblicazione: (2024)
Learning a Diffusion Model Policy from Rewards via Q-Score Matching
di: Psenka, Michael, et al.
Pubblicazione: (2023)
di: Psenka, Michael, et al.
Pubblicazione: (2023)
FastTD3: Simple, Fast, and Capable Reinforcement Learning for Humanoid Control
di: Seo, Younggyo, et al.
Pubblicazione: (2025)
di: Seo, Younggyo, et al.
Pubblicazione: (2025)
Adversaries Can Misuse Combinations of Safe Models
di: Jones, Erik, et al.
Pubblicazione: (2024)
di: Jones, Erik, et al.
Pubblicazione: (2024)
Cliqueformer: Model-Based Optimization with Structured Transformers
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2024)
di: Kuba, Jakub Grudzien, et al.
Pubblicazione: (2024)
Learning Temporal Distances: Contrastive Successor Features Can Provide a Metric Structure for Decision-Making
di: Myers, Vivek, et al.
Pubblicazione: (2024)
di: Myers, Vivek, et al.
Pubblicazione: (2024)
MOKA: Open-World Robotic Manipulation through Mark-Based Visual Prompting
di: Liu, Fangchen, et al.
Pubblicazione: (2024)
di: Liu, Fangchen, et al.
Pubblicazione: (2024)
From LLMs to Actions: Latent Codes as Bridges in Hierarchical Robot Control
di: Shentu, Yide, et al.
Pubblicazione: (2024)
di: Shentu, Yide, et al.
Pubblicazione: (2024)
Reinforcement Learning with Foundation Priors: Let the Embodied Agent Efficiently Learn on Its Own
di: Ye, Weirui, et al.
Pubblicazione: (2023)
di: Ye, Weirui, et al.
Pubblicazione: (2023)
Learning Interactive Real-World Simulators
di: Yang, Sherry, et al.
Pubblicazione: (2023)
di: Yang, Sherry, et al.
Pubblicazione: (2023)
Object-centric 3D Motion Field for Robot Learning from Human Videos
di: Yin, Zhao-Heng, et al.
Pubblicazione: (2025)
di: Yin, Zhao-Heng, et al.
Pubblicazione: (2025)
Lightning Grasp: High Performance Procedural Grasp Synthesis with Contact Fields
di: Yin, Zhao-Heng, et al.
Pubblicazione: (2025)
di: Yin, Zhao-Heng, et al.
Pubblicazione: (2025)
Semi-Supervised One-Shot Imitation Learning
di: Wu, Philipp, et al.
Pubblicazione: (2024)
di: Wu, Philipp, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Alignment Tampering: How Reinforcement Learning from Human Feedback Is Exploited to Optimize Misaligned Biases
di: Hahm, Dongyoon, et al.
Pubblicazione: (2026) -
Distributional Preference Learning: Understanding and Accounting for Hidden Context in RLHF
di: Siththaranjan, Anand, et al.
Pubblicazione: (2023) -
Distributional Process Reward Models: Calibrated Prediction of Future Rewards via Conditional Optimal Transport
di: Ma, Rachel, et al.
Pubblicazione: (2026) -
Disjoint Processing Mechanisms of Hierarchical and Linear Grammars in Large Language Models
di: Sankaranarayanan, Aruna, et al.
Pubblicazione: (2025) -
Prompt Injection as Role Confusion
di: Ye, Charles, et al.
Pubblicazione: (2026)