Guardado en:
| Autores principales: | Liu, Yi, Datta, Gaurav, Novoseller, Ellen, Brown, Daniel S. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2023
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2301.04741 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Crowd-PrefRL: Preference-Based Reward Learning from Crowds
por: Chhan, David, et al.
Publicado: (2024)
por: Chhan, David, et al.
Publicado: (2024)
GraphAllocBench: A Flexible Benchmark for Preference-Conditioned Multi-Objective Policy Learning
por: Jiang, Zhiheng, et al.
Publicado: (2026)
por: Jiang, Zhiheng, et al.
Publicado: (2026)
Rating-based Reinforcement Learning
por: White, Devin, et al.
Publicado: (2023)
por: White, Devin, et al.
Publicado: (2023)
Multi-Type Preference Learning: Empowering Preference-Based Reinforcement Learning with Equal Preferences
por: Liu, Ziang, et al.
Publicado: (2024)
por: Liu, Ziang, et al.
Publicado: (2024)
Preference-Guided Reinforcement Learning for Efficient Exploration
por: Wang, Guojian, et al.
Publicado: (2024)
por: Wang, Guojian, et al.
Publicado: (2024)
Boosting Robustness in Preference-Based Reinforcement Learning with Dynamic Sparsity
por: Muslimani, Calarina, et al.
Publicado: (2024)
por: Muslimani, Calarina, et al.
Publicado: (2024)
Efficient Deep Learning: A Survey on Making Deep Learning Models Smaller, Faster, and Better
por: Menghani, Gaurav
Publicado: (2021)
por: Menghani, Gaurav
Publicado: (2021)
Sample-Efficient Preference-based Reinforcement Learning with Dynamics Aware Rewards
por: Metcalf, Katherine, et al.
Publicado: (2024)
por: Metcalf, Katherine, et al.
Publicado: (2024)
Preference VLM: Leveraging VLMs for Scalable Preference-Based Reinforcement Learning
por: Ghosh, Udita, et al.
Publicado: (2025)
por: Ghosh, Udita, et al.
Publicado: (2025)
RA-PbRL: Provably Efficient Risk-Aware Preference-Based Reinforcement Learning
por: Zhao, Yujie, et al.
Publicado: (2024)
por: Zhao, Yujie, et al.
Publicado: (2024)
Query-Policy Misalignment in Preference-Based Reinforcement Learning
por: Hu, Xiao, et al.
Publicado: (2023)
por: Hu, Xiao, et al.
Publicado: (2023)
TEACH: Temporal Variance-Driven Curriculum for Reinforcement Learning
por: Chaudhary, Gaurav, et al.
Publicado: (2025)
por: Chaudhary, Gaurav, et al.
Publicado: (2025)
Efficient Preference-Based Reinforcement Learning: Randomized Exploration Meets Experimental Design
por: Schlaginhaufen, Andreas, et al.
Publicado: (2025)
por: Schlaginhaufen, Andreas, et al.
Publicado: (2025)
From Reward-Free Representations to Preferences: Rethinking Offline Preference-Based Reinforcement Learning
por: Yang, Jun-Jie, et al.
Publicado: (2026)
por: Yang, Jun-Jie, et al.
Publicado: (2026)
Hindsight Preference Learning for Offline Preference-based Reinforcement Learning
por: Gao, Chen-Xiao, et al.
Publicado: (2024)
por: Gao, Chen-Xiao, et al.
Publicado: (2024)
From Novelty to Imitation: Self-Distilled Rewards for Offline Reinforcement Learning
por: Chaudhary, Gaurav, et al.
Publicado: (2025)
por: Chaudhary, Gaurav, et al.
Publicado: (2025)
Efficient Multi-Policy Evaluation for Reinforcement Learning
por: Liu, Shuze Daniel, et al.
Publicado: (2024)
por: Liu, Shuze Daniel, et al.
Publicado: (2024)
Modeling Behavioral Preferences of Cyber Adversaries Using Inverse Reinforcement Learning
por: Shinde, Aditya, et al.
Publicado: (2025)
por: Shinde, Aditya, et al.
Publicado: (2025)
Combinatorial Reinforcement Learning with Preference Feedback
por: Lee, Joongkyu, et al.
Publicado: (2025)
por: Lee, Joongkyu, et al.
Publicado: (2025)
On Efficient Bayesian Exploration in Model-Based Reinforcement Learning
por: Caron, Alberto, et al.
Publicado: (2025)
por: Caron, Alberto, et al.
Publicado: (2025)
General Preference Reinforcement Learning
por: Umer, Muhammad, et al.
Publicado: (2026)
por: Umer, Muhammad, et al.
Publicado: (2026)
ResponseRank: Data-Efficient Reward Modeling through Preference Strength Learning
por: Kaufmann, Timo, et al.
Publicado: (2025)
por: Kaufmann, Timo, et al.
Publicado: (2025)
AREAL-DTA: Dynamic Tree Attention for Efficient Reinforcement Learning of Large Language Models
por: Zhang, Jiarui, et al.
Publicado: (2026)
por: Zhang, Jiarui, et al.
Publicado: (2026)
Efficient Policy Evaluation with Safety Constraint for Reinforcement Learning
por: Chen, Claire, et al.
Publicado: (2024)
por: Chen, Claire, et al.
Publicado: (2024)
Search-Based Credit Assignment for Offline Preference-Based Reinforcement Learning
por: Gao, Xiancheng, et al.
Publicado: (2025)
por: Gao, Xiancheng, et al.
Publicado: (2025)
Autonomous Assessment of Demonstration Sufficiency via Bayesian Inverse Reinforcement Learning
por: Trinh, Tu, et al.
Publicado: (2022)
por: Trinh, Tu, et al.
Publicado: (2022)
Provable Reward-Agnostic Preference-Based Reinforcement Learning
por: Zhan, Wenhao, et al.
Publicado: (2023)
por: Zhan, Wenhao, et al.
Publicado: (2023)
PB$^2$: Preference Space Exploration via Population-Based Methods in Preference-Based Reinforcement Learning
por: Driss, Brahim, et al.
Publicado: (2025)
por: Driss, Brahim, et al.
Publicado: (2025)
Reinforcement Learning from Diverse Human Preferences
por: Xue, Wanqi, et al.
Publicado: (2023)
por: Xue, Wanqi, et al.
Publicado: (2023)
Preference-based Multi-Objective Reinforcement Learning
por: Mu, Ni, et al.
Publicado: (2025)
por: Mu, Ni, et al.
Publicado: (2025)
MOORL: A Framework for Integrating Offline-Online Reinforcement Learning
por: Chaudhary, Gaurav, et al.
Publicado: (2025)
por: Chaudhary, Gaurav, et al.
Publicado: (2025)
MOBODY: Model Based Off-Dynamics Offline Reinforcement Learning
por: Guo, Yihong, et al.
Publicado: (2025)
por: Guo, Yihong, et al.
Publicado: (2025)
Preference Elicitation for Offline Reinforcement Learning
por: Pace, Alizée, et al.
Publicado: (2024)
por: Pace, Alizée, et al.
Publicado: (2024)
Residual Reward Models for Preference-based Reinforcement Learning
por: Cao, Chenyang, et al.
Publicado: (2025)
por: Cao, Chenyang, et al.
Publicado: (2025)
Binary Reward Labeling: Bridging Offline Preference and Reward-Based Reinforcement Learning
por: Xu, Yinglun, et al.
Publicado: (2024)
por: Xu, Yinglun, et al.
Publicado: (2024)
Dynamic Preference Multi-Objective Reinforcement Learning for Internet Network Management
por: Heo, DongNyeong, et al.
Publicado: (2025)
por: Heo, DongNyeong, et al.
Publicado: (2025)
Efficient Reinforcement Learning from Human Feedback via Bayesian Preference Inference
por: Cercola, Matteo, et al.
Publicado: (2025)
por: Cercola, Matteo, et al.
Publicado: (2025)
LAPP: Large Language Model Feedback for Preference-Driven Reinforcement Learning
por: Jian, Pingcheng, et al.
Publicado: (2025)
por: Jian, Pingcheng, et al.
Publicado: (2025)
Two-Step Offline Preference-Based Reinforcement Learning with Constrained Actions
por: Xu, Yinglun, et al.
Publicado: (2023)
por: Xu, Yinglun, et al.
Publicado: (2023)
Fine-tuning Behavioral Cloning Policies with Preference-Based Reinforcement Learning
por: Macuglia, Maël, et al.
Publicado: (2025)
por: Macuglia, Maël, et al.
Publicado: (2025)
Ejemplares similares
-
Crowd-PrefRL: Preference-Based Reward Learning from Crowds
por: Chhan, David, et al.
Publicado: (2024) -
GraphAllocBench: A Flexible Benchmark for Preference-Conditioned Multi-Objective Policy Learning
por: Jiang, Zhiheng, et al.
Publicado: (2026) -
Rating-based Reinforcement Learning
por: White, Devin, et al.
Publicado: (2023) -
Multi-Type Preference Learning: Empowering Preference-Based Reinforcement Learning with Equal Preferences
por: Liu, Ziang, et al.
Publicado: (2024) -
Preference-Guided Reinforcement Learning for Efficient Exploration
por: Wang, Guojian, et al.
Publicado: (2024)