Dual Active Learning for Reinforcement Learning from Human Feedback
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Liu, Pangpang, Shi, Chengchun, Sun, Will Wei |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Reinforcement Learning from Human Feedback: A Statistical Perspective
von: Liu, Pangpang, et al.
Veröffentlicht: (2026)
von: Liu, Pangpang, et al.
Veröffentlicht: (2026)
Uncertainty Quantification for Large Language Model Reward Learning under Heterogeneous Human Feedback
von: Liu, Pangpang, et al.
Veröffentlicht: (2025)
von: Liu, Pangpang, et al.
Veröffentlicht: (2025)
Statistical Inference in Reinforcement Learning: A Selective Survey
von: Shi, Chengchun
Veröffentlicht: (2025)
von: Shi, Chengchun
Veröffentlicht: (2025)
Robust Reinforcement Learning from Human Feedback for Large Language Models Fine-Tuning
von: Ye, Kai, et al.
Veröffentlicht: (2025)
von: Ye, Kai, et al.
Veröffentlicht: (2025)
Counterfactually Safe Reinforcement Learning
von: Li, Jingyi, et al.
Veröffentlicht: (2026)
von: Li, Jingyi, et al.
Veröffentlicht: (2026)
Pessimistic Causal Reinforcement Learning with Mediators for Confounded Offline Data
von: Wang, Danyang, et al.
Veröffentlicht: (2024)
von: Wang, Danyang, et al.
Veröffentlicht: (2024)
Fairness-aware Contextual Dynamic Pricing with Strategic Buyers
von: Liu, Pangpang, et al.
Veröffentlicht: (2025)
von: Liu, Pangpang, et al.
Veröffentlicht: (2025)
Policy Gradient Primal-Dual Method for Safe Reinforcement Learning from Human Feedback
von: Liu, Qiang, et al.
Veröffentlicht: (2026)
von: Liu, Qiang, et al.
Veröffentlicht: (2026)
Low-Rank Contextual Reinforcement Learning from Heterogeneous Human Feedback
von: Lee, Seong Jin, et al.
Veröffentlicht: (2024)
von: Lee, Seong Jin, et al.
Veröffentlicht: (2024)
The Power of Active Multi-Task Learning in Reinforcement Learning from Human Feedback
von: Chen, Ruitao, et al.
Veröffentlicht: (2024)
von: Chen, Ruitao, et al.
Veröffentlicht: (2024)
Testing Stationarity and Change Point Detection in Reinforcement Learning
von: Li, Mengbing, et al.
Veröffentlicht: (2022)
von: Li, Mengbing, et al.
Veröffentlicht: (2022)
Privacy-Preserving Reinforcement Learning from Human Feedback via Decoupled Reward Modeling
von: Cho, Young Hyun, et al.
Veröffentlicht: (2026)
von: Cho, Young Hyun, et al.
Veröffentlicht: (2026)
Reinforcement Learning from Human Feedback with Active Queries
von: Ji, Kaixuan, et al.
Veröffentlicht: (2024)
von: Ji, Kaixuan, et al.
Veröffentlicht: (2024)
Reinforcement Learning from Human Feedback
von: Lambert, Nathan
Veröffentlicht: (2025)
von: Lambert, Nathan
Veröffentlicht: (2025)
Doubly Inhomogeneous Reinforcement Learning
von: Hu, Liyuan, et al.
Veröffentlicht: (2022)
von: Hu, Liyuan, et al.
Veröffentlicht: (2022)
Dense Reward for Free in Reinforcement Learning from Human Feedback
von: Chan, Alex J., et al.
Veröffentlicht: (2024)
von: Chan, Alex J., et al.
Veröffentlicht: (2024)
Strategyproof Reinforcement Learning from Human Feedback
von: Buening, Thomas Kleine, et al.
Veröffentlicht: (2025)
von: Buening, Thomas Kleine, et al.
Veröffentlicht: (2025)
Exploring Data Scaling Trends and Effects in Reinforcement Learning from Human Feedback
von: Shen, Wei, et al.
Veröffentlicht: (2025)
von: Shen, Wei, et al.
Veröffentlicht: (2025)
Robust Reinforcement Learning from Corrupted Human Feedback
von: Bukharin, Alexander, et al.
Veröffentlicht: (2024)
von: Bukharin, Alexander, et al.
Veröffentlicht: (2024)
Two-way Deconfounder for Off-policy Evaluation in Causal Reinforcement Learning
von: Yu, Shuguang, et al.
Veröffentlicht: (2024)
von: Yu, Shuguang, et al.
Veröffentlicht: (2024)
Sequential Knockoffs for Variable Selection in Reinforcement Learning
von: Ma, Tao, et al.
Veröffentlicht: (2023)
von: Ma, Tao, et al.
Veröffentlicht: (2023)
Online Iterative Reinforcement Learning from Human Feedback with General Preference Model
von: Ye, Chenlu, et al.
Veröffentlicht: (2024)
von: Ye, Chenlu, et al.
Veröffentlicht: (2024)
A Minimaximalist Approach to Reinforcement Learning from Human Feedback
von: Swamy, Gokul, et al.
Veröffentlicht: (2024)
von: Swamy, Gokul, et al.
Veröffentlicht: (2024)
Multi-turn Reinforcement Learning from Preference Human Feedback
von: Shani, Lior, et al.
Veröffentlicht: (2024)
von: Shani, Lior, et al.
Veröffentlicht: (2024)
Reinforcement Learning from Multi-level and Episodic Human Feedback
von: Elahi, Muhammad Qasim, et al.
Veröffentlicht: (2025)
von: Elahi, Muhammad Qasim, et al.
Veröffentlicht: (2025)
Designing Time Series Experiments in A/B Testing with Transformer Reinforcement Learning
von: Wu, Xiangkun, et al.
Veröffentlicht: (2026)
von: Wu, Xiangkun, et al.
Veröffentlicht: (2026)
Contextual Dynamic Pricing with Strategic Buyers
von: Liu, Pangpang, et al.
Veröffentlicht: (2023)
von: Liu, Pangpang, et al.
Veröffentlicht: (2023)
Semi-pessimistic Reinforcement Learning
von: Zhu, Jin, et al.
Veröffentlicht: (2025)
von: Zhu, Jin, et al.
Veröffentlicht: (2025)
Parameter Efficient Reinforcement Learning from Human Feedback
von: Sidahmed, Hakim, et al.
Veröffentlicht: (2024)
von: Sidahmed, Hakim, et al.
Veröffentlicht: (2024)
Data-dependent Exploration for Online Reinforcement Learning from Human Feedback
von: Zhang, Zhen-Yu, et al.
Veröffentlicht: (2026)
von: Zhang, Zhen-Yu, et al.
Veröffentlicht: (2026)
The Alignment Ceiling: Objective Mismatch in Reinforcement Learning from Human Feedback
von: Lambert, Nathan, et al.
Veröffentlicht: (2023)
von: Lambert, Nathan, et al.
Veröffentlicht: (2023)
Provable Reinforcement Learning from Human Feedback with an Unknown Link Function
von: Zhang, Qining, et al.
Veröffentlicht: (2025)
von: Zhang, Qining, et al.
Veröffentlicht: (2025)
A Survey of Reinforcement Learning from Human Feedback
von: Kaufmann, Timo, et al.
Veröffentlicht: (2023)
von: Kaufmann, Timo, et al.
Veröffentlicht: (2023)
Double Fairness Policy Learning: Integrating Action Fairness and Outcome Fairness in Decision-making
von: Bian, Zeyu, et al.
Veröffentlicht: (2026)
von: Bian, Zeyu, et al.
Veröffentlicht: (2026)
Swap-guided Preference Learning for Personalized Reinforcement Learning from Human Feedback
von: Kim, Gihoon, et al.
Veröffentlicht: (2026)
von: Kim, Gihoon, et al.
Veröffentlicht: (2026)
Labeled TrustSet Guided: Batch Active Learning with Reinforcement Learning
von: Cui, Guofeng, et al.
Veröffentlicht: (2026)
von: Cui, Guofeng, et al.
Veröffentlicht: (2026)
Adaptive Preference Scaling for Reinforcement Learning with Human Feedback
von: Hong, Ilgee, et al.
Veröffentlicht: (2024)
von: Hong, Ilgee, et al.
Veröffentlicht: (2024)
Corruption Robust Offline Reinforcement Learning with Human Feedback
von: Mandal, Debmalya, et al.
Veröffentlicht: (2024)
von: Mandal, Debmalya, et al.
Veröffentlicht: (2024)
Reinforcement Learning from Human Feedback without Reward Inference: Model-Free Algorithm and Instance-Dependent Analysis
von: Zhang, Qining, et al.
Veröffentlicht: (2024)
von: Zhang, Qining, et al.
Veröffentlicht: (2024)
TIC-GRPO: Provable and Efficient Optimization for Reinforcement Learning from Human Feedback
von: Pang, Lei, et al.
Veröffentlicht: (2025)
von: Pang, Lei, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
Reinforcement Learning from Human Feedback: A Statistical Perspective
von: Liu, Pangpang, et al.
Veröffentlicht: (2026) -
Uncertainty Quantification for Large Language Model Reward Learning under Heterogeneous Human Feedback
von: Liu, Pangpang, et al.
Veröffentlicht: (2025) -
Statistical Inference in Reinforcement Learning: A Selective Survey
von: Shi, Chengchun
Veröffentlicht: (2025) -
Robust Reinforcement Learning from Human Feedback for Large Language Models Fine-Tuning
von: Ye, Kai, et al.
Veröffentlicht: (2025) -
Counterfactually Safe Reinforcement Learning
von: Li, Jingyi, et al.
Veröffentlicht: (2026)