Explainable reinforcement learning from human feedback to improve alignment
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Liu, Shicheng, Xu, Siyuan, Qiu, Wenjie, Zhang, Hangfan, Zhu, Minghui |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2025
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
Interactive Inverse Reinforcement Learning of Interaction Scenarios via Bi-level Optimization
von: Mao, Yue, et al.
Veröffentlicht: (2026)
von: Mao, Yue, et al.
Veröffentlicht: (2026)
In-Trajectory Inverse Reinforcement Learning: Learn Incrementally Before An Ongoing Trajectory Terminates
von: Liu, Shicheng, et al.
Veröffentlicht: (2024)
von: Liu, Shicheng, et al.
Veröffentlicht: (2024)
Federated reinforcement learning for robot motion planning with zero-shot generalization
von: Yuan, Zhenyuan, et al.
Veröffentlicht: (2024)
von: Yuan, Zhenyuan, et al.
Veröffentlicht: (2024)
Learning to summarize user information for personalized reinforcement learning from human feedback
von: Nam, Hyunji, et al.
Veröffentlicht: (2025)
von: Nam, Hyunji, et al.
Veröffentlicht: (2025)
Meta-Reinforcement Learning with Universal Policy Adaptation: Provable Near-Optimality under All-task Optimum Comparator
von: Xu, Siyuan, et al.
Veröffentlicht: (2024)
von: Xu, Siyuan, et al.
Veröffentlicht: (2024)
Delayed homomorphic reinforcement learning for environments with delayed feedback
von: Lee, Jongsoo, et al.
Veröffentlicht: (2026)
von: Lee, Jongsoo, et al.
Veröffentlicht: (2026)
Explainable deep learning improves human mental models of self-driving cars
von: Kenny, Eoin M., et al.
Veröffentlicht: (2024)
von: Kenny, Eoin M., et al.
Veröffentlicht: (2024)
Curriculum reinforcement learning with measurable task representation learning
von: Wen, Yongyan, et al.
Veröffentlicht: (2026)
von: Wen, Yongyan, et al.
Veröffentlicht: (2026)
Byzantine-resilient federated online learning for Gaussian process regression
von: Zhang, Xu, et al.
Veröffentlicht: (2025)
von: Zhang, Xu, et al.
Veröffentlicht: (2025)
Deep reinforcement learning for irrigation scheduling using high-dimensional sensor feedback
von: Saikai, Yuji, et al.
Veröffentlicht: (2023)
von: Saikai, Yuji, et al.
Veröffentlicht: (2023)
Using reinforcement learning to probe the role of feedback in skill acquisition
von: Terpin, Antonio, et al.
Veröffentlicht: (2025)
von: Terpin, Antonio, et al.
Veröffentlicht: (2025)
Simple Denoising Diffusion Language Models
von: Zhu, Huaisheng, et al.
Veröffentlicht: (2025)
von: Zhu, Huaisheng, et al.
Veröffentlicht: (2025)
A Bayesian latent class reinforcement learning framework to capture adaptive, feedback-driven travel behaviour
von: Sfeir, Georges, et al.
Veröffentlicht: (2025)
von: Sfeir, Georges, et al.
Veröffentlicht: (2025)
Leveraging weights signals -- Predicting and improving generalizability in reinforcement learning
von: Moulin, Olivier, et al.
Veröffentlicht: (2025)
von: Moulin, Olivier, et al.
Veröffentlicht: (2025)
Connections between reinforcement learning with feedback,test-time scaling, and diffusion guidance: An anthology
von: Jiao, Yuchen, et al.
Veröffentlicht: (2025)
von: Jiao, Yuchen, et al.
Veröffentlicht: (2025)
TIFeD: a Tiny Integer-based Federated learning algorithm with Direct feedback alignment
von: Colombo, Luca, et al.
Veröffentlicht: (2024)
von: Colombo, Luca, et al.
Veröffentlicht: (2024)
Ergodicity in reinforcement learning
von: Baumann, Dominik, et al.
Veröffentlicht: (2026)
von: Baumann, Dominik, et al.
Veröffentlicht: (2026)
Automated co-design of high-performance thermodynamic cycles via graph-based hierarchical reinforcement learning
von: Li, Wenqing, et al.
Veröffentlicht: (2026)
von: Li, Wenqing, et al.
Veröffentlicht: (2026)
Using reinforcement learning to improve drone-based inference of greenhouse gas fluxes
von: van Hove, Alouette, et al.
Veröffentlicht: (2024)
von: van Hove, Alouette, et al.
Veröffentlicht: (2024)
Adaptive traffic signal safety and efficiency improvement by multi objective deep reinforcement learning approach
von: Mirbakhsh, Shahin, et al.
Veröffentlicht: (2024)
von: Mirbakhsh, Shahin, et al.
Veröffentlicht: (2024)
SHAP-Guided Kernel Actor-Critic for Explainable Reinforcement Learning
von: Li, Na, et al.
Veröffentlicht: (2025)
von: Li, Na, et al.
Veröffentlicht: (2025)
Explainable deep reinforcement learning reveals energy-efficient control strategies for turbulent drag reduction
von: Tonti, Federica, et al.
Veröffentlicht: (2026)
von: Tonti, Federica, et al.
Veröffentlicht: (2026)
Streamlined optical training of large-scale modern deep learning architectures with direct feedback alignment
von: Wang, Ziao, et al.
Veröffentlicht: (2024)
von: Wang, Ziao, et al.
Veröffentlicht: (2024)
Experimental evaluation of offline reinforcement learning for HVAC control in buildings
von: Wang, Jun, et al.
Veröffentlicht: (2024)
von: Wang, Jun, et al.
Veröffentlicht: (2024)
Advanced deep-reinforcement-learning methods for flow control: group-invariant and positional-encoding networks improve learning speed and quality
von: Jeon, Joongoo, et al.
Veröffentlicht: (2024)
von: Jeon, Joongoo, et al.
Veröffentlicht: (2024)
Optimistic Q-learning for average reward and episodic reinforcement learning
von: Agrawal, Priyank, et al.
Veröffentlicht: (2024)
von: Agrawal, Priyank, et al.
Veröffentlicht: (2024)
Feature-driven reinforcement learning for photovoltaic in continuous intraday trading
von: Abate, Arega Getaneh, et al.
Veröffentlicht: (2025)
von: Abate, Arega Getaneh, et al.
Veröffentlicht: (2025)
Model predictive control-based value estimation for efficient reinforcement learning
von: Wu, Qizhen, et al.
Veröffentlicht: (2023)
von: Wu, Qizhen, et al.
Veröffentlicht: (2023)
Evaluating alignment between humans and neural network representations in image-based learning tasks
von: Demircan, Can, et al.
Veröffentlicht: (2023)
von: Demircan, Can, et al.
Veröffentlicht: (2023)
Adaptive trajectory-constrained exploration strategy for deep reinforcement learning
von: Wang, Guojian, et al.
Veröffentlicht: (2023)
von: Wang, Guojian, et al.
Veröffentlicht: (2023)
Recommender systems and reinforcement learning for human-building interaction and context-aware support: A text mining-driven review of scientific literature
von: Zhang, Wenhao, et al.
Veröffentlicht: (2024)
von: Zhang, Wenhao, et al.
Veröffentlicht: (2024)
Risk-averse learning with delayed feedback
von: Wang, Siyi, et al.
Veröffentlicht: (2024)
von: Wang, Siyi, et al.
Veröffentlicht: (2024)
Ethics2vec: aligning automatic agents and human preferences
von: Bontempi, Gianluca
Veröffentlicht: (2025)
von: Bontempi, Gianluca
Veröffentlicht: (2025)
Normalization and effective learning rates in reinforcement learning
von: Lyle, Clare, et al.
Veröffentlicht: (2024)
von: Lyle, Clare, et al.
Veröffentlicht: (2024)
Complementing reinforcement learning with SFT through logit averaging in the post training of LLMs
von: Gan, Xingwei, et al.
Veröffentlicht: (2026)
von: Gan, Xingwei, et al.
Veröffentlicht: (2026)
An introduction to reinforcement learning for neuroscience
von: Jensen, Kristopher T.
Veröffentlicht: (2023)
von: Jensen, Kristopher T.
Veröffentlicht: (2023)
LIRE: listwise reward enhancement for preference alignment
von: Zhu, Mingye, et al.
Veröffentlicht: (2024)
von: Zhu, Mingye, et al.
Veröffentlicht: (2024)
TRACE: Trajectory Recovery for Continuous Mechanism Evolution in Causal Representation Learning
von: Fan, Shicheng, et al.
Veröffentlicht: (2026)
von: Fan, Shicheng, et al.
Veröffentlicht: (2026)
Generalized Bayesian deep reinforcement learning
von: Roy, Shreya Sinha, et al.
Veröffentlicht: (2024)
von: Roy, Shreya Sinha, et al.
Veröffentlicht: (2024)
Safe reinforcement learning in uncertain contexts
von: Baumann, Dominik, et al.
Veröffentlicht: (2024)
von: Baumann, Dominik, et al.
Veröffentlicht: (2024)
Ähnliche Einträge
-
Interactive Inverse Reinforcement Learning of Interaction Scenarios via Bi-level Optimization
von: Mao, Yue, et al.
Veröffentlicht: (2026) -
In-Trajectory Inverse Reinforcement Learning: Learn Incrementally Before An Ongoing Trajectory Terminates
von: Liu, Shicheng, et al.
Veröffentlicht: (2024) -
Federated reinforcement learning for robot motion planning with zero-shot generalization
von: Yuan, Zhenyuan, et al.
Veröffentlicht: (2024) -
Learning to summarize user information for personalized reinforcement learning from human feedback
von: Nam, Hyunji, et al.
Veröffentlicht: (2025) -
Meta-Reinforcement Learning with Universal Policy Adaptation: Provable Near-Optimality under All-task Optimum Comparator
von: Xu, Siyuan, et al.
Veröffentlicht: (2024)