Adaptive Alignment: Dynamic Preference Adjustments via Multi-Objective Reinforcement Learning for Pluralistic AI
Fuente:
arXiv
Gespeichert in:
| Hauptverfasser: | Harland, Hadassah, Dazeley, Richard, Vamplew, Peter, Senaratne, Hashini, Nakisa, Bahareh, Cruz, Francisco |
|---|---|
| Format: | Preprint |
| Veröffentlicht: |
2024
|
| Schlagworte: | |
| Online-Zugang: | |
| Tags: |
Tag hinzufügen
Keine Tags, Fügen Sie den ersten Tag hinzu!
|
Ähnliche Einträge
AI Apology: A Critical Review of Apology in AI Systems
von: Harland, Hadassah, et al.
Veröffentlicht: (2024)
von: Harland, Hadassah, et al.
Veröffentlicht: (2024)
Multi-objective Reinforcement Learning: A Tool for Pluralistic Alignment
von: Vamplew, Peter, et al.
Veröffentlicht: (2024)
von: Vamplew, Peter, et al.
Veröffentlicht: (2024)
Learning the Value Systems of Societies with Preference-based Multi-objective Reinforcement Learning
von: Holgado-Sánchez, Andrés, et al.
Veröffentlicht: (2026)
von: Holgado-Sánchez, Andrés, et al.
Veröffentlicht: (2026)
Ensemble Elastic DQN: A novel multi-step ensemble approach to address overestimation in deep value-based reinforcement learning
von: Ly, Adrian, et al.
Veröffentlicht: (2025)
von: Ly, Adrian, et al.
Veröffentlicht: (2025)
Adaptive Human-AI Coordination via Hierarchical Action Disentanglement
von: Ahmad, Adnan, et al.
Veröffentlicht: (2026)
von: Ahmad, Adnan, et al.
Veröffentlicht: (2026)
An Empirical Investigation of Value-Based Multi-objective Reinforcement Learning for Stochastic Environments
von: Ding, Kewen, et al.
Veröffentlicht: (2024)
von: Ding, Kewen, et al.
Veröffentlicht: (2024)
Issues with Value-Based Multi-objective Reinforcement Learning: Value Function Interference and Overestimation Sensitivity
von: Vamplew, Peter, et al.
Veröffentlicht: (2024)
von: Vamplew, Peter, et al.
Veröffentlicht: (2024)
BCR-DRL: Behavior- and Context-aware Reward for Deep Reinforcement Learning in Human-AI Coordination
von: Hao, Xin, et al.
Veröffentlicht: (2024)
von: Hao, Xin, et al.
Veröffentlicht: (2024)
On Generalization Across Environments In Multi-Objective Reinforcement Learning
von: Teoh, Jayden, et al.
Veröffentlicht: (2025)
von: Teoh, Jayden, et al.
Veröffentlicht: (2025)
APPA: Adaptive Preference Pluralistic Alignment for Fair Federated RLHF of LLMs
von: Srewa, Mahmoud, et al.
Veröffentlicht: (2026)
von: Srewa, Mahmoud, et al.
Veröffentlicht: (2026)
Adaptive XAI in High Stakes Environments: Modeling Swift Trust with Multimodal Feedback in Human AI Teams
von: Fernando, Nishani, et al.
Veröffentlicht: (2025)
von: Fernando, Nishani, et al.
Veröffentlicht: (2025)
Complex Facial Expression Recognition Using Deep Knowledge Distillation of Basic Features
von: Maiden, Angus, et al.
Veröffentlicht: (2023)
von: Maiden, Angus, et al.
Veröffentlicht: (2023)
MixDPO: Modeling Preference Strength for Pluralistic Alignment
von: Imai, Saki, et al.
Veröffentlicht: (2026)
von: Imai, Saki, et al.
Veröffentlicht: (2026)
Rewards-in-Context: Multi-objective Alignment of Foundation Models with Dynamic Preference Adjustment
von: Yang, Rui, et al.
Veröffentlicht: (2024)
von: Yang, Rui, et al.
Veröffentlicht: (2024)
A BERT-Based Summarization approach for depression detection
von: Gavalan, Hossein Salahshoor, et al.
Veröffentlicht: (2024)
von: Gavalan, Hossein Salahshoor, et al.
Veröffentlicht: (2024)
Multi-objective Reinforcement Learning With Augmented States Requires Rewards After Deployment
von: Vamplew, Peter, et al.
Veröffentlicht: (2026)
von: Vamplew, Peter, et al.
Veröffentlicht: (2026)
Whose Truth? Pluralistic Geo-Alignment for (Agentic) AI
von: Janowicz, Krzysztof, et al.
Veröffentlicht: (2025)
von: Janowicz, Krzysztof, et al.
Veröffentlicht: (2025)
Hindsight Preference Replay Improves Preference-Conditioned Multi-Objective Reinforcement Learning
von: Shianifar, Jonaid, et al.
Veröffentlicht: (2026)
von: Shianifar, Jonaid, et al.
Veröffentlicht: (2026)
Learning Rewards, Not Labels: Adversarial Inverse Reinforcement Learning for Machinery Fault Detection
von: Neupane, Dhiraj, et al.
Veröffentlicht: (2026)
von: Neupane, Dhiraj, et al.
Veröffentlicht: (2026)
A Systematic Evaluation of Preference Aggregation in Federated RLHF for Pluralistic Alignment of LLMs
von: Srewa, Mahmoud, et al.
Veröffentlicht: (2025)
von: Srewa, Mahmoud, et al.
Veröffentlicht: (2025)
Pluralistic Alignment Over Time
von: Klassen, Toryn Q., et al.
Veröffentlicht: (2024)
von: Klassen, Toryn Q., et al.
Veröffentlicht: (2024)
A Roadmap to Pluralistic Alignment
von: Sorensen, Taylor, et al.
Veröffentlicht: (2024)
von: Sorensen, Taylor, et al.
Veröffentlicht: (2024)
MODULI: Unlocking Preference Generalization via Diffusion Models for Offline Multi-Objective Reinforcement Learning
von: Yuan, Yifu, et al.
Veröffentlicht: (2024)
von: Yuan, Yifu, et al.
Veröffentlicht: (2024)
Beyond One-Preference-Fits-All Alignment: Multi-Objective Direct Preference Optimization
von: Zhou, Zhanhui, et al.
Veröffentlicht: (2023)
von: Zhou, Zhanhui, et al.
Veröffentlicht: (2023)
Robust Emotion Recognition via Bi-Level Self-Supervised Continual Learning
von: Ahmad, Adnan, et al.
Veröffentlicht: (2025)
von: Ahmad, Adnan, et al.
Veröffentlicht: (2025)
Pairwise Calibrated Rewards for Pluralistic Alignment
von: Halpern, Daniel, et al.
Veröffentlicht: (2025)
von: Halpern, Daniel, et al.
Veröffentlicht: (2025)
Pluralistic Off-policy Evaluation and Alignment
von: Huang, Chengkai, et al.
Veröffentlicht: (2025)
von: Huang, Chengkai, et al.
Veröffentlicht: (2025)
Controllable Preference Optimization: Toward Controllable Multi-Objective Alignment
von: Guo, Yiju, et al.
Veröffentlicht: (2024)
von: Guo, Yiju, et al.
Veröffentlicht: (2024)
Dynamic Detection of Relevant Objectives and Adaptation to Preference Drifts in Interactive Evolutionary Multi-Objective Optimization
von: Shavarani, Seyed Mahdi, et al.
Veröffentlicht: (2024)
von: Shavarani, Seyed Mahdi, et al.
Veröffentlicht: (2024)
Property-driven Protein Inverse Folding With Multi-Objective Preference Alignment
von: Hou, Xiaoyang, et al.
Veröffentlicht: (2026)
von: Hou, Xiaoyang, et al.
Veröffentlicht: (2026)
Being Considerate as a Pathway Towards Pluralistic Alignment for Agentic AI
von: Alamdari, Parand A., et al.
Veröffentlicht: (2024)
von: Alamdari, Parand A., et al.
Veröffentlicht: (2024)
A Persona-Based Evaluation Framework for Pluralistic Alignment in Generative AI
von: Karagoz, Atahan
Veröffentlicht: (2026)
von: Karagoz, Atahan
Veröffentlicht: (2026)
PARM: Multi-Objective Test-Time Alignment via Preference-Aware Autoregressive Reward Model
von: Lin, Baijiong, et al.
Veröffentlicht: (2025)
von: Lin, Baijiong, et al.
Veröffentlicht: (2025)
Affective-CARA: A Knowledge Graph Driven Framework for Culturally Adaptive Emotional Intelligence in HCI
von: Pussadeniya, Nirodya, et al.
Veröffentlicht: (2025)
von: Pussadeniya, Nirodya, et al.
Veröffentlicht: (2025)
VISPA: Pluralistic Alignment via Automatic Value Selection and Activation
von: Zheng, Shenyan, et al.
Veröffentlicht: (2026)
von: Zheng, Shenyan, et al.
Veröffentlicht: (2026)
Preference Conditioned Multi-Objective Reinforcement Learning: Decomposed, Diversity-Driven Policy Optimization
von: Ambadkar, Tanmay, et al.
Veröffentlicht: (2026)
von: Ambadkar, Tanmay, et al.
Veröffentlicht: (2026)
Reinforcement Learning for Multi-Objective Multi-Echelon Supply Chain Optimisation
von: Rachman, Rifny, et al.
Veröffentlicht: (2025)
von: Rachman, Rifny, et al.
Veröffentlicht: (2025)
Complex Emotion Recognition System using basic emotions via Facial Expression, EEG, and ECG Signals: a review
von: Joloudari, Javad Hassannataj, et al.
Veröffentlicht: (2024)
von: Joloudari, Javad Hassannataj, et al.
Veröffentlicht: (2024)
Steerable Pluralism: Pluralistic Alignment via Few-Shot Comparative Regression
von: Adams, Jadie, et al.
Veröffentlicht: (2025)
von: Adams, Jadie, et al.
Veröffentlicht: (2025)
Dynamic Reward Scaling for Multivariate Time Series Anomaly Detection: A VAE-Enhanced Reinforcement Learning Approach
von: Golchin, Bahareh, et al.
Veröffentlicht: (2025)
von: Golchin, Bahareh, et al.
Veröffentlicht: (2025)
Ähnliche Einträge
-
AI Apology: A Critical Review of Apology in AI Systems
von: Harland, Hadassah, et al.
Veröffentlicht: (2024) -
Multi-objective Reinforcement Learning: A Tool for Pluralistic Alignment
von: Vamplew, Peter, et al.
Veröffentlicht: (2024) -
Learning the Value Systems of Societies with Preference-based Multi-objective Reinforcement Learning
von: Holgado-Sánchez, Andrés, et al.
Veröffentlicht: (2026) -
Ensemble Elastic DQN: A novel multi-step ensemble approach to address overestimation in deep value-based reinforcement learning
von: Ly, Adrian, et al.
Veröffentlicht: (2025) -
Adaptive Human-AI Coordination via Hierarchical Action Disentanglement
von: Ahmad, Adnan, et al.
Veröffentlicht: (2026)