MaxMin-RLHF: Alignment with Diverse Human Preferences
Fuente:
arXiv
Salvato in:
| Autori principali: | Chakraborty, Souradip, Qiu, Jiahao, Yuan, Hui, Koppel, Alec, Huang, Furong, Manocha, Dinesh, Bedi, Amrit Singh, Wang, Mengdi |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
PARL: A Unified Framework for Policy Alignment in Reinforcement Learning from Human Feedback
di: Chakraborty, Souradip, et al.
Pubblicazione: (2023)
di: Chakraborty, Souradip, et al.
Pubblicazione: (2023)
REBEL: Reward Regularization-Based Approach for Robotic Reinforcement Learning from Human Feedback
di: Chakraborty, Souradip, et al.
Pubblicazione: (2023)
di: Chakraborty, Souradip, et al.
Pubblicazione: (2023)
Transfer Q Star: Principled Decoding for LLM Alignment
di: Chakraborty, Souradip, et al.
Pubblicazione: (2024)
di: Chakraborty, Souradip, et al.
Pubblicazione: (2024)
SAIL: Self-Improving Efficient Online Alignment of Large Language Models
di: Ding, Mucong, et al.
Pubblicazione: (2024)
di: Ding, Mucong, et al.
Pubblicazione: (2024)
DMCA: Dense Multi-agent Navigation using Attention and Communication
di: Arul, Senthil Hariharan, et al.
Pubblicazione: (2022)
di: Arul, Senthil Hariharan, et al.
Pubblicazione: (2022)
Code Comprehension then Auditing for Unsupervised LLM Evaluation
di: Patel, Bhrij, et al.
Pubblicazione: (2024)
di: Patel, Bhrij, et al.
Pubblicazione: (2024)
Beyond Joint Demonstrations: Personalized Expert Guidance for Efficient Multi-Agent Reinforcement Learning
di: Yu, Peihong, et al.
Pubblicazione: (2024)
di: Yu, Peihong, et al.
Pubblicazione: (2024)
Safety Recovery in Reasoning Models Is Only a Few Early Steering Steps Away
di: Ghosal, Soumya Suvra, et al.
Pubblicazione: (2026)
di: Ghosal, Soumya Suvra, et al.
Pubblicazione: (2026)
LIAR: Leveraging Inference Time Alignment (Best-of-N) to Jailbreak LLMs in Seconds
di: Beetham, James, et al.
Pubblicazione: (2024)
di: Beetham, James, et al.
Pubblicazione: (2024)
Collab: Controlled Decoding using Mixture of Agents for LLM Alignment
di: Chakraborty, Souradip, et al.
Pubblicazione: (2025)
di: Chakraborty, Souradip, et al.
Pubblicazione: (2025)
Confidence-Controlled Exploration: Efficient Sparse-Reward Policy Learning for Robot Navigation
di: Patel, Bhrij, et al.
Pubblicazione: (2023)
di: Patel, Bhrij, et al.
Pubblicazione: (2023)
Beyond Text: Utilizing Vocal Cues to Improve Decision Making in LLMs for Robot Navigation Tasks
di: Sun, Xingpeng, et al.
Pubblicazione: (2024)
di: Sun, Xingpeng, et al.
Pubblicazione: (2024)
Personalized Embodied Navigation for Portable Object Finding
di: Dorbala, Vishnu Sashank, et al.
Pubblicazione: (2024)
di: Dorbala, Vishnu Sashank, et al.
Pubblicazione: (2024)
On the Vulnerability of LLM/VLM-Controlled Robotics
di: Wu, Xiyang, et al.
Pubblicazione: (2024)
di: Wu, Xiyang, et al.
Pubblicazione: (2024)
VARP: Reinforcement Learning from Vision-Language Model Feedback with Agent Regularized Preferences
di: Singh, Anukriti, et al.
Pubblicazione: (2025)
di: Singh, Anukriti, et al.
Pubblicazione: (2025)
Immune: Improving Safety Against Jailbreaks in Multi-modal LLMs via Inference-Time Alignment
di: Ghosal, Soumya Suvra, et al.
Pubblicazione: (2024)
di: Ghosal, Soumya Suvra, et al.
Pubblicazione: (2024)
SABER: A Stealthy Agentic Black-Box Attack Framework for Vision-Language-Action Models
di: Wu, Xiyang, et al.
Pubblicazione: (2026)
di: Wu, Xiyang, et al.
Pubblicazione: (2026)
Does Thinking More always Help? Mirage of Test-Time Scaling in Reasoning Models
di: Ghosal, Soumya Suvra, et al.
Pubblicazione: (2025)
di: Ghosal, Soumya Suvra, et al.
Pubblicazione: (2025)
Bounded Rationality for LLMs: Satisficing Alignment at Inference-Time
di: Chehade, Mohamad, et al.
Pubblicazione: (2025)
di: Chehade, Mohamad, et al.
Pubblicazione: (2025)
On (In)approximability of MaxMin Independent Set Reconfiguration
di: Hoang, Hung P., et al.
Pubblicazione: (2026)
di: Hoang, Hung P., et al.
Pubblicazione: (2026)
LANCAR: Leveraging Language for Context-Aware Robot Locomotion in Unstructured Environments
di: Shek, Chak Lam, et al.
Pubblicazione: (2023)
di: Shek, Chak Lam, et al.
Pubblicazione: (2023)
Learning Multi-Robot Coordination through Locality-Based Factorized Multi-Agent Actor-Critic Algorithm
di: Shek, Chak Lam, et al.
Pubblicazione: (2025)
di: Shek, Chak Lam, et al.
Pubblicazione: (2025)
Uncertainty-Aware Answer Selection for Improved Reasoning in Multi-LLM Systems
di: Agrawal, Aakriti, et al.
Pubblicazione: (2025)
di: Agrawal, Aakriti, et al.
Pubblicazione: (2025)
LBAP: Improved Uncertainty Alignment of LLM Planners using Bayesian Inference
di: Mullen Jr., James F., et al.
Pubblicazione: (2024)
di: Mullen Jr., James F., et al.
Pubblicazione: (2024)
RL with Learnable Textual Feedback: A Bilevel Approach
di: Singh, Utsav, et al.
Pubblicazione: (2026)
di: Singh, Utsav, et al.
Pubblicazione: (2026)
Towards Global Optimality for Practical Average Reward Reinforcement Learning without Mixing Time Oracles
di: Patel, Bhrij, et al.
Pubblicazione: (2024)
di: Patel, Bhrij, et al.
Pubblicazione: (2024)
MIRA: Towards Mitigating Reward Hacking in Inference-Time Alignment of T2I Diffusion Models
di: Zhai, Kevin, et al.
Pubblicazione: (2025)
di: Zhai, Kevin, et al.
Pubblicazione: (2025)
Why Pass@k Optimization Can Degrade Pass@1: Prompt Interference in LLM Post-training
di: Barakat, Anas, et al.
Pubblicazione: (2026)
di: Barakat, Anas, et al.
Pubblicazione: (2026)
BalancedDPO: Adaptive Multi-Metric Alignment
di: Tamboli, Dipesh, et al.
Pubblicazione: (2025)
di: Tamboli, Dipesh, et al.
Pubblicazione: (2025)
TrustNavGPT: Modeling Uncertainty to Improve Trustworthiness of Audio-Guided LLM-Based Robot Navigation
di: Sun, Xingpeng, et al.
Pubblicazione: (2024)
di: Sun, Xingpeng, et al.
Pubblicazione: (2024)
HALO: Human Preference Aligned Offline Reward Learning for Robot Navigation
di: Seneviratne, Gershom, et al.
Pubblicazione: (2025)
di: Seneviratne, Gershom, et al.
Pubblicazione: (2025)
CHOP: Counterfactual Human Preference Labels Improve Obstacle Avoidance in Visuomotor Navigation Policies
di: Seneviratne, Gershom, et al.
Pubblicazione: (2026)
di: Seneviratne, Gershom, et al.
Pubblicazione: (2026)
Can LLMs Generate Human-Like Wayfinding Instructions? Towards Platform-Agnostic Embodied Instruction Synthesis
di: Dorbala, Vishnu Sashank, et al.
Pubblicazione: (2024)
di: Dorbala, Vishnu Sashank, et al.
Pubblicazione: (2024)
Align-Pro: A Principled Approach to Prompt Optimization for LLM Alignment
di: Trivedi, Prashant, et al.
Pubblicazione: (2025)
di: Trivedi, Prashant, et al.
Pubblicazione: (2025)
Multi-LLM QA with Embodied Exploration
di: Patel, Bhrij, et al.
Pubblicazione: (2024)
di: Patel, Bhrij, et al.
Pubblicazione: (2024)
DIPPER: Direct Preference Optimization to Accelerate Primitive-Enabled Hierarchical Reinforcement Learning
di: Singh, Utsav, et al.
Pubblicazione: (2024)
di: Singh, Utsav, et al.
Pubblicazione: (2024)
MemCtrl: Using MLLMs as Active Memory Controllers on Embodied Agents
di: Dorbala, Vishnu Sashank, et al.
Pubblicazione: (2026)
di: Dorbala, Vishnu Sashank, et al.
Pubblicazione: (2026)
Active Preference Optimization for Sample Efficient RLHF
di: Das, Nirjhar, et al.
Pubblicazione: (2024)
di: Das, Nirjhar, et al.
Pubblicazione: (2024)
On the Global Optimality of Policy Gradient Methods in General Utility Reinforcement Learning
di: Barakat, Anas, et al.
Pubblicazione: (2024)
di: Barakat, Anas, et al.
Pubblicazione: (2024)
MaxMin Separation Problems: FPT Algorithms for $st$-Separator and Odd Cycle Transversal
di: Gaikwad, Ajinkya, et al.
Pubblicazione: (2025)
di: Gaikwad, Ajinkya, et al.
Pubblicazione: (2025)
Documenti analoghi
-
PARL: A Unified Framework for Policy Alignment in Reinforcement Learning from Human Feedback
di: Chakraborty, Souradip, et al.
Pubblicazione: (2023) -
REBEL: Reward Regularization-Based Approach for Robotic Reinforcement Learning from Human Feedback
di: Chakraborty, Souradip, et al.
Pubblicazione: (2023) -
Transfer Q Star: Principled Decoding for LLM Alignment
di: Chakraborty, Souradip, et al.
Pubblicazione: (2024) -
SAIL: Self-Improving Efficient Online Alignment of Large Language Models
di: Ding, Mucong, et al.
Pubblicazione: (2024) -
DMCA: Dense Multi-agent Navigation using Attention and Communication
di: Arul, Senthil Hariharan, et al.
Pubblicazione: (2022)