Approximated Variational Bayesian Inverse Reinforcement Learning for Large Language Model Alignment
Fuente:
arXiv
Salvato in:
| Autori principali: | Cai, Yuang, Yuan, Yuyu, Shi, Jinsheng, Lin, Qinhong |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Inverse-RLignment: Large Language Model Alignment from Demonstrations through Inverse Reinforcement Learning
di: Sun, Hao, et al.
Pubblicazione: (2024)
di: Sun, Hao, et al.
Pubblicazione: (2024)
$\mathcal{X}$-KD: General Experiential Knowledge Distillation for Large Language Models
di: Cai, Yuang, et al.
Pubblicazione: (2026)
di: Cai, Yuang, et al.
Pubblicazione: (2026)
Kernel Density Bayesian Inverse Reinforcement Learning
di: Mandyam, Aishwarya, et al.
Pubblicazione: (2023)
di: Mandyam, Aishwarya, et al.
Pubblicazione: (2023)
Walking the Values in Bayesian Inverse Reinforcement Learning
di: Bajgar, Ondrej, et al.
Pubblicazione: (2024)
di: Bajgar, Ondrej, et al.
Pubblicazione: (2024)
Variational Linearized Laplace Approximation for Bayesian Deep Learning
di: Ortega, Luis A., et al.
Pubblicazione: (2023)
di: Ortega, Luis A., et al.
Pubblicazione: (2023)
Bayesian Inverse Reinforcement Learning for Non-Markovian Rewards
di: Topper, Noah, et al.
Pubblicazione: (2024)
di: Topper, Noah, et al.
Pubblicazione: (2024)
A Bayesian Approach to Robust Inverse Reinforcement Learning
di: Wei, Ran, et al.
Pubblicazione: (2023)
di: Wei, Ran, et al.
Pubblicazione: (2023)
PAC Apprenticeship Learning with Bayesian Active Inverse Reinforcement Learning
di: Bajgar, Ondrej, et al.
Pubblicazione: (2025)
di: Bajgar, Ondrej, et al.
Pubblicazione: (2025)
Offline Regularised Reinforcement Learning for Large Language Models Alignment
di: Richemond, Pierre Harvey, et al.
Pubblicazione: (2024)
di: Richemond, Pierre Harvey, et al.
Pubblicazione: (2024)
Rethinking Inverse Reinforcement Learning: from Data Alignment to Task Alignment
di: Zhou, Weichao, et al.
Pubblicazione: (2024)
di: Zhou, Weichao, et al.
Pubblicazione: (2024)
Autonomous Assessment of Demonstration Sufficiency via Bayesian Inverse Reinforcement Learning
di: Trinh, Tu, et al.
Pubblicazione: (2022)
di: Trinh, Tu, et al.
Pubblicazione: (2022)
Bayesian Meta-Reinforcement Learning with Laplace Variational Recurrent Networks
di: de Vries, Joery A., et al.
Pubblicazione: (2025)
di: de Vries, Joery A., et al.
Pubblicazione: (2025)
Interactionless Inverse Reinforcement Learning: A Data-Centric Framework for Durable Alignment
di: Malomgré, Elias, et al.
Pubblicazione: (2026)
di: Malomgré, Elias, et al.
Pubblicazione: (2026)
Reinforcement Learning Finetunes Small Subnetworks in Large Language Models
di: Mukherjee, Sagnik, et al.
Pubblicazione: (2025)
di: Mukherjee, Sagnik, et al.
Pubblicazione: (2025)
Score-Based Variational Inference for Inverse Problems
di: Xue, Zhipeng, et al.
Pubblicazione: (2024)
di: Xue, Zhipeng, et al.
Pubblicazione: (2024)
Uncertainty Quantification of Large Language Models using Approximate Bayesian Computation
di: Sharma, Mridul, et al.
Pubblicazione: (2025)
di: Sharma, Mridul, et al.
Pubblicazione: (2025)
SLaB: Sparse-Lowrank-Binary Decomposition for Efficient Large Language Models
di: Li, Ziwei, et al.
Pubblicazione: (2026)
di: Li, Ziwei, et al.
Pubblicazione: (2026)
Inverse Reinforcement Learning without Reinforcement Learning
di: Swamy, Gokul, et al.
Pubblicazione: (2023)
di: Swamy, Gokul, et al.
Pubblicazione: (2023)
Bayesian Reward Models for LLM Alignment
di: Yang, Adam X., et al.
Pubblicazione: (2024)
di: Yang, Adam X., et al.
Pubblicazione: (2024)
Inverse Reinforcement Learning with Dynamic Reward Scaling for LLM Alignment
di: Cheng, Ruoxi, et al.
Pubblicazione: (2025)
di: Cheng, Ruoxi, et al.
Pubblicazione: (2025)
On Predictability of Reinforcement Learning Dynamics for Large Language Models
di: Cai, Yuchen, et al.
Pubblicazione: (2025)
di: Cai, Yuchen, et al.
Pubblicazione: (2025)
GRACE: A Language Model Framework for Explainable Inverse Reinforcement Learning
di: Sapora, Silvia, et al.
Pubblicazione: (2025)
di: Sapora, Silvia, et al.
Pubblicazione: (2025)
Inverse Reinforcement Learning Meets Large Language Model Post-Training: Basics, Advances, and Opportunities
di: Sun, Hao, et al.
Pubblicazione: (2025)
di: Sun, Hao, et al.
Pubblicazione: (2025)
Doubly Robust Alignment for Large Language Models
di: Xu, Erhan, et al.
Pubblicazione: (2025)
di: Xu, Erhan, et al.
Pubblicazione: (2025)
Distributional Inverse Reinforcement Learning
di: Wu, Feiyang, et al.
Pubblicazione: (2025)
di: Wu, Feiyang, et al.
Pubblicazione: (2025)
EARL: Efficient Agentic Reinforcement Learning Systems for Large Language Models
di: Tan, Zheyue, et al.
Pubblicazione: (2025)
di: Tan, Zheyue, et al.
Pubblicazione: (2025)
Model-Free Approximate Bayesian Learning for Large-Scale Conversion Funnel Optimization
di: Iyengar, Garud, et al.
Pubblicazione: (2024)
di: Iyengar, Garud, et al.
Pubblicazione: (2024)
Rank-1 Approximation of Inverse Fisher for Natural Policy Gradients in Deep Reinforcement Learning
di: Huo, Yingxiao, et al.
Pubblicazione: (2026)
di: Huo, Yingxiao, et al.
Pubblicazione: (2026)
Mixed-Precision Federated Learning via Multi-Precision Over-The-Air Aggregation
di: Yuan, Jinsheng, et al.
Pubblicazione: (2024)
di: Yuan, Jinsheng, et al.
Pubblicazione: (2024)
Internalizing Meta-Experience into Memory for Guided Reinforcement Learning in Large Language Models
di: Huang, Shiting, et al.
Pubblicazione: (2026)
di: Huang, Shiting, et al.
Pubblicazione: (2026)
Reinforced Collaboration in Multi-Agent Flow Networks
di: Wang, Zheng, et al.
Pubblicazione: (2026)
di: Wang, Zheng, et al.
Pubblicazione: (2026)
Goal-Guided Efficient Exploration via Large Language Model in Reinforcement Learning
di: Qi, Yajie, et al.
Pubblicazione: (2025)
di: Qi, Yajie, et al.
Pubblicazione: (2025)
Efficient Reinforcement Learning with Large Language Model Priors
di: Yan, Xue, et al.
Pubblicazione: (2024)
di: Yan, Xue, et al.
Pubblicazione: (2024)
Teaching Large Language Models to Reason with Reinforcement Learning
di: Havrilla, Alex, et al.
Pubblicazione: (2024)
di: Havrilla, Alex, et al.
Pubblicazione: (2024)
SALMON: Self-Alignment with Instructable Reward Models
di: Sun, Zhiqing, et al.
Pubblicazione: (2023)
di: Sun, Zhiqing, et al.
Pubblicazione: (2023)
Learning To Sample From Diffusion Models Via Inverse Reinforcement Learning
di: Bourdrez, Constant, et al.
Pubblicazione: (2026)
di: Bourdrez, Constant, et al.
Pubblicazione: (2026)
Towards Generalized Inverse Reinforcement Learning
di: Dong, Chaosheng, et al.
Pubblicazione: (2024)
di: Dong, Chaosheng, et al.
Pubblicazione: (2024)
The Virtues of Pessimism in Inverse Reinforcement Learning
di: Wu, David, et al.
Pubblicazione: (2024)
di: Wu, David, et al.
Pubblicazione: (2024)
Directional Alignment Mitigates Reward Hacking in Reinforcement Learning for Language Models
di: Deng, Wenlong, et al.
Pubblicazione: (2026)
di: Deng, Wenlong, et al.
Pubblicazione: (2026)
Overcoming the Curse of Dimensionality in Reinforcement Learning Through Approximate Factorization
di: Lu, Chenbei, et al.
Pubblicazione: (2024)
di: Lu, Chenbei, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Inverse-RLignment: Large Language Model Alignment from Demonstrations through Inverse Reinforcement Learning
di: Sun, Hao, et al.
Pubblicazione: (2024) -
$\mathcal{X}$-KD: General Experiential Knowledge Distillation for Large Language Models
di: Cai, Yuang, et al.
Pubblicazione: (2026) -
Kernel Density Bayesian Inverse Reinforcement Learning
di: Mandyam, Aishwarya, et al.
Pubblicazione: (2023) -
Walking the Values in Bayesian Inverse Reinforcement Learning
di: Bajgar, Ondrej, et al.
Pubblicazione: (2024) -
Variational Linearized Laplace Approximation for Bayesian Deep Learning
di: Ortega, Luis A., et al.
Pubblicazione: (2023)