On a Connection Between Imitation Learning and RLHF
Fuente:
arXiv
Salvato in:
| Autori principali: | Xiao, Teng, Yuan, Yige, Li, Mingxiao, Chen, Zhengyu, Honavar, Vasant G |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
How to Leverage Demonstration Data in Alignment for Large Language Model? A Self-Imitation Learning Perspective
di: Xiao, Teng, et al.
Pubblicazione: (2024)
di: Xiao, Teng, et al.
Pubblicazione: (2024)
Cal-DPO: Calibrated Direct Preference Optimization for Language Model Alignment
di: Xiao, Teng, et al.
Pubblicazione: (2024)
di: Xiao, Teng, et al.
Pubblicazione: (2024)
SimPER: A Minimalist Approach to Preference Alignment without Hyperparameters
di: Xiao, Teng, et al.
Pubblicazione: (2025)
di: Xiao, Teng, et al.
Pubblicazione: (2025)
3M-Diffusion: Latent Multi-Modal Diffusion for Language-Guided Molecular Structure Generation
di: Zhu, Huaisheng, et al.
Pubblicazione: (2024)
di: Zhu, Huaisheng, et al.
Pubblicazione: (2024)
EsaCL: Efficient Continual Learning of Sparse Models
di: Ren, Weijieying, et al.
Pubblicazione: (2024)
di: Ren, Weijieying, et al.
Pubblicazione: (2024)
GeomCLIP: Contrastive Geometry-Text Pre-training for Molecules
di: Xiao, Teng, et al.
Pubblicazione: (2024)
di: Xiao, Teng, et al.
Pubblicazione: (2024)
Simple Denoising Diffusion Language Models
di: Zhu, Huaisheng, et al.
Pubblicazione: (2025)
di: Zhu, Huaisheng, et al.
Pubblicazione: (2025)
Hyperdimensional Representation Learning for Node Classification and Link Prediction
di: Dalvi, Abhishek, et al.
Pubblicazione: (2024)
di: Dalvi, Abhishek, et al.
Pubblicazione: (2024)
MolBind: Multimodal Alignment of Language, Molecules, and Proteins
di: Xiao, Teng, et al.
Pubblicazione: (2024)
di: Xiao, Teng, et al.
Pubblicazione: (2024)
Hyperdimensional Cross-Modal Alignment of Frozen Language and Image Models for Efficient Image Captioning
di: Dalvi, Abhishek, et al.
Pubblicazione: (2026)
di: Dalvi, Abhishek, et al.
Pubblicazione: (2026)
C-HDNet: Hyperdimensional Computing for Causal Effect Estimation from Observational Data Under Network Interference
di: Dalvi, Abhishek, et al.
Pubblicazione: (2025)
di: Dalvi, Abhishek, et al.
Pubblicazione: (2025)
Deep Learning within Tabular Data: Foundations, Challenges, Advances and Future Directions
di: Ren, Weijieying, et al.
Pubblicazione: (2025)
di: Ren, Weijieying, et al.
Pubblicazione: (2025)
Restoring the Sweet Spot: Pass-Rate Weighted Self-Distillation for LLM Reasoning
di: Liu, Zehao, et al.
Pubblicazione: (2026)
di: Liu, Zehao, et al.
Pubblicazione: (2026)
Projection-Free Transformers via Gaussian Kernel Attention
di: Kundu, Debarshi, et al.
Pubblicazione: (2026)
di: Kundu, Debarshi, et al.
Pubblicazione: (2026)
A Comprehensive Survey of Electronic Health Record Modeling: From Deep Learning Approaches to Large Language Models
di: Ren, Weijieying, et al.
Pubblicazione: (2025)
di: Ren, Weijieying, et al.
Pubblicazione: (2025)
The Hidden Link Between RLHF and Contrastive Learning
di: Lv, Xufei, et al.
Pubblicazione: (2025)
di: Lv, Xufei, et al.
Pubblicazione: (2025)
Simple and Asymmetric Graph Contrastive Learning without Augmentations
di: Xiao, Teng, et al.
Pubblicazione: (2023)
di: Xiao, Teng, et al.
Pubblicazione: (2023)
Regression with Large Language Models for Materials and Molecular Property Prediction
di: Jacobs, Ryan, et al.
Pubblicazione: (2024)
di: Jacobs, Ryan, et al.
Pubblicazione: (2024)
Learning a Pessimistic Reward Model in RLHF
di: Xu, Yinglun, et al.
Pubblicazione: (2025)
di: Xu, Yinglun, et al.
Pubblicazione: (2025)
Brains vs. Bytes: Evaluating LLM Proficiency in Olympiad Mathematics
di: Mahdavi, Hamed, et al.
Pubblicazione: (2025)
di: Mahdavi, Hamed, et al.
Pubblicazione: (2025)
Mitigating the Alignment Tax of RLHF
di: Lin, Yong, et al.
Pubblicazione: (2023)
di: Lin, Yong, et al.
Pubblicazione: (2023)
Towards a Theoretical Understanding to the Generalization of RLHF
di: Li, Zhaochun, et al.
Pubblicazione: (2026)
di: Li, Zhaochun, et al.
Pubblicazione: (2026)
InfoNCE is a Free Lunch for Semantically guided Graph Contrastive Learning
di: Wang, Zixu, et al.
Pubblicazione: (2025)
di: Wang, Zixu, et al.
Pubblicazione: (2025)
SharedRep-RLHF: A Shared Representation Approach to RLHF with Diverse Preferences
di: Mukherjee, Arpan, et al.
Pubblicazione: (2025)
di: Mukherjee, Arpan, et al.
Pubblicazione: (2025)
Principled Penalty-based Methods for Bilevel Reinforcement Learning and RLHF
di: Shen, Han, et al.
Pubblicazione: (2024)
di: Shen, Han, et al.
Pubblicazione: (2024)
Meta-Reinforcement Learning with Self-Reflection for Agentic Search
di: Xiao, Teng, et al.
Pubblicazione: (2026)
di: Xiao, Teng, et al.
Pubblicazione: (2026)
Reward-Robust RLHF in LLMs
di: Yan, Yuzi, et al.
Pubblicazione: (2024)
di: Yan, Yuzi, et al.
Pubblicazione: (2024)
RLVMR: Reinforcement Learning with Verifiable Meta-Reasoning Rewards for Robust Long-Horizon Agents
di: Zhang, Zijing, et al.
Pubblicazione: (2025)
di: Zhang, Zijing, et al.
Pubblicazione: (2025)
RefGrader: Automated Grading of Mathematical Competition Proofs using Agentic Workflows
di: Mahdavi, Hamed, et al.
Pubblicazione: (2025)
di: Mahdavi, Hamed, et al.
Pubblicazione: (2025)
Imitative Membership Inference Attack
di: Du, Yuntao, et al.
Pubblicazione: (2025)
di: Du, Yuntao, et al.
Pubblicazione: (2025)
Factored Causal Representation Learning for Robust Reward Modeling in RLHF
di: Yang, Yupei, et al.
Pubblicazione: (2026)
di: Yang, Yupei, et al.
Pubblicazione: (2026)
SALSA: Soup-based Alignment Learning for Stronger Adaptation in RLHF
di: Chegini, Atoosa, et al.
Pubblicazione: (2024)
di: Chegini, Atoosa, et al.
Pubblicazione: (2024)
Online Bandit Learning with Offline Preference Data for Improved RLHF
di: Agnihotri, Akhil, et al.
Pubblicazione: (2024)
di: Agnihotri, Akhil, et al.
Pubblicazione: (2024)
Latent Wasserstein Adversarial Imitation Learning
di: Yang, Siqi, et al.
Pubblicazione: (2026)
di: Yang, Siqi, et al.
Pubblicazione: (2026)
OpenRLHF: An Easy-to-use, Scalable and High-performance RLHF Framework
di: Hu, Jian, et al.
Pubblicazione: (2024)
di: Hu, Jian, et al.
Pubblicazione: (2024)
Unifying Stable Optimization and Reference Regularization in RLHF
di: He, Li, et al.
Pubblicazione: (2026)
di: He, Li, et al.
Pubblicazione: (2026)
Policy Optimization in RLHF: The Impact of Out-of-preference Data
di: Li, Ziniu, et al.
Pubblicazione: (2023)
di: Li, Ziniu, et al.
Pubblicazione: (2023)
Offline Imitation Learning with Variational Counterfactual Reasoning
di: He, Bowei, et al.
Pubblicazione: (2023)
di: He, Bowei, et al.
Pubblicazione: (2023)
MITA: Bridging the Gap between Model and Data for Test-time Adaptation
di: Yuan, Yige, et al.
Pubblicazione: (2024)
di: Yuan, Yige, et al.
Pubblicazione: (2024)
RLHF Workflow: From Reward Modeling to Online RLHF
di: Dong, Hanze, et al.
Pubblicazione: (2024)
di: Dong, Hanze, et al.
Pubblicazione: (2024)
Documenti analoghi
-
How to Leverage Demonstration Data in Alignment for Large Language Model? A Self-Imitation Learning Perspective
di: Xiao, Teng, et al.
Pubblicazione: (2024) -
Cal-DPO: Calibrated Direct Preference Optimization for Language Model Alignment
di: Xiao, Teng, et al.
Pubblicazione: (2024) -
SimPER: A Minimalist Approach to Preference Alignment without Hyperparameters
di: Xiao, Teng, et al.
Pubblicazione: (2025) -
3M-Diffusion: Latent Multi-Modal Diffusion for Language-Guided Molecular Structure Generation
di: Zhu, Huaisheng, et al.
Pubblicazione: (2024) -
EsaCL: Efficient Continual Learning of Sparse Models
di: Ren, Weijieying, et al.
Pubblicazione: (2024)