Online Self-Preferring Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhai, Yuanzhao, Zhang, Zhuo, Xu, Kele, Peng, Hanyang, Yu, Yue, Feng, Dawei, Yang, Cheng, Ding, Bo, Wang, Huaimin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Uncertainty-Penalized Reinforcement Learning from Human Feedback with Diverse Reward LoRA Ensembles
di: Zhai, Yuanzhao, et al.
Pubblicazione: (2023)
di: Zhai, Yuanzhao, et al.
Pubblicazione: (2023)
Optimistic Model Rollouts for Pessimistic Offline Policy Optimization
di: Zhai, Yuanzhao, et al.
Pubblicazione: (2024)
di: Zhai, Yuanzhao, et al.
Pubblicazione: (2024)
Enhancing Decision-Making for LLM Agents via Step-Level Q-Value Models
di: Zhai, Yuanzhao, et al.
Pubblicazione: (2024)
di: Zhai, Yuanzhao, et al.
Pubblicazione: (2024)
Scaffold-Conditioned Preference Triplets for Controllable Molecular Optimization with Large Language Models
di: Xiong, Yi, et al.
Pubblicazione: (2026)
di: Xiong, Yi, et al.
Pubblicazione: (2026)
Correcting Large Language Model Behavior via Influence Function
di: Zhang, Han, et al.
Pubblicazione: (2024)
di: Zhang, Han, et al.
Pubblicazione: (2024)
COPR: Continual Learning Human Preference through Optimal Policy Regularization
di: Zhang, Han, et al.
Pubblicazione: (2023)
di: Zhang, Han, et al.
Pubblicazione: (2023)
MAny: Merge Anything for Multimodal Continual Instruction Tuning
di: Gao, Zijian, et al.
Pubblicazione: (2026)
di: Gao, Zijian, et al.
Pubblicazione: (2026)
Self-Exploring Language Models: Active Preference Elicitation for Online Alignment
di: Zhang, Shenao, et al.
Pubblicazione: (2024)
di: Zhang, Shenao, et al.
Pubblicazione: (2024)
Symphony-MoE: Harmonizing Disparate Pre-trained Models into a Coherent Mixture-of-Experts
di: Wang, Qi, et al.
Pubblicazione: (2025)
di: Wang, Qi, et al.
Pubblicazione: (2025)
COPR: Continual Human Preference Learning via Optimal Policy Regularization
di: Zhang, Han, et al.
Pubblicazione: (2024)
di: Zhang, Han, et al.
Pubblicazione: (2024)
Online Preference Alignment for Language Models via Count-based Exploration
di: Bai, Chenjia, et al.
Pubblicazione: (2025)
di: Bai, Chenjia, et al.
Pubblicazione: (2025)
Information Shapes Koopman Representation
di: Cheng, Xiaoyuan, et al.
Pubblicazione: (2025)
di: Cheng, Xiaoyuan, et al.
Pubblicazione: (2025)
RelPrism: A Multi-Faceted Pre-training Framework with Self-Generated Tasks for Relational Databases
di: Yang, Jinyu, et al.
Pubblicazione: (2026)
di: Yang, Jinyu, et al.
Pubblicazione: (2026)
Self-Play Preference Optimization for Language Model Alignment
di: Wu, Yue, et al.
Pubblicazione: (2024)
di: Wu, Yue, et al.
Pubblicazione: (2024)
Online Irregular Multivariate Time Series Forecasting via Uncertainty-Driven Dual-Expert Calibration
di: Wen, Haonan, et al.
Pubblicazione: (2026)
di: Wen, Haonan, et al.
Pubblicazione: (2026)
AutoFeedback: An LLM-based Framework for Efficient and Accurate API Request Generation
di: Liu, Huanxi, et al.
Pubblicazione: (2024)
di: Liu, Huanxi, et al.
Pubblicazione: (2024)
Online Preference-based Reinforcement Learning with Self-augmented Feedback from Large Language Model
di: Tu, Songjun, et al.
Pubblicazione: (2024)
di: Tu, Songjun, et al.
Pubblicazione: (2024)
Bayesian Optimization with Preference Exploration using a Monotonic Neural Network Ensemble
di: Wang, Hanyang, et al.
Pubblicazione: (2025)
di: Wang, Hanyang, et al.
Pubblicazione: (2025)
Semantically-Guided Inference for Conditional Diffusion Models: Enhancing Covariate Consistency in Time Series Forecasting
di: Ding, Rui, et al.
Pubblicazione: (2025)
di: Ding, Rui, et al.
Pubblicazione: (2025)
Context parroting: A simple but tough-to-beat baseline for foundation models in scientific machine learning
di: Zhang, Yuanzhao, et al.
Pubblicazione: (2025)
di: Zhang, Yuanzhao, et al.
Pubblicazione: (2025)
Zero-shot forecasting of chaotic systems
di: Zhang, Yuanzhao, et al.
Pubblicazione: (2024)
di: Zhang, Yuanzhao, et al.
Pubblicazione: (2024)
Fast Track to Winning Tickets: Repowering One-Shot Pruning for Graph Neural Networks
di: Yue, Yanwei, et al.
Pubblicazione: (2024)
di: Yue, Yanwei, et al.
Pubblicazione: (2024)
IntAttention: A Fully Integer Attention Pipeline for Efficient Edge Inference
di: Zhong, Wanli, et al.
Pubblicazione: (2025)
di: Zhong, Wanli, et al.
Pubblicazione: (2025)
Self-Improvement Towards Pareto Optimality: Mitigating Preference Conflicts in Multi-Objective Alignment
di: Li, Moxin, et al.
Pubblicazione: (2025)
di: Li, Moxin, et al.
Pubblicazione: (2025)
Dynamical system prediction from sparse observations using deep neural networks with Voronoi tessellation and physics constraint
di: Wang, Hanyang, et al.
Pubblicazione: (2024)
di: Wang, Hanyang, et al.
Pubblicazione: (2024)
SilentStriker:Toward Stealthy Bit-Flip Attacks on Large Language Models
di: Xu, Haotian, et al.
Pubblicazione: (2025)
di: Xu, Haotian, et al.
Pubblicazione: (2025)
What Is Preference Optimization Doing, and Why?
di: Wang, Yue, et al.
Pubblicazione: (2025)
di: Wang, Yue, et al.
Pubblicazione: (2025)
Towards Understanding Valuable Preference Data for Large Language Model Alignment
di: Zhang, Zizhuo, et al.
Pubblicazione: (2025)
di: Zhang, Zizhuo, et al.
Pubblicazione: (2025)
Beyond Bradley-Terry Models: A General Preference Model for Language Model Alignment
di: Zhang, Yifan, et al.
Pubblicazione: (2024)
di: Zhang, Yifan, et al.
Pubblicazione: (2024)
RPO: Fine-Tuning Visual Generative Models via Rich Vision-Language Preferences
di: Zhao, Hanyang, et al.
Pubblicazione: (2025)
di: Zhao, Hanyang, et al.
Pubblicazione: (2025)
Contractive Diffusion Probabilistic Models
di: Tang, Wenpin, et al.
Pubblicazione: (2024)
di: Tang, Wenpin, et al.
Pubblicazione: (2024)
SoftSignSGD(S3): An Enhanced Optimizer for Practical DNN Training and Loss Spikes Minimization Beyond Adam
di: Peng, Hanyang, et al.
Pubblicazione: (2025)
di: Peng, Hanyang, et al.
Pubblicazione: (2025)
SecP-Tuning: Efficient Privacy-Preserving Prompt Tuning for Large Language Models via MPC
di: Luo, Jinglong, et al.
Pubblicazione: (2025)
di: Luo, Jinglong, et al.
Pubblicazione: (2025)
Hypergraph Self-supervised Learning with Sampling-efficient Signals
di: Li, Fan, et al.
Pubblicazione: (2024)
di: Li, Fan, et al.
Pubblicazione: (2024)
PCDVQ: Enhancing Vector Quantization for Large Language Models via Polar Coordinate Decoupling
di: Yue, Yuxuan, et al.
Pubblicazione: (2025)
di: Yue, Yuxuan, et al.
Pubblicazione: (2025)
Spatio-Temporal Conformal Prediction for Power Outage Data
di: Jiang, Hanyang, et al.
Pubblicazione: (2024)
di: Jiang, Hanyang, et al.
Pubblicazione: (2024)
The Limits of Differential Privacy in Online Learning
di: Li, Bo, et al.
Pubblicazione: (2024)
di: Li, Bo, et al.
Pubblicazione: (2024)
Human Alignment of Large Language Models through Online Preference Optimisation
di: Calandriello, Daniele, et al.
Pubblicazione: (2024)
di: Calandriello, Daniele, et al.
Pubblicazione: (2024)
SAIL: Self-Improving Efficient Online Alignment of Large Language Models
di: Ding, Mucong, et al.
Pubblicazione: (2024)
di: Ding, Mucong, et al.
Pubblicazione: (2024)
ROPO: Robust Preference Optimization for Large Language Models
di: Liang, Xize, et al.
Pubblicazione: (2024)
di: Liang, Xize, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Uncertainty-Penalized Reinforcement Learning from Human Feedback with Diverse Reward LoRA Ensembles
di: Zhai, Yuanzhao, et al.
Pubblicazione: (2023) -
Optimistic Model Rollouts for Pessimistic Offline Policy Optimization
di: Zhai, Yuanzhao, et al.
Pubblicazione: (2024) -
Enhancing Decision-Making for LLM Agents via Step-Level Q-Value Models
di: Zhai, Yuanzhao, et al.
Pubblicazione: (2024) -
Scaffold-Conditioned Preference Triplets for Controllable Molecular Optimization with Large Language Models
di: Xiong, Yi, et al.
Pubblicazione: (2026) -
Correcting Large Language Model Behavior via Influence Function
di: Zhang, Han, et al.
Pubblicazione: (2024)