Visualising Policy-Reward Interplay to Inform Zeroth-Order Preference Optimisation of Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Galatolo, Alessio, Dai, Zhenbang, Winkle, Katie, Beloucif, Meriem |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
DIEKAE: Difference Injection for Efficient Knowledge Augmentation and Editing of Large Language Models
di: Galatolo, Alessio, et al.
Pubblicazione: (2024)
di: Galatolo, Alessio, et al.
Pubblicazione: (2024)
Beyond Ethical Alignment: Evaluating LLMs as Artificial Moral Assistants
di: Galatolo, Alessio, et al.
Pubblicazione: (2025)
di: Galatolo, Alessio, et al.
Pubblicazione: (2025)
Defining Boundaries: The Impact of Domain Specification on Cross-Language and Cross-Domain Transfer in Machine Translation
di: Shahnazaryan, Lia, et al.
Pubblicazione: (2024)
di: Shahnazaryan, Lia, et al.
Pubblicazione: (2024)
Building Better: Avoiding Pitfalls in Developing Language Resources when Data is Scarce
di: Ousidhoum, Nedjma, et al.
Pubblicazione: (2024)
di: Ousidhoum, Nedjma, et al.
Pubblicazione: (2024)
On the Convergence of Zeroth-Order Federated Tuning for Large Language Models
di: Ling, Zhenqing, et al.
Pubblicazione: (2024)
di: Ling, Zhenqing, et al.
Pubblicazione: (2024)
Differentially Private Zeroth-Order Methods for Scalable Large Language Model Finetuning
di: Liu, Z, et al.
Pubblicazione: (2024)
di: Liu, Z, et al.
Pubblicazione: (2024)
Simultaneous Computation and Memory Efficient Zeroth-Order Optimizer for Fine-Tuning Large Language Models
di: Wang, Fei, et al.
Pubblicazione: (2024)
di: Wang, Fei, et al.
Pubblicazione: (2024)
Discriminative Finetuning of Generative Large Language Models without Reward Models and Human Preference Data
di: Guo, Siqi, et al.
Pubblicazione: (2025)
di: Guo, Siqi, et al.
Pubblicazione: (2025)
VerifyBench: Benchmarking Reference-based Reward Systems for Large Language Models
di: Yan, Yuchen, et al.
Pubblicazione: (2025)
di: Yan, Yuchen, et al.
Pubblicazione: (2025)
Black Big Boxes: Tracing Adjective Order Preferences in Large Language Models
di: Jumelet, Jaap, et al.
Pubblicazione: (2024)
di: Jumelet, Jaap, et al.
Pubblicazione: (2024)
On the Interplay between Musical Preferences and Personality through the Lens of Language
di: Shem-Tov, Eliran, et al.
Pubblicazione: (2025)
di: Shem-Tov, Eliran, et al.
Pubblicazione: (2025)
Variance-reduced Zeroth-Order Methods for Fine-Tuning Language Models
di: Gautam, Tanmay, et al.
Pubblicazione: (2024)
di: Gautam, Tanmay, et al.
Pubblicazione: (2024)
Efficient Safety Alignment of Large Language Models via Preference Re-ranking and Representation-based Reward Modeling
di: Deng, Qiyuan, et al.
Pubblicazione: (2025)
di: Deng, Qiyuan, et al.
Pubblicazione: (2025)
Prior-Informed Zeroth-Order Optimization with Adaptive Direction Alignment for Memory-Efficient LLM Fine-Tuning
di: Jin, Feihu, et al.
Pubblicazione: (2026)
di: Jin, Feihu, et al.
Pubblicazione: (2026)
AdaZeta: Adaptive Zeroth-Order Tensor-Train Adaption for Memory-Efficient Large Language Models Fine-Tuning
di: Yang, Yifan, et al.
Pubblicazione: (2024)
di: Yang, Yifan, et al.
Pubblicazione: (2024)
URPO: A Unified Reward & Policy Optimization Framework for Large Language Models
di: Lu, Songshuo, et al.
Pubblicazione: (2025)
di: Lu, Songshuo, et al.
Pubblicazione: (2025)
Cooper: Co-Optimizing Policy and Reward Models in Reinforcement Learning for Large Language Models
di: Hong, Haitao, et al.
Pubblicazione: (2025)
di: Hong, Haitao, et al.
Pubblicazione: (2025)
Zeroth-Order Sharpness-Aware Learning with Exponential Tilting
di: Gong, Xuchen, et al.
Pubblicazione: (2025)
di: Gong, Xuchen, et al.
Pubblicazione: (2025)
The Policy Cliff: A Theoretical Analysis of Reward-Policy Maps in Large Language Models
di: Xu, Xingcheng
Pubblicazione: (2025)
di: Xu, Xingcheng
Pubblicazione: (2025)
Private Fine-tuning of Large Language Models with Zeroth-order Optimization
di: Tang, Xinyu, et al.
Pubblicazione: (2024)
di: Tang, Xinyu, et al.
Pubblicazione: (2024)
Addax: Utilizing Zeroth-Order Gradients to Improve Memory Efficiency and Performance of SGD for Fine-Tuning Language Models
di: Li, Zeman, et al.
Pubblicazione: (2024)
di: Li, Zeman, et al.
Pubblicazione: (2024)
Sparse Reward Subsystem in Large Language Models
di: Xu, Guowei, et al.
Pubblicazione: (2026)
di: Xu, Guowei, et al.
Pubblicazione: (2026)
Understanding the Interplay between Parametric and Contextual Knowledge for Large Language Models
di: Cheng, Sitao, et al.
Pubblicazione: (2024)
di: Cheng, Sitao, et al.
Pubblicazione: (2024)
Weighted-Reward Preference Optimization for Implicit Model Fusion
di: Yang, Ziyi, et al.
Pubblicazione: (2024)
di: Yang, Ziyi, et al.
Pubblicazione: (2024)
Promoting the Responsible Development of Speech Datasets for Mental Health and Neurological Disorders Research
di: Mancini, Eleonora, et al.
Pubblicazione: (2024)
di: Mancini, Eleonora, et al.
Pubblicazione: (2024)
AdaEvolve: Adaptive LLM Driven Zeroth-Order Optimization
di: Cemri, Mert, et al.
Pubblicazione: (2026)
di: Cemri, Mert, et al.
Pubblicazione: (2026)
Generalist Reward Models: Found Inside Large Language Models
di: Li, Yi-Chen, et al.
Pubblicazione: (2025)
di: Li, Yi-Chen, et al.
Pubblicazione: (2025)
Optimising Calls to Large Language Models with Uncertainty-Based Two-Tier Selection
di: Ramírez, Guillem, et al.
Pubblicazione: (2024)
di: Ramírez, Guillem, et al.
Pubblicazione: (2024)
Cache & Distil: Optimising API Calls to Large Language Models
di: Ramírez, Guillem, et al.
Pubblicazione: (2023)
di: Ramírez, Guillem, et al.
Pubblicazione: (2023)
On-Device Fine-Tuning via Backprop-Free Zeroth-Order Optimization
di: Katti, Prabodh, et al.
Pubblicazione: (2025)
di: Katti, Prabodh, et al.
Pubblicazione: (2025)
ALMol: Aligned Language-Molecule Translation LLMs through Offline Preference Contrastive Optimisation
di: Gkoumas, Dimitris
Pubblicazione: (2024)
di: Gkoumas, Dimitris
Pubblicazione: (2024)
Preference Packing: Efficient Preference Optimization for Large Language Models
di: Cho, Jaekyung
Pubblicazione: (2026)
di: Cho, Jaekyung
Pubblicazione: (2026)
EVALUESTEER: Measuring Reward Model Steerability Towards Values and Preferences
di: Ghate, Kshitish, et al.
Pubblicazione: (2025)
di: Ghate, Kshitish, et al.
Pubblicazione: (2025)
VRM: Teaching Reward Models to Understand Authentic Human Preferences
di: Liu, Biao, et al.
Pubblicazione: (2026)
di: Liu, Biao, et al.
Pubblicazione: (2026)
Code-Optimise: Self-Generated Preference Data for Correctness and Efficiency
di: Gee, Leonidas, et al.
Pubblicazione: (2024)
di: Gee, Leonidas, et al.
Pubblicazione: (2024)
Direct Preference Knowledge Distillation for Large Language Models
di: Li, Yixing, et al.
Pubblicazione: (2024)
di: Li, Yixing, et al.
Pubblicazione: (2024)
Auto MC-Reward: Automated Dense Reward Design with Large Language Models for Minecraft
di: Li, Hao, et al.
Pubblicazione: (2023)
di: Li, Hao, et al.
Pubblicazione: (2023)
Linguistically Informed Tokenization Improves ASR for Underresourced Languages
di: Daul, Massimo, et al.
Pubblicazione: (2025)
di: Daul, Massimo, et al.
Pubblicazione: (2025)
Gender Bias in Emotion Recognition by Large Language Models
di: Herbert, Maureen, et al.
Pubblicazione: (2025)
di: Herbert, Maureen, et al.
Pubblicazione: (2025)
Enhancing Large Language Model Reasoning with Reward Models: An Analytical Survey
di: Liu, Qiyuan, et al.
Pubblicazione: (2025)
di: Liu, Qiyuan, et al.
Pubblicazione: (2025)
Documenti analoghi
-
DIEKAE: Difference Injection for Efficient Knowledge Augmentation and Editing of Large Language Models
di: Galatolo, Alessio, et al.
Pubblicazione: (2024) -
Beyond Ethical Alignment: Evaluating LLMs as Artificial Moral Assistants
di: Galatolo, Alessio, et al.
Pubblicazione: (2025) -
Defining Boundaries: The Impact of Domain Specification on Cross-Language and Cross-Domain Transfer in Machine Translation
di: Shahnazaryan, Lia, et al.
Pubblicazione: (2024) -
Building Better: Avoiding Pitfalls in Developing Language Resources when Data is Scarce
di: Ousidhoum, Nedjma, et al.
Pubblicazione: (2024) -
On the Convergence of Zeroth-Order Federated Tuning for Large Language Models
di: Ling, Zhenqing, et al.
Pubblicazione: (2024)