Dynamic Rewarding with Prompt Optimization Enables Tuning-free Self-Alignment of Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Singla, Somanshu, Wang, Zhen, Liu, Tianyang, Ashfaq, Abdullah, Hu, Zhiting, Xing, Eric P. |
|---|---|
| Formato: | Preprint |
| Publicado: |
2024
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Decentralized Arena: Towards Democratic and Scalable Automatic Evaluation of Language Models
por: Yin, Yanbin, et al.
Publicado: (2025)
por: Yin, Yanbin, et al.
Publicado: (2025)
ToolkenGPT: Augmenting Frozen Language Models with Massive Tools via Tool Embeddings
por: Hao, Shibo, et al.
Publicado: (2023)
por: Hao, Shibo, et al.
Publicado: (2023)
Direct Large Language Model Alignment Through Self-Rewarding Contrastive Prompt Distillation
por: Liu, Aiwei, et al.
Publicado: (2024)
por: Liu, Aiwei, et al.
Publicado: (2024)
SSP: Self-Supervised Prompting for Cross-Lingual Transfer to Low-Resource Languages using Large Language Models
por: Rathore, Vipul, et al.
Publicado: (2024)
por: Rathore, Vipul, et al.
Publicado: (2024)
General Agentic Planning Through Simulative Reasoning with World Models
por: Deng, Mingkai, et al.
Publicado: (2025)
por: Deng, Mingkai, et al.
Publicado: (2025)
Cultural Alignment in Large Language Models Using Soft Prompt Tuning
por: Masoud, Reem I., et al.
Publicado: (2025)
por: Masoud, Reem I., et al.
Publicado: (2025)
Critiques of World Models
por: Xing, Eric, et al.
Publicado: (2025)
por: Xing, Eric, et al.
Publicado: (2025)
Self-Prompt Tuning: Enable Autonomous Role-Playing in LLMs
por: Kong, Aobo, et al.
Publicado: (2024)
por: Kong, Aobo, et al.
Publicado: (2024)
Learning to Optimize Multi-Objective Alignment Through Dynamic Reward Weighting
por: Lu, Yining, et al.
Publicado: (2025)
por: Lu, Yining, et al.
Publicado: (2025)
LLM Reasoners: New Evaluation, Library, and Analysis of Step-by-Step Reasoning with Large Language Models
por: Hao, Shibo, et al.
Publicado: (2024)
por: Hao, Shibo, et al.
Publicado: (2024)
Towards Alignment-Centric Paradigm: A Survey of Instruction Tuning in Large Language Models
por: Han, Xudong, et al.
Publicado: (2025)
por: Han, Xudong, et al.
Publicado: (2025)
Synthesizing Privacy-Preserving Text Data via Finetuning without Finetuning Billion-Scale LLMs
por: Tan, Bowen, et al.
Publicado: (2025)
por: Tan, Bowen, et al.
Publicado: (2025)
Dynamic Adaptive Optimization for Effective Sentiment Analysis Fine-Tuning on Large Language Models
por: Ding, Hongcheng, et al.
Publicado: (2024)
por: Ding, Hongcheng, et al.
Publicado: (2024)
Prompt Programming for Cultural Bias and Alignment of Large Language Models
por: Eren, Maksim, et al.
Publicado: (2026)
por: Eren, Maksim, et al.
Publicado: (2026)
Reward-free Alignment for Conflicting Objectives
por: Chen, Peter, et al.
Publicado: (2026)
por: Chen, Peter, et al.
Publicado: (2026)
MPO: Multilingual Safety Alignment via Reward Gap Optimization
por: Zhao, Weixiang, et al.
Publicado: (2025)
por: Zhao, Weixiang, et al.
Publicado: (2025)
SALMON: Self-Alignment with Instructable Reward Models
por: Sun, Zhiqing, et al.
Publicado: (2023)
por: Sun, Zhiqing, et al.
Publicado: (2023)
BiasGuard: A Reasoning-enhanced Bias Detection Tool For Large Language Models
por: Fan, Zhiting, et al.
Publicado: (2025)
por: Fan, Zhiting, et al.
Publicado: (2025)
Extensive Self-Contrast Enables Feedback-Free Language Model Alignment
por: Liu, Xiao, et al.
Publicado: (2024)
por: Liu, Xiao, et al.
Publicado: (2024)
Negative-Prompt-driven Alignment for Generative Language Model
por: Qiao, Shiqi, et al.
Publicado: (2024)
por: Qiao, Shiqi, et al.
Publicado: (2024)
Meta-Rewarding Language Models: Self-Improving Alignment with LLM-as-a-Meta-Judge
por: Wu, Tianhao, et al.
Publicado: (2024)
por: Wu, Tianhao, et al.
Publicado: (2024)
Process-based Self-Rewarding Language Models
por: Zhang, Shimao, et al.
Publicado: (2025)
por: Zhang, Shimao, et al.
Publicado: (2025)
On the Robustness of Reward Models for Language Model Alignment
por: Hong, Jiwoo, et al.
Publicado: (2025)
por: Hong, Jiwoo, et al.
Publicado: (2025)
Self-Rewarding Language Models
por: Yuan, Weizhe, et al.
Publicado: (2024)
por: Yuan, Weizhe, et al.
Publicado: (2024)
Teaching LLM to be Persuasive: Reward-Enhanced Policy Optimization for Alignment from Heterogeneous Rewards
por: Zeng, Xia, et al.
Publicado: (2025)
por: Zeng, Xia, et al.
Publicado: (2025)
Elephant in the Room: Unveiling the Impact of Reward Model Quality in Alignment
por: Liu, Yan, et al.
Publicado: (2024)
por: Liu, Yan, et al.
Publicado: (2024)
Transferable Modeling Strategies for Low-Resource LLM Tasks: A Prompt and Alignment-Based Approach
por: Lyu, Shuangquan, et al.
Publicado: (2025)
por: Lyu, Shuangquan, et al.
Publicado: (2025)
DynaPrompt: Dynamic Test-Time Prompt Tuning
por: Xiao, Zehao, et al.
Publicado: (2025)
por: Xiao, Zehao, et al.
Publicado: (2025)
Reinforcement Learning with Semantic Rewards Enables Low-Resource Language Expansion without Alignment Tax
por: Su, Zeli, et al.
Publicado: (2026)
por: Su, Zeli, et al.
Publicado: (2026)
Noise Contrastive Alignment of Language Models with Explicit Rewards
por: Chen, Huayu, et al.
Publicado: (2024)
por: Chen, Huayu, et al.
Publicado: (2024)
Group Robust Preference Optimization in Reward-free RLHF
por: Ramesh, Shyam Sundhar, et al.
Publicado: (2024)
por: Ramesh, Shyam Sundhar, et al.
Publicado: (2024)
Energy-Based Reward Models for Robust Language Model Alignment
por: Lochab, Anamika, et al.
Publicado: (2025)
por: Lochab, Anamika, et al.
Publicado: (2025)
Self-Play Preference Optimization for Language Model Alignment
por: Wu, Yue, et al.
Publicado: (2024)
por: Wu, Yue, et al.
Publicado: (2024)
IAPT: Instruction-Aware Prompt Tuning for Large Language Models
por: Zhu, Wei, et al.
Publicado: (2024)
por: Zhu, Wei, et al.
Publicado: (2024)
Optimizing Large Language Models with an Enhanced LoRA Fine-Tuning Algorithm for Efficiency and Robustness in NLP Tasks
por: Hu, Jiacheng, et al.
Publicado: (2024)
por: Hu, Jiacheng, et al.
Publicado: (2024)
Dynamic Compressing Prompts for Efficient Inference of Large Language Models
por: Hu, Jinwu, et al.
Publicado: (2025)
por: Hu, Jinwu, et al.
Publicado: (2025)
Self-Augmented Preference Optimization: Off-Policy Paradigms for Language Model Alignment
por: Yin, Yueqin, et al.
Publicado: (2024)
por: Yin, Yueqin, et al.
Publicado: (2024)
MRO: Enhancing Reasoning in Diffusion Language Models via Multi-Reward Optimization
por: Wang, Chenglong, et al.
Publicado: (2025)
por: Wang, Chenglong, et al.
Publicado: (2025)
Patch-Prompt Aligned Bayesian Prompt Tuning for Vision-Language Models
por: Liu, Xinyang, et al.
Publicado: (2023)
por: Liu, Xinyang, et al.
Publicado: (2023)
Teaching Language Models to Evolve with Users: Dynamic Profile Modeling for Personalized Alignment
por: Zhao, Weixiang, et al.
Publicado: (2025)
por: Zhao, Weixiang, et al.
Publicado: (2025)
Ejemplares similares
-
Decentralized Arena: Towards Democratic and Scalable Automatic Evaluation of Language Models
por: Yin, Yanbin, et al.
Publicado: (2025) -
ToolkenGPT: Augmenting Frozen Language Models with Massive Tools via Tool Embeddings
por: Hao, Shibo, et al.
Publicado: (2023) -
Direct Large Language Model Alignment Through Self-Rewarding Contrastive Prompt Distillation
por: Liu, Aiwei, et al.
Publicado: (2024) -
SSP: Self-Supervised Prompting for Cross-Lingual Transfer to Low-Resource Languages using Large Language Models
por: Rathore, Vipul, et al.
Publicado: (2024) -
General Agentic Planning Through Simulative Reasoning with World Models
por: Deng, Mingkai, et al.
Publicado: (2025)