Value Augmented Sampling for Language Model Alignment and Personalization
Fuente:
arXiv
Salvato in:
| Autori principali: | Han, Seungwook, Shenfeld, Idan, Srivastava, Akash, Kim, Yoon, Agrawal, Pulkit |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Training Language Models via Neural Cellular Automata
di: Lee, Dan, et al.
Pubblicazione: (2026)
di: Lee, Dan, et al.
Pubblicazione: (2026)
Curiosity-driven Red-teaming for Large Language Models
di: Hong, Zhang-Wei, et al.
Pubblicazione: (2024)
di: Hong, Zhang-Wei, et al.
Pubblicazione: (2024)
Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective
di: Han, Seungwook, et al.
Pubblicazione: (2024)
di: Han, Seungwook, et al.
Pubblicazione: (2024)
Reaching Beyond the Mode: RL for Distributional Reasoning in Language Models
di: Puri, Isha, et al.
Pubblicazione: (2026)
di: Puri, Isha, et al.
Pubblicazione: (2026)
Beyond Binary Rewards: Training LMs to Reason About Their Uncertainty
di: Damani, Mehul, et al.
Pubblicazione: (2025)
di: Damani, Mehul, et al.
Pubblicazione: (2025)
Aligning Language Models from User Interactions
di: Buening, Thomas Kleine, et al.
Pubblicazione: (2026)
di: Buening, Thomas Kleine, et al.
Pubblicazione: (2026)
Language Model Personalization via Reward Factorization
di: Shenfeld, Idan, et al.
Pubblicazione: (2025)
di: Shenfeld, Idan, et al.
Pubblicazione: (2025)
Vector Policy Optimization: Training for Diversity Improves Test-Time Search
di: Bahlous-Boldi, Ryan, et al.
Pubblicazione: (2026)
di: Bahlous-Boldi, Ryan, et al.
Pubblicazione: (2026)
Learning How Hard to Think: Input-Adaptive Allocation of LM Computation
di: Damani, Mehul, et al.
Pubblicazione: (2024)
di: Damani, Mehul, et al.
Pubblicazione: (2024)
Personalizing Large Language Models using Retrieval Augmented Generation and Knowledge Graph
di: Prahlad, Deeksha, et al.
Pubblicazione: (2025)
di: Prahlad, Deeksha, et al.
Pubblicazione: (2025)
Internal Value Alignment in Large Language Models through Controlled Value Vector Activation
di: Jin, Haoran, et al.
Pubblicazione: (2025)
di: Jin, Haoran, et al.
Pubblicazione: (2025)
RL's Razor: Why Online Reinforcement Learning Forgets Less
di: Shenfeld, Idan, et al.
Pubblicazione: (2025)
di: Shenfeld, Idan, et al.
Pubblicazione: (2025)
SAIL: Self-Improving Efficient Online Alignment of Large Language Models
di: Ding, Mucong, et al.
Pubblicazione: (2024)
di: Ding, Mucong, et al.
Pubblicazione: (2024)
Curry-DPO: Enhancing Alignment using Curriculum Learning & Ranked Preferences
di: Pattnaik, Pulkit, et al.
Pubblicazione: (2024)
di: Pattnaik, Pulkit, et al.
Pubblicazione: (2024)
Rethinking the Role of Proxy Rewards in Language Model Alignment
di: Kim, Sungdong, et al.
Pubblicazione: (2024)
di: Kim, Sungdong, et al.
Pubblicazione: (2024)
On the Robustness of Reward Models for Language Model Alignment
di: Hong, Jiwoo, et al.
Pubblicazione: (2025)
di: Hong, Jiwoo, et al.
Pubblicazione: (2025)
Heterogeneous Value Alignment Evaluation for Large Language Models
di: Zhang, Zhaowei, et al.
Pubblicazione: (2023)
di: Zhang, Zhaowei, et al.
Pubblicazione: (2023)
Binary Classifier Optimization for Large Language Model Alignment
di: Jung, Seungjae, et al.
Pubblicazione: (2024)
di: Jung, Seungjae, et al.
Pubblicazione: (2024)
LifeAlign: Lifelong Alignment for Large Language Models with Memory-Augmented Focalized Preference Optimization
di: Li, Junsong, et al.
Pubblicazione: (2025)
di: Li, Junsong, et al.
Pubblicazione: (2025)
Learning to Interpret Weight Differences in Language Models
di: Goel, Avichal, et al.
Pubblicazione: (2025)
di: Goel, Avichal, et al.
Pubblicazione: (2025)
SQuat: Subspace-orthogonal KV Cache Quantization
di: Wang, Hao, et al.
Pubblicazione: (2025)
di: Wang, Hao, et al.
Pubblicazione: (2025)
AI-Augmented Surveys: Leveraging Large Language Models and Surveys for Opinion Prediction
di: Kim, Junsol, et al.
Pubblicazione: (2023)
di: Kim, Junsol, et al.
Pubblicazione: (2023)
Large Language Model Augmented Exercise Retrieval for Personalized Language Learning
di: Xu, Austin, et al.
Pubblicazione: (2024)
di: Xu, Austin, et al.
Pubblicazione: (2024)
Sample-Efficient Alignment for LLMs
di: Liu, Zichen, et al.
Pubblicazione: (2024)
di: Liu, Zichen, et al.
Pubblicazione: (2024)
Probabilistic Token Alignment for Large Language Model Fusion
di: Zeng, Runjia, et al.
Pubblicazione: (2025)
di: Zeng, Runjia, et al.
Pubblicazione: (2025)
RAP: Retrieval-Augmented Personalization for Multimodal Large Language Models
di: Hao, Haoran, et al.
Pubblicazione: (2024)
di: Hao, Haoran, et al.
Pubblicazione: (2024)
Personalized Language Modeling from Personalized Human Feedback
di: Li, Xinyu, et al.
Pubblicazione: (2024)
di: Li, Xinyu, et al.
Pubblicazione: (2024)
BAPO: Base-Anchored Preference Optimization for Overcoming Forgetting in Large Language Models Personalization
di: Lee, Gihun, et al.
Pubblicazione: (2024)
di: Lee, Gihun, et al.
Pubblicazione: (2024)
Towards Reasoning Ability of Small Language Models
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025)
di: Srivastava, Gaurav, et al.
Pubblicazione: (2025)
KaSA: Knowledge-Aware Singular-Value Adaptation of Large Language Models
di: Wang, Fan, et al.
Pubblicazione: (2024)
di: Wang, Fan, et al.
Pubblicazione: (2024)
Bringing Value Models Back: Generative Critics for Value Modeling in LLM Reinforcement Learning
di: Shan, Zikang, et al.
Pubblicazione: (2026)
di: Shan, Zikang, et al.
Pubblicazione: (2026)
Value-Action Alignment in Large Language Models under Privacy-Prosocial Conflict
di: Chen, Guanyu, et al.
Pubblicazione: (2026)
di: Chen, Guanyu, et al.
Pubblicazione: (2026)
Knowledge-Augmented Large Language Models for Personalized Contextual Query Suggestion
di: Baek, Jinheon, et al.
Pubblicazione: (2023)
di: Baek, Jinheon, et al.
Pubblicazione: (2023)
Learning Retrieval Augmentation for Personalized Dialogue Generation
di: Huang, Qiushi, et al.
Pubblicazione: (2024)
di: Huang, Qiushi, et al.
Pubblicazione: (2024)
Personalized Alignment Revisited: The Necessity and Sufficiency of User Diversity
di: Kang, Enoch Hyunwook
Pubblicazione: (2026)
di: Kang, Enoch Hyunwook
Pubblicazione: (2026)
Evolutionary Contrastive Distillation for Language Model Alignment
di: Katz-Samuels, Julian, et al.
Pubblicazione: (2024)
di: Katz-Samuels, Julian, et al.
Pubblicazione: (2024)
Pareto Multi-Objective Alignment for Language Models
di: He, Qiang, et al.
Pubblicazione: (2025)
di: He, Qiang, et al.
Pubblicazione: (2025)
MolMem: Memory-Augmented Agentic Reinforcement Learning for Sample-Efficient Molecular Optimization
di: Wang, Ziqing, et al.
Pubblicazione: (2026)
di: Wang, Ziqing, et al.
Pubblicazione: (2026)
Text Knows What, Tables Know When: Clinical Timeline Reconstruction via Retrieval-Augmented Multimodal Alignment
di: Kumar, Sayantan, et al.
Pubblicazione: (2026)
di: Kumar, Sayantan, et al.
Pubblicazione: (2026)
Relative Value Biases in Large Language Models
di: Hayes, William M., et al.
Pubblicazione: (2024)
di: Hayes, William M., et al.
Pubblicazione: (2024)
Documenti analoghi
-
Training Language Models via Neural Cellular Automata
di: Lee, Dan, et al.
Pubblicazione: (2026) -
Curiosity-driven Red-teaming for Large Language Models
di: Hong, Zhang-Wei, et al.
Pubblicazione: (2024) -
Emergence and Effectiveness of Task Vectors in In-Context Learning: An Encoder Decoder Perspective
di: Han, Seungwook, et al.
Pubblicazione: (2024) -
Reaching Beyond the Mode: RL for Distributional Reasoning in Language Models
di: Puri, Isha, et al.
Pubblicazione: (2026) -
Beyond Binary Rewards: Training LMs to Reason About Their Uncertainty
di: Damani, Mehul, et al.
Pubblicazione: (2025)