VALUEFLOW: Toward Pluralistic and Steerable Value-based Alignment in Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Kim, Woojin, Hyeon, Sieun, Oh, Jusang, Do, Jaeyoung |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
MATA: Multi-Agent Framework for Reliable and Flexible Table Question Answering
por: Hyeon, Sieun, et al.
Publicado: (2026)
por: Hyeon, Sieun, et al.
Publicado: (2026)
Don't Let It Fade: Preserving Edits in Diffusion Language Models via Token Timestep Allocation
por: Kim, Woojin, et al.
Publicado: (2025)
por: Kim, Woojin, et al.
Publicado: (2025)
Dynin-Omni: Omnimodal Unified Large Diffusion Language Model
por: Kim, Jaeik, et al.
Publicado: (2026)
por: Kim, Jaeik, et al.
Publicado: (2026)
Steerable Pluralism: Pluralistic Alignment via Few-Shot Comparative Regression
por: Adams, Jadie, et al.
Publicado: (2025)
por: Adams, Jadie, et al.
Publicado: (2025)
Is Retraining-Free Enough? The Necessity of Router Calibration for Efficient MoE Compression
por: Hyeon, Sieun, et al.
Publicado: (2026)
por: Hyeon, Sieun, et al.
Publicado: (2026)
Counterfactual Reasoning for Steerable Pluralistic Value Alignment of Large Language Models
por: Guo, Hanze, et al.
Publicado: (2025)
por: Guo, Hanze, et al.
Publicado: (2025)
MathSpeech: Leveraging Small LMs for Accurate Conversion in Mathematical Speech-to-Formula
por: Hyeon, Sieun, et al.
Publicado: (2024)
por: Hyeon, Sieun, et al.
Publicado: (2024)
MathBridge: A Large Corpus Dataset for Translating Spoken Mathematical Expressions into $LaTeX$ Formulas for Improved Readability
por: Jung, Kyudan, et al.
Publicado: (2024)
por: Jung, Kyudan, et al.
Publicado: (2024)
The Pluralistic Moral Gap: Understanding Judgment and Value Differences between Humans and Large Language Models
por: Russo, Giuseppe, et al.
Publicado: (2025)
por: Russo, Giuseppe, et al.
Publicado: (2025)
Aligning Large Language Models via Fine-grained Supervision
por: Xu, Dehong, et al.
Publicado: (2024)
por: Xu, Dehong, et al.
Publicado: (2024)
RFEval: Benchmarking Reasoning Faithfulness under Counterfactual Reasoning Intervention in Large Reasoning Models
por: Han, Yunseok, et al.
Publicado: (2026)
por: Han, Yunseok, et al.
Publicado: (2026)
VISPA: Pluralistic Alignment via Automatic Value Selection and Activation
por: Zheng, Shenyan, et al.
Publicado: (2026)
por: Zheng, Shenyan, et al.
Publicado: (2026)
Pluralistic Off-policy Evaluation and Alignment
por: Huang, Chengkai, et al.
Publicado: (2025)
por: Huang, Chengkai, et al.
Publicado: (2025)
PICACO: Pluralistic In-Context Value Alignment of LLMs via Total Correlation Optimization
por: Jiang, Han, et al.
Publicado: (2025)
por: Jiang, Han, et al.
Publicado: (2025)
SEAL: Steerable Reasoning Calibration of Large Language Models for Free
por: Chen, Runjin, et al.
Publicado: (2025)
por: Chen, Runjin, et al.
Publicado: (2025)
Evaluating the Prompt Steerability of Large Language Models
por: Miehling, Erik, et al.
Publicado: (2024)
por: Miehling, Erik, et al.
Publicado: (2024)
A Roadmap to Pluralistic Alignment
por: Sorensen, Taylor, et al.
Publicado: (2024)
por: Sorensen, Taylor, et al.
Publicado: (2024)
AI Steerability 360: A Toolkit for Steering Large Language Models
por: Miehling, Erik, et al.
Publicado: (2026)
por: Miehling, Erik, et al.
Publicado: (2026)
Value Kaleidoscope: Engaging AI with Pluralistic Human Values, Rights, and Duties
por: Sorensen, Taylor, et al.
Publicado: (2023)
por: Sorensen, Taylor, et al.
Publicado: (2023)
MixDPO: Modeling Preference Strength for Pluralistic Alignment
por: Imai, Saki, et al.
Publicado: (2026)
por: Imai, Saki, et al.
Publicado: (2026)
Benchmarking Multi-National Value Alignment for Large Language Models
por: Shi, Weijie, et al.
Publicado: (2025)
por: Shi, Weijie, et al.
Publicado: (2025)
Your Language Model is Its Own Critic: Reinforcement Learning with Value Estimation from Actor's Internal States
por: Choi, Yunho, et al.
Publicado: (2026)
por: Choi, Yunho, et al.
Publicado: (2026)
On the Robustness of Reward Models for Language Model Alignment
por: Hong, Jiwoo, et al.
Publicado: (2025)
por: Hong, Jiwoo, et al.
Publicado: (2025)
MMPB: It's Time for Multi-Modal Personalization
por: Kim, Jaeik, et al.
Publicado: (2025)
por: Kim, Jaeik, et al.
Publicado: (2025)
A Systematic Evaluation of Preference Aggregation in Federated RLHF for Pluralistic Alignment of LLMs
por: Srewa, Mahmoud, et al.
Publicado: (2025)
por: Srewa, Mahmoud, et al.
Publicado: (2025)
Don't Forget Your Reward Values: Language Model Alignment via Value-based Calibration
por: Mao, Xin, et al.
Publicado: (2024)
por: Mao, Xin, et al.
Publicado: (2024)
Diverse Human Value Alignment for Large Language Models via Ethical Reasoning
por: Wang, Jiahao, et al.
Publicado: (2025)
por: Wang, Jiahao, et al.
Publicado: (2025)
Pluralistic Alignment for Healthcare: A Role-Driven Framework
por: Zhong, Jiayou, et al.
Publicado: (2025)
por: Zhong, Jiayou, et al.
Publicado: (2025)
Towards Context-Invariant Safety Alignment for Large Language Models
por: Wang, Yixu, et al.
Publicado: (2026)
por: Wang, Yixu, et al.
Publicado: (2026)
VITAL: A New Dataset for Benchmarking Pluralistic Alignment in Healthcare
por: Shetty, Anudeex, et al.
Publicado: (2025)
por: Shetty, Anudeex, et al.
Publicado: (2025)
Value Augmented Sampling for Language Model Alignment and Personalization
por: Han, Seungwook, et al.
Publicado: (2024)
por: Han, Seungwook, et al.
Publicado: (2024)
Internal Value Alignment in Large Language Models through Controlled Value Vector Activation
por: Jin, Haoran, et al.
Publicado: (2025)
por: Jin, Haoran, et al.
Publicado: (2025)
Language Models are Homer Simpson! Safety Re-Alignment of Fine-tuned Language Models through Task Arithmetic
por: Bhardwaj, Rishabh, et al.
Publicado: (2024)
por: Bhardwaj, Rishabh, et al.
Publicado: (2024)
Uncovering Factor Level Preferences to Improve Human-Model Alignment
por: Oh, Juhyun, et al.
Publicado: (2024)
por: Oh, Juhyun, et al.
Publicado: (2024)
Towards Efficient Visual-Language Alignment of the Q-Former for Visual Reasoning Tasks
por: Kim, Sungkyung, et al.
Publicado: (2024)
por: Kim, Sungkyung, et al.
Publicado: (2024)
A Persona-Based Evaluation Framework for Pluralistic Alignment in Generative AI
por: Karagoz, Atahan
Publicado: (2026)
por: Karagoz, Atahan
Publicado: (2026)
Heterogeneous Value Alignment Evaluation for Large Language Models
por: Zhang, Zhaowei, et al.
Publicado: (2023)
por: Zhang, Zhaowei, et al.
Publicado: (2023)
Exploring Chain-of-Thought Reasoning for Steerable Pluralistic Alignment
por: Zhang, Yunfan, et al.
Publicado: (2025)
por: Zhang, Yunfan, et al.
Publicado: (2025)
Exploring Iterative Controllable Summarization with Large Language Models
por: Ryu, Sangwon, et al.
Publicado: (2024)
por: Ryu, Sangwon, et al.
Publicado: (2024)
Exploring Large Language Models on Cross-Cultural Values in Connection with Training Methodology
por: Kim, Minsang, et al.
Publicado: (2024)
por: Kim, Minsang, et al.
Publicado: (2024)
Ejemplares similares
-
MATA: Multi-Agent Framework for Reliable and Flexible Table Question Answering
por: Hyeon, Sieun, et al.
Publicado: (2026) -
Don't Let It Fade: Preserving Edits in Diffusion Language Models via Token Timestep Allocation
por: Kim, Woojin, et al.
Publicado: (2025) -
Dynin-Omni: Omnimodal Unified Large Diffusion Language Model
por: Kim, Jaeik, et al.
Publicado: (2026) -
Steerable Pluralism: Pluralistic Alignment via Few-Shot Comparative Regression
por: Adams, Jadie, et al.
Publicado: (2025) -
Is Retraining-Free Enough? The Necessity of Router Calibration for Efficient MoE Compression
por: Hyeon, Sieun, et al.
Publicado: (2026)