VALUEFLOW: Toward Pluralistic and Steerable Value-based Alignment in Large Language Models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Woojin, Hyeon, Sieun, Oh, Jusang, Do, Jaeyoung |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
MATA: Multi-Agent Framework for Reliable and Flexible Table Question Answering
par: Hyeon, Sieun, et autres
Publié: (2026)
par: Hyeon, Sieun, et autres
Publié: (2026)
Don't Let It Fade: Preserving Edits in Diffusion Language Models via Token Timestep Allocation
par: Kim, Woojin, et autres
Publié: (2025)
par: Kim, Woojin, et autres
Publié: (2025)
Dynin-Omni: Omnimodal Unified Large Diffusion Language Model
par: Kim, Jaeik, et autres
Publié: (2026)
par: Kim, Jaeik, et autres
Publié: (2026)
Steerable Pluralism: Pluralistic Alignment via Few-Shot Comparative Regression
par: Adams, Jadie, et autres
Publié: (2025)
par: Adams, Jadie, et autres
Publié: (2025)
Is Retraining-Free Enough? The Necessity of Router Calibration for Efficient MoE Compression
par: Hyeon, Sieun, et autres
Publié: (2026)
par: Hyeon, Sieun, et autres
Publié: (2026)
Counterfactual Reasoning for Steerable Pluralistic Value Alignment of Large Language Models
par: Guo, Hanze, et autres
Publié: (2025)
par: Guo, Hanze, et autres
Publié: (2025)
MathSpeech: Leveraging Small LMs for Accurate Conversion in Mathematical Speech-to-Formula
par: Hyeon, Sieun, et autres
Publié: (2024)
par: Hyeon, Sieun, et autres
Publié: (2024)
MathBridge: A Large Corpus Dataset for Translating Spoken Mathematical Expressions into $LaTeX$ Formulas for Improved Readability
par: Jung, Kyudan, et autres
Publié: (2024)
par: Jung, Kyudan, et autres
Publié: (2024)
The Pluralistic Moral Gap: Understanding Judgment and Value Differences between Humans and Large Language Models
par: Russo, Giuseppe, et autres
Publié: (2025)
par: Russo, Giuseppe, et autres
Publié: (2025)
Aligning Large Language Models via Fine-grained Supervision
par: Xu, Dehong, et autres
Publié: (2024)
par: Xu, Dehong, et autres
Publié: (2024)
RFEval: Benchmarking Reasoning Faithfulness under Counterfactual Reasoning Intervention in Large Reasoning Models
par: Han, Yunseok, et autres
Publié: (2026)
par: Han, Yunseok, et autres
Publié: (2026)
VISPA: Pluralistic Alignment via Automatic Value Selection and Activation
par: Zheng, Shenyan, et autres
Publié: (2026)
par: Zheng, Shenyan, et autres
Publié: (2026)
Pluralistic Off-policy Evaluation and Alignment
par: Huang, Chengkai, et autres
Publié: (2025)
par: Huang, Chengkai, et autres
Publié: (2025)
PICACO: Pluralistic In-Context Value Alignment of LLMs via Total Correlation Optimization
par: Jiang, Han, et autres
Publié: (2025)
par: Jiang, Han, et autres
Publié: (2025)
SEAL: Steerable Reasoning Calibration of Large Language Models for Free
par: Chen, Runjin, et autres
Publié: (2025)
par: Chen, Runjin, et autres
Publié: (2025)
Evaluating the Prompt Steerability of Large Language Models
par: Miehling, Erik, et autres
Publié: (2024)
par: Miehling, Erik, et autres
Publié: (2024)
A Roadmap to Pluralistic Alignment
par: Sorensen, Taylor, et autres
Publié: (2024)
par: Sorensen, Taylor, et autres
Publié: (2024)
AI Steerability 360: A Toolkit for Steering Large Language Models
par: Miehling, Erik, et autres
Publié: (2026)
par: Miehling, Erik, et autres
Publié: (2026)
Value Kaleidoscope: Engaging AI with Pluralistic Human Values, Rights, and Duties
par: Sorensen, Taylor, et autres
Publié: (2023)
par: Sorensen, Taylor, et autres
Publié: (2023)
MixDPO: Modeling Preference Strength for Pluralistic Alignment
par: Imai, Saki, et autres
Publié: (2026)
par: Imai, Saki, et autres
Publié: (2026)
Benchmarking Multi-National Value Alignment for Large Language Models
par: Shi, Weijie, et autres
Publié: (2025)
par: Shi, Weijie, et autres
Publié: (2025)
Your Language Model is Its Own Critic: Reinforcement Learning with Value Estimation from Actor's Internal States
par: Choi, Yunho, et autres
Publié: (2026)
par: Choi, Yunho, et autres
Publié: (2026)
On the Robustness of Reward Models for Language Model Alignment
par: Hong, Jiwoo, et autres
Publié: (2025)
par: Hong, Jiwoo, et autres
Publié: (2025)
MMPB: It's Time for Multi-Modal Personalization
par: Kim, Jaeik, et autres
Publié: (2025)
par: Kim, Jaeik, et autres
Publié: (2025)
A Systematic Evaluation of Preference Aggregation in Federated RLHF for Pluralistic Alignment of LLMs
par: Srewa, Mahmoud, et autres
Publié: (2025)
par: Srewa, Mahmoud, et autres
Publié: (2025)
Don't Forget Your Reward Values: Language Model Alignment via Value-based Calibration
par: Mao, Xin, et autres
Publié: (2024)
par: Mao, Xin, et autres
Publié: (2024)
Diverse Human Value Alignment for Large Language Models via Ethical Reasoning
par: Wang, Jiahao, et autres
Publié: (2025)
par: Wang, Jiahao, et autres
Publié: (2025)
Pluralistic Alignment for Healthcare: A Role-Driven Framework
par: Zhong, Jiayou, et autres
Publié: (2025)
par: Zhong, Jiayou, et autres
Publié: (2025)
Towards Context-Invariant Safety Alignment for Large Language Models
par: Wang, Yixu, et autres
Publié: (2026)
par: Wang, Yixu, et autres
Publié: (2026)
VITAL: A New Dataset for Benchmarking Pluralistic Alignment in Healthcare
par: Shetty, Anudeex, et autres
Publié: (2025)
par: Shetty, Anudeex, et autres
Publié: (2025)
Value Augmented Sampling for Language Model Alignment and Personalization
par: Han, Seungwook, et autres
Publié: (2024)
par: Han, Seungwook, et autres
Publié: (2024)
Internal Value Alignment in Large Language Models through Controlled Value Vector Activation
par: Jin, Haoran, et autres
Publié: (2025)
par: Jin, Haoran, et autres
Publié: (2025)
Language Models are Homer Simpson! Safety Re-Alignment of Fine-tuned Language Models through Task Arithmetic
par: Bhardwaj, Rishabh, et autres
Publié: (2024)
par: Bhardwaj, Rishabh, et autres
Publié: (2024)
Uncovering Factor Level Preferences to Improve Human-Model Alignment
par: Oh, Juhyun, et autres
Publié: (2024)
par: Oh, Juhyun, et autres
Publié: (2024)
Towards Efficient Visual-Language Alignment of the Q-Former for Visual Reasoning Tasks
par: Kim, Sungkyung, et autres
Publié: (2024)
par: Kim, Sungkyung, et autres
Publié: (2024)
A Persona-Based Evaluation Framework for Pluralistic Alignment in Generative AI
par: Karagoz, Atahan
Publié: (2026)
par: Karagoz, Atahan
Publié: (2026)
Heterogeneous Value Alignment Evaluation for Large Language Models
par: Zhang, Zhaowei, et autres
Publié: (2023)
par: Zhang, Zhaowei, et autres
Publié: (2023)
Exploring Chain-of-Thought Reasoning for Steerable Pluralistic Alignment
par: Zhang, Yunfan, et autres
Publié: (2025)
par: Zhang, Yunfan, et autres
Publié: (2025)
Exploring Iterative Controllable Summarization with Large Language Models
par: Ryu, Sangwon, et autres
Publié: (2024)
par: Ryu, Sangwon, et autres
Publié: (2024)
Exploring Large Language Models on Cross-Cultural Values in Connection with Training Methodology
par: Kim, Minsang, et autres
Publié: (2024)
par: Kim, Minsang, et autres
Publié: (2024)
Documents similaires
-
MATA: Multi-Agent Framework for Reliable and Flexible Table Question Answering
par: Hyeon, Sieun, et autres
Publié: (2026) -
Don't Let It Fade: Preserving Edits in Diffusion Language Models via Token Timestep Allocation
par: Kim, Woojin, et autres
Publié: (2025) -
Dynin-Omni: Omnimodal Unified Large Diffusion Language Model
par: Kim, Jaeik, et autres
Publié: (2026) -
Steerable Pluralism: Pluralistic Alignment via Few-Shot Comparative Regression
par: Adams, Jadie, et autres
Publié: (2025) -
Is Retraining-Free Enough? The Necessity of Router Calibration for Efficient MoE Compression
par: Hyeon, Sieun, et autres
Publié: (2026)