Guardado en:
| Autores principales: | Xu, Hefei, Wu, Le, Wang, Yu, Hou, Min, Wu, Han, Zhang, Zhen, Wang, Meng |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | https://arxiv.org/abs/2603.18113 |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
Multi-Value Alignment for LLMs via Value Decorrelation and Extrapolation
por: Xu, Hefei, et al.
Publicado: (2025)
por: Xu, Hefei, et al.
Publicado: (2025)
Internal Value Alignment in Large Language Models through Controlled Value Vector Activation
por: Jin, Haoran, et al.
Publicado: (2025)
por: Jin, Haoran, et al.
Publicado: (2025)
PiSSA: Principal Singular Values and Singular Vectors Adaptation of Large Language Models
por: Meng, Fanxu, et al.
Publicado: (2024)
por: Meng, Fanxu, et al.
Publicado: (2024)
Alignment Revisited: Are Large Language Models Consistent in Stated and Revealed Preferences?
por: Gu, Zhuojun, et al.
Publicado: (2025)
por: Gu, Zhuojun, et al.
Publicado: (2025)
Heterogeneous Value Alignment Evaluation for Large Language Models
por: Zhang, Zhaowei, et al.
Publicado: (2023)
por: Zhang, Zhaowei, et al.
Publicado: (2023)
Counterfactual Reasoning for Steerable Pluralistic Value Alignment of Large Language Models
por: Guo, Hanze, et al.
Publicado: (2025)
por: Guo, Hanze, et al.
Publicado: (2025)
Value Augmented Sampling for Language Model Alignment and Personalization
por: Han, Seungwook, et al.
Publicado: (2024)
por: Han, Seungwook, et al.
Publicado: (2024)
Benchmarking Multi-National Value Alignment for Large Language Models
por: Shi, Weijie, et al.
Publicado: (2025)
por: Shi, Weijie, et al.
Publicado: (2025)
Bone Soups: A Seek-and-Soup Model Merging Approach for Controllable Multi-Objective Generation
por: Xie, Guofu, et al.
Publicado: (2025)
por: Xie, Guofu, et al.
Publicado: (2025)
Value-Action Alignment in Large Language Models under Privacy-Prosocial Conflict
por: Chen, Guanyu, et al.
Publicado: (2026)
por: Chen, Guanyu, et al.
Publicado: (2026)
MAP: Multi-Human-Value Alignment Palette
por: Wang, Xinran, et al.
Publicado: (2024)
por: Wang, Xinran, et al.
Publicado: (2024)
CATP-LLM: Empowering Large Language Models for Cost-Aware Tool Planning
por: Wu, Duo, et al.
Publicado: (2024)
por: Wu, Duo, et al.
Publicado: (2024)
Bringing Value Models Back: Generative Critics for Value Modeling in LLM Reinforcement Learning
por: Shan, Zikang, et al.
Publicado: (2026)
por: Shan, Zikang, et al.
Publicado: (2026)
Highway Value Iteration Networks
por: Wang, Yuhui, et al.
Publicado: (2024)
por: Wang, Yuhui, et al.
Publicado: (2024)
SoupLM: Model Integration in Large Language and Multi-Modal Models
por: Bai, Yue, et al.
Publicado: (2024)
por: Bai, Yue, et al.
Publicado: (2024)
Vision Language Models are In-Context Value Learners
por: Ma, Yecheng Jason, et al.
Publicado: (2024)
por: Ma, Yecheng Jason, et al.
Publicado: (2024)
Spend Search Where It Pays: Value-Guided Structured Sampling and Optimization for Generative Recommendation
por: Jiang, Jie, et al.
Publicado: (2026)
por: Jiang, Jie, et al.
Publicado: (2026)
Relative Value Biases in Large Language Models
por: Hayes, William M., et al.
Publicado: (2024)
por: Hayes, William M., et al.
Publicado: (2024)
Unlocking Interpretability for RF Sensing: A Complex-Valued White-Box Transformer
por: Zhang, Xie, et al.
Publicado: (2025)
por: Zhang, Xie, et al.
Publicado: (2025)
Pessimistic Value Iteration for Multi-Task Data Sharing in Offline Reinforcement Learning
por: Bai, Chenjia, et al.
Publicado: (2024)
por: Bai, Chenjia, et al.
Publicado: (2024)
WKVQuant: Quantizing Weight and Key/Value Cache for Large Language Models Gains More
por: Yue, Yuxuan, et al.
Publicado: (2024)
por: Yue, Yuxuan, et al.
Publicado: (2024)
SGDPO: Self-Guided Direct Preference Optimization for Language Model Alignment
por: Zhu, Wenqiao, et al.
Publicado: (2025)
por: Zhu, Wenqiao, et al.
Publicado: (2025)
Singular Value Decomposition on Kronecker Adaptation for Large Language Model
por: Chong, Yee Hin, et al.
Publicado: (2025)
por: Chong, Yee Hin, et al.
Publicado: (2025)
VALUE: Value-Aware Large Language Model for Query Rewriting via Weighted Trie in Sponsored Search
por: Zhang, Xiao, et al.
Publicado: (2025)
por: Zhang, Xiao, et al.
Publicado: (2025)
Diverse Randomized Value Functions: A Provably Pessimistic Approach for Offline Reinforcement Learning
por: Yu, Xudong, et al.
Publicado: (2024)
por: Yu, Xudong, et al.
Publicado: (2024)
ECG-Soup: Harnessing Multi-Layer Synergy for ECG Foundation Models
por: Nguyen, Phu X., et al.
Publicado: (2025)
por: Nguyen, Phu X., et al.
Publicado: (2025)
Rethinking Key-Value Cache Compression Techniques for Large Language Model Serving
por: Gao, Wei, et al.
Publicado: (2025)
por: Gao, Wei, et al.
Publicado: (2025)
Stitched Value Model for Diffusion Alignment
por: Go, Hyojun, et al.
Publicado: (2026)
por: Go, Hyojun, et al.
Publicado: (2026)
KaSA: Knowledge-Aware Singular-Value Adaptation of Large Language Models
por: Wang, Fan, et al.
Publicado: (2024)
por: Wang, Fan, et al.
Publicado: (2024)
Multi-level Value Alignment in Agentic AI Systems: Survey and Perspectives
por: Zeng, Wei, et al.
Publicado: (2025)
por: Zeng, Wei, et al.
Publicado: (2025)
Regurgitative Training: The Value of Real Data in Training Large Language Models
por: Zhang, Jinghui, et al.
Publicado: (2024)
por: Zhang, Jinghui, et al.
Publicado: (2024)
Pretrain Value, Not Reward: Decoupled Value Policy Optimization
por: Huang, Chenghua, et al.
Publicado: (2025)
por: Huang, Chenghua, et al.
Publicado: (2025)
Losing is for Cherishing: Data Valuation Based on Machine Unlearning and Shapley Value
por: Ma, Le, et al.
Publicado: (2025)
por: Ma, Le, et al.
Publicado: (2025)
Diverse Human Value Alignment for Large Language Models via Ethical Reasoning
por: Wang, Jiahao, et al.
Publicado: (2025)
por: Wang, Jiahao, et al.
Publicado: (2025)
Explaining Large Language Models Decisions Using Shapley Values
por: Mohammadi, Behnam
Publicado: (2024)
por: Mohammadi, Behnam
Publicado: (2024)
How Can LLM Guide RL? A Value-Based Approach
por: Zhang, Shenao, et al.
Publicado: (2024)
por: Zhang, Shenao, et al.
Publicado: (2024)
Toward Stable Value Alignment: Introducing Independent Modules for Consistent Value Guidance
por: Chen, Wenhao, et al.
Publicado: (2026)
por: Chen, Wenhao, et al.
Publicado: (2026)
Efficient Table Retrieval and Understanding with Multimodal Large Language Models
por: Xu, Zhuoyan, et al.
Publicado: (2026)
por: Xu, Zhuoyan, et al.
Publicado: (2026)
Context-Value-Action Architecture for Value-Driven Large Language Model Agents
por: Zhang, TianZe, et al.
Publicado: (2026)
por: Zhang, TianZe, et al.
Publicado: (2026)
Knowledge-Level Consistency Reinforcement Learning: Dual-Fact Alignment for Long-Form Factuality
por: Li, Junliang, et al.
Publicado: (2025)
por: Li, Junliang, et al.
Publicado: (2025)
Ejemplares similares
-
Multi-Value Alignment for LLMs via Value Decorrelation and Extrapolation
por: Xu, Hefei, et al.
Publicado: (2025) -
Internal Value Alignment in Large Language Models through Controlled Value Vector Activation
por: Jin, Haoran, et al.
Publicado: (2025) -
PiSSA: Principal Singular Values and Singular Vectors Adaptation of Large Language Models
por: Meng, Fanxu, et al.
Publicado: (2024) -
Alignment Revisited: Are Large Language Models Consistent in Stated and Revealed Preferences?
por: Gu, Zhuojun, et al.
Publicado: (2025) -
Heterogeneous Value Alignment Evaluation for Large Language Models
por: Zhang, Zhaowei, et al.
Publicado: (2023)