MVPBench: A Benchmark and Fine-Tuning Framework for Aligning Large Language Models with Diverse Human Values
Fuente:
arXiv
Guardado en:
| Autores principales: | Liang, Yao, Zhao, Dongcheng, Zhao, Feifei, Shen, Guobin, Wang, Yuwei, Liang, Dongqi, Zeng, Yi |
|---|---|
| Formato: | Preprint |
| Publicado: |
2025
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
C-VARC: A Large-Scale Chinese Value Rule Corpus for Value Alignment of Large Language Models
por: Wu, Ping, et al.
Publicado: (2025)
por: Wu, Ping, et al.
Publicado: (2025)
Multi-Level Safety Continual Projection for Fine-Tuned Large Language Models without Retraining
por: Han, Bing, et al.
Publicado: (2025)
por: Han, Bing, et al.
Publicado: (2025)
StressPrompt: Does Stress Impact Large Language Models and Human Performance Similarly?
por: Shen, Guobin, et al.
Publicado: (2024)
por: Shen, Guobin, et al.
Publicado: (2024)
TriAdaptLoRA: Brain-Inspired Triangular Adaptive Low-Rank Adaptation for Parameter-Efficient Fine-Tuning
por: Liang, Yao, et al.
Publicado: (2025)
por: Liang, Yao, et al.
Publicado: (2025)
Harnessing Task Overload for Scalable Jailbreak Attacks on Large Language Models
por: Dong, Yiting, et al.
Publicado: (2024)
por: Dong, Yiting, et al.
Publicado: (2024)
Matrix-Transformation Based Low-Rank Adaptation (MTLoRA): A Brain-Inspired Method for Parameter-Efficient Fine-Tuning
por: Liang, Yao, et al.
Publicado: (2024)
por: Liang, Yao, et al.
Publicado: (2024)
Jailbreak Antidote: Runtime Safety-Utility Balance via Sparse Representation Adjustment in Large Language Models
por: Shen, Guobin, et al.
Publicado: (2024)
por: Shen, Guobin, et al.
Publicado: (2024)
A Brain-inspired Memory Transformation based Differentiable Neural Computer for Reasoning-based Question Answering
por: Liang, Yao, et al.
Publicado: (2023)
por: Liang, Yao, et al.
Publicado: (2023)
Safety Instincts: LLMs Learn to Trust Their Internal Compass for Self-Defense
por: Shen, Guobin, et al.
Publicado: (2025)
por: Shen, Guobin, et al.
Publicado: (2025)
Aligning Large Language Models via Fine-grained Supervision
por: Xu, Dehong, et al.
Publicado: (2024)
por: Xu, Dehong, et al.
Publicado: (2024)
NeSTR: A Neuro-Symbolic Abductive Framework for Temporal Reasoning in Large Language Models
por: Liang, Feng, et al.
Publicado: (2025)
por: Liang, Feng, et al.
Publicado: (2025)
Scaling Data Diversity for Fine-Tuning Language Models in Human Alignment
por: Song, Feifan, et al.
Publicado: (2024)
por: Song, Feifan, et al.
Publicado: (2024)
Bidirectional Intention Inference Enhances LLMs' Defense Against Multi-Turn Jailbreak Attacks
por: Tong, Haibo, et al.
Publicado: (2025)
por: Tong, Haibo, et al.
Publicado: (2025)
ARS: Adaptive Reasoning Suppression for Efficient Large Reasoning Language Models
por: Zheng, Dongqi
Publicado: (2025)
por: Zheng, Dongqi
Publicado: (2025)
Taiyi: A Bilingual Fine-Tuned Large Language Model for Diverse Biomedical Tasks
por: Luo, Ling, et al.
Publicado: (2023)
por: Luo, Ling, et al.
Publicado: (2023)
Fine-Tuning Improves Information Conveyance in Language Models
por: Cheng, Yuwei, et al.
Publicado: (2026)
por: Cheng, Yuwei, et al.
Publicado: (2026)
Super Co-alignment of Human and AI for Sustainable Symbiotic Society
por: Zeng, Yi, et al.
Publicado: (2025)
por: Zeng, Yi, et al.
Publicado: (2025)
Anti-Self-Distillation for Reasoning RL via Pointwise Mutual Information
por: Shen, Guobin, et al.
Publicado: (2026)
por: Shen, Guobin, et al.
Publicado: (2026)
Impact of Fine-Tuning Methods on Memorization in Large Language Models
por: Hou, Jie, et al.
Publicado: (2025)
por: Hou, Jie, et al.
Publicado: (2025)
Large Language Models are Contrastive Reasoners
por: Yao, Liang
Publicado: (2024)
por: Yao, Liang
Publicado: (2024)
Improving Linguistic Diversity of Large Language Models with Possibility Exploration Fine-Tuning
por: Mai, Long, et al.
Publicado: (2024)
por: Mai, Long, et al.
Publicado: (2024)
Align Generative Artificial Intelligence with Human Preferences: A Novel Large Language Model Fine-Tuning Method for Online Review Management
por: Wang, Yanan, et al.
Publicado: (2026)
por: Wang, Yanan, et al.
Publicado: (2026)
Efficient Fine-Tuning of Large Language Models for Automated Medical Documentation
por: Leong, Hui Yi, et al.
Publicado: (2024)
por: Leong, Hui Yi, et al.
Publicado: (2024)
CAT: Causal Attention Tuning For Injecting Fine-grained Causal Knowledge into Large Language Models
por: Han, Kairong, et al.
Publicado: (2025)
por: Han, Kairong, et al.
Publicado: (2025)
Learning the Plasticity: Plasticity-Driven Learning Framework in Spiking Neural Networks
por: Shen, Guobin, et al.
Publicado: (2023)
por: Shen, Guobin, et al.
Publicado: (2023)
Learn from Downstream and Be Yourself in Multimodal Large Language Model Fine-Tuning
por: Huang, Wenke, et al.
Publicado: (2024)
por: Huang, Wenke, et al.
Publicado: (2024)
Diverse Human Value Alignment for Large Language Models via Ethical Reasoning
por: Wang, Jiahao, et al.
Publicado: (2025)
por: Wang, Jiahao, et al.
Publicado: (2025)
Developmental Plasticity-inspired Adaptive Pruning for Deep Spiking and Artificial Neural Networks
por: Han, Bing, et al.
Publicado: (2022)
por: Han, Bing, et al.
Publicado: (2022)
Light Alignment Improves LLM Safety via Model Self-Reflection with a Single Neuron
por: Shen, Sicheng, et al.
Publicado: (2026)
por: Shen, Sicheng, et al.
Publicado: (2026)
Memorization in Fine-Tuned Large Language Models
por: Savine, Danil
Publicado: (2025)
por: Savine, Danil
Publicado: (2025)
Evaluating the Performance of Large Language Models on GAOKAO Benchmark
por: Zhang, Xiaotian, et al.
Publicado: (2023)
por: Zhang, Xiaotian, et al.
Publicado: (2023)
FineMath: A Fine-Grained Mathematical Evaluation Benchmark for Chinese Large Language Models
por: Liu, Yan, et al.
Publicado: (2024)
por: Liu, Yan, et al.
Publicado: (2024)
Dynamic Adaptive Optimization for Effective Sentiment Analysis Fine-Tuning on Large Language Models
por: Ding, Hongcheng, et al.
Publicado: (2024)
por: Ding, Hongcheng, et al.
Publicado: (2024)
Aligning Large Language Models with Searcher Preferences
por: Wu, Wei, et al.
Publicado: (2026)
por: Wu, Wei, et al.
Publicado: (2026)
EnviroExam: Benchmarking Environmental Science Knowledge of Large Language Models
por: Huang, Yu, et al.
Publicado: (2024)
por: Huang, Yu, et al.
Publicado: (2024)
Revisiting Catastrophic Forgetting in Large Language Model Tuning
por: Li, Hongyu, et al.
Publicado: (2024)
por: Li, Hongyu, et al.
Publicado: (2024)
Relation Extraction with Fine-Tuned Large Language Models in Retrieval Augmented Generation Frameworks
por: Efeoglu, Sefika, et al.
Publicado: (2024)
por: Efeoglu, Sefika, et al.
Publicado: (2024)
Safety-Aware Fine-Tuning of Large Language Models
por: Choi, Hyeong Kyu, et al.
Publicado: (2024)
por: Choi, Hyeong Kyu, et al.
Publicado: (2024)
Phased Instruction Fine-Tuning for Large Language Models
por: Pang, Wei, et al.
Publicado: (2024)
por: Pang, Wei, et al.
Publicado: (2024)
Diversity as a Reward: Fine-Tuning LLMs on a Mixture of Domain-Undetermined Data
por: Ling, Zhenqing, et al.
Publicado: (2025)
por: Ling, Zhenqing, et al.
Publicado: (2025)
Ejemplares similares
-
C-VARC: A Large-Scale Chinese Value Rule Corpus for Value Alignment of Large Language Models
por: Wu, Ping, et al.
Publicado: (2025) -
Multi-Level Safety Continual Projection for Fine-Tuned Large Language Models without Retraining
por: Han, Bing, et al.
Publicado: (2025) -
StressPrompt: Does Stress Impact Large Language Models and Human Performance Similarly?
por: Shen, Guobin, et al.
Publicado: (2024) -
TriAdaptLoRA: Brain-Inspired Triangular Adaptive Low-Rank Adaptation for Parameter-Efficient Fine-Tuning
por: Liang, Yao, et al.
Publicado: (2025) -
Harnessing Task Overload for Scalable Jailbreak Attacks on Large Language Models
por: Dong, Yiting, et al.
Publicado: (2024)