Flexible Realignment of Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Zhu, Wenhong, Xie, Ruobing, Zhang, Weinan, Wang, Rui |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Hybrid Policy Distillation for LLMs
di: Zhu, Wenhong, et al.
Pubblicazione: (2026)
di: Zhu, Wenhong, et al.
Pubblicazione: (2026)
Proximal Supervised Fine-Tuning
di: Zhu, Wenhong, et al.
Pubblicazione: (2025)
di: Zhu, Wenhong, et al.
Pubblicazione: (2025)
Decoding-time Realignment of Language Models
di: Liu, Tianlin, et al.
Pubblicazione: (2024)
di: Liu, Tianlin, et al.
Pubblicazione: (2024)
Adding Alignment Control to Language Models
di: Zhu, Wenhong, et al.
Pubblicazione: (2025)
di: Zhu, Wenhong, et al.
Pubblicazione: (2025)
AlignFreeze: Navigating the Impact of Realignment on the Layers of Multilingual Models Across Diverse Languages
di: Bakos, Steve, et al.
Pubblicazione: (2025)
di: Bakos, Steve, et al.
Pubblicazione: (2025)
Language Models "Grok" to Copy
di: Lv, Ang, et al.
Pubblicazione: (2024)
di: Lv, Ang, et al.
Pubblicazione: (2024)
Rethinking what Matters: Effective and Robust Multilingual Realignment for Low-Resource Languages
di: Nguyen, Quang Phuoc, et al.
Pubblicazione: (2025)
di: Nguyen, Quang Phuoc, et al.
Pubblicazione: (2025)
Optimizing Psychological Counseling with Instruction-Tuned Large Language Models
di: Li, Wenjie, et al.
Pubblicazione: (2024)
di: Li, Wenjie, et al.
Pubblicazione: (2024)
Unraveling and Mitigating Retriever Inconsistencies in Retrieval-Augmented Large Language Models
di: Li, Mingda, et al.
Pubblicazione: (2024)
di: Li, Mingda, et al.
Pubblicazione: (2024)
DPPA: Pruning Method for Large Language Model to Model Merging
di: Zhu, Yaochen, et al.
Pubblicazione: (2024)
di: Zhu, Yaochen, et al.
Pubblicazione: (2024)
Gradients with Respect to Semantics Preserving Embeddings Tell the Uncertainty of Large Language Models
di: Li, Mingda, et al.
Pubblicazione: (2026)
di: Li, Mingda, et al.
Pubblicazione: (2026)
Mastering Text, Code and Math Simultaneously via Fusing Highly Specialized Language Models
di: Ding, Ning, et al.
Pubblicazione: (2024)
di: Ding, Ning, et al.
Pubblicazione: (2024)
Autonomy-of-Experts Models
di: Lv, Ang, et al.
Pubblicazione: (2025)
di: Lv, Ang, et al.
Pubblicazione: (2025)
A Survey of Process Reward Models: From Outcome Signals to Process Supervisions for Large Language Models
di: Zheng, Congmin, et al.
Pubblicazione: (2025)
di: Zheng, Congmin, et al.
Pubblicazione: (2025)
ESI: Epistemic Uncertainty Quantification via Semantic-preserving Intervention for Large Language Models
di: Li, Mingda, et al.
Pubblicazione: (2025)
di: Li, Mingda, et al.
Pubblicazione: (2025)
Mitigating Hallucination in Multimodal Large Language Model via Hallucination-targeted Direct Preference Optimization
di: Fu, Yuhan, et al.
Pubblicazione: (2024)
di: Fu, Yuhan, et al.
Pubblicazione: (2024)
ELF-Gym: Evaluating Large Language Models Generated Features for Tabular Prediction
di: Zhang, Yanlin, et al.
Pubblicazione: (2024)
di: Zhang, Yanlin, et al.
Pubblicazione: (2024)
UltraFeedback: Boosting Language Models with Scaled AI Feedback
di: Cui, Ganqu, et al.
Pubblicazione: (2023)
di: Cui, Ganqu, et al.
Pubblicazione: (2023)
Adapting Large Language Models for Education: Foundational Capabilities, Potentials, and Challenges
di: Li, Qingyao, et al.
Pubblicazione: (2023)
di: Li, Qingyao, et al.
Pubblicazione: (2023)
CodeApex: A Bilingual Programming Evaluation Benchmark for Large Language Models
di: Fu, Lingyue, et al.
Pubblicazione: (2023)
di: Fu, Lingyue, et al.
Pubblicazione: (2023)
Emergent Structured Representations Support Flexible In-Context Inference in Large Language Models
di: Xu, Ningyu, et al.
Pubblicazione: (2026)
di: Xu, Ningyu, et al.
Pubblicazione: (2026)
Steering When Necessary: Flexible Steering Large Language Models with Backtracking
di: Cheng, Zifeng, et al.
Pubblicazione: (2025)
di: Cheng, Zifeng, et al.
Pubblicazione: (2025)
OpenR: An Open Source Framework for Advanced Reasoning with Large Language Models
di: Wang, Jun, et al.
Pubblicazione: (2024)
di: Wang, Jun, et al.
Pubblicazione: (2024)
Self-Distillation for Multi-Token Prediction
di: Zhao, Guoliang, et al.
Pubblicazione: (2026)
di: Zhao, Guoliang, et al.
Pubblicazione: (2026)
Beyond Natural Language: LLMs Leveraging Alternative Formats for Enhanced Reasoning and Communication
di: Chen, Weize, et al.
Pubblicazione: (2024)
di: Chen, Weize, et al.
Pubblicazione: (2024)
Language Models Represent Beliefs of Self and Others
di: Zhu, Wentao, et al.
Pubblicazione: (2024)
di: Zhu, Wentao, et al.
Pubblicazione: (2024)
FlexOlmo: Open Language Models for Flexible Data Use
di: Shi, Weijia, et al.
Pubblicazione: (2025)
di: Shi, Weijia, et al.
Pubblicazione: (2025)
Flexora: Flexible Low Rank Adaptation for Large Language Models
di: Wei, Chenxing, et al.
Pubblicazione: (2024)
di: Wei, Chenxing, et al.
Pubblicazione: (2024)
Lossless KV Cache Compression to 2%
di: Yang, Zhen, et al.
Pubblicazione: (2024)
di: Yang, Zhen, et al.
Pubblicazione: (2024)
Pioneering Reliable Assessment in Text-to-Image Knowledge Editing: Leveraging a Fine-Grained Dataset and an Innovative Criterion
di: Gu, Hengrui, et al.
Pubblicazione: (2024)
di: Gu, Hengrui, et al.
Pubblicazione: (2024)
SE-Merging: A Self-Enhanced Approach for Dynamic Model Merging
di: Chen, Zijun, et al.
Pubblicazione: (2025)
di: Chen, Zijun, et al.
Pubblicazione: (2025)
XGrammar: Flexible and Efficient Structured Generation Engine for Large Language Models
di: Dong, Yixin, et al.
Pubblicazione: (2024)
di: Dong, Yixin, et al.
Pubblicazione: (2024)
Ask Again, Then Fail: Large Language Models' Vacillations in Judgment
di: Xie, Qiming, et al.
Pubblicazione: (2023)
di: Xie, Qiming, et al.
Pubblicazione: (2023)
Embedding-Informed Adaptive Retrieval-Augmented Generation of Large Language Models
di: Huang, Chengkai, et al.
Pubblicazione: (2024)
di: Huang, Chengkai, et al.
Pubblicazione: (2024)
SciMaster: Towards General-Purpose Scientific AI Agents, Part I. X-Master as Foundation: Can We Lead on Humanity's Last Exam?
di: Chai, Jingyi, et al.
Pubblicazione: (2025)
di: Chai, Jingyi, et al.
Pubblicazione: (2025)
Pruning as a Cooperative Game: Surrogate-Assisted Layer Contribution Estimation for Large Language Models
di: Ding, Xuan, et al.
Pubblicazione: (2026)
di: Ding, Xuan, et al.
Pubblicazione: (2026)
Towards Better Multi-task Learning: A Framework for Optimizing Dataset Combinations in Large Language Models
di: Zhan, Zaifu, et al.
Pubblicazione: (2024)
di: Zhan, Zaifu, et al.
Pubblicazione: (2024)
More Expressive Attention with Negative Weights
di: Lv, Ang, et al.
Pubblicazione: (2024)
di: Lv, Ang, et al.
Pubblicazione: (2024)
A Survey on Fairness in Large Language Models
di: Li, Yingji, et al.
Pubblicazione: (2023)
di: Li, Yingji, et al.
Pubblicazione: (2023)
EcoSafeRAG: Efficient Security through Context Analysis in Retrieval-Augmented Generation
di: Yao, Ruobing, et al.
Pubblicazione: (2025)
di: Yao, Ruobing, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Hybrid Policy Distillation for LLMs
di: Zhu, Wenhong, et al.
Pubblicazione: (2026) -
Proximal Supervised Fine-Tuning
di: Zhu, Wenhong, et al.
Pubblicazione: (2025) -
Decoding-time Realignment of Language Models
di: Liu, Tianlin, et al.
Pubblicazione: (2024) -
Adding Alignment Control to Language Models
di: Zhu, Wenhong, et al.
Pubblicazione: (2025) -
AlignFreeze: Navigating the Impact of Realignment on the Layers of Multilingual Models Across Diverse Languages
di: Bakos, Steve, et al.
Pubblicazione: (2025)