Enhancing Large Language Model Performance with Gradient-Based Parameter Selection
Fuente:
arXiv
Salvato in:
| Autori principali: | Li, Haoling, Zhang, Xin, Liu, Xiao, Gong, Yeyun, Wang, Yifan, Chen, Qi, Cheng, Peng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2024
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Overcoming Vocabulary Mismatch: Vocabulary-agnostic Teacher Guided Language Modeling
di: Shin, Haebin, et al.
Pubblicazione: (2025)
di: Shin, Haebin, et al.
Pubblicazione: (2025)
Process-based Self-Rewarding Language Models
di: Zhang, Shimao, et al.
Pubblicazione: (2025)
di: Zhang, Shimao, et al.
Pubblicazione: (2025)
Enhancing Chain-of-Thoughts Prompting with Iterative Bootstrapping in Large Language Models
di: Sun, Jiashuo, et al.
Pubblicazione: (2023)
di: Sun, Jiashuo, et al.
Pubblicazione: (2023)
Learning from the Best, Differently: A Diversity-Driven Rethinking on Data Selection
di: He, Hongyi, et al.
Pubblicazione: (2025)
di: He, Hongyi, et al.
Pubblicazione: (2025)
How Does Alignment Enhance LLMs' Multilingual Capabilities? A Language Neurons Perspective
di: Zhang, Shimao, et al.
Pubblicazione: (2025)
di: Zhang, Shimao, et al.
Pubblicazione: (2025)
Velocitune: A Velocity-based Dynamic Domain Reweighting Method for Continual Pre-training
di: Luo, Zheheng, et al.
Pubblicazione: (2024)
di: Luo, Zheheng, et al.
Pubblicazione: (2024)
CRITIC: Large Language Models Can Self-Correct with Tool-Interactive Critiquing
di: Gou, Zhibin, et al.
Pubblicazione: (2023)
di: Gou, Zhibin, et al.
Pubblicazione: (2023)
Gradient Co-occurrence Analysis for Detecting Unsafe Prompts in Large Language Models
di: Yang, Jingyuan, et al.
Pubblicazione: (2025)
di: Yang, Jingyuan, et al.
Pubblicazione: (2025)
DynamixSFT: Dynamic Mixture Optimization of Instruction Tuning Collections
di: Shin, Haebin, et al.
Pubblicazione: (2025)
di: Shin, Haebin, et al.
Pubblicazione: (2025)
RoSA: Enhancing Parameter-Efficient Fine-Tuning via RoPE-aware Selective Adaptation in Large Language Models
di: Pan, Dayan, et al.
Pubblicazione: (2025)
di: Pan, Dayan, et al.
Pubblicazione: (2025)
LawGPT: A Chinese Legal Knowledge-Enhanced Large Language Model
di: Zhou, Zhi, et al.
Pubblicazione: (2024)
di: Zhou, Zhi, et al.
Pubblicazione: (2024)
Knowledge Graph-Enhanced Large Language Models via Path Selection
di: Liu, Haochen, et al.
Pubblicazione: (2024)
di: Liu, Haochen, et al.
Pubblicazione: (2024)
Data Mixing Agent: Learning to Re-weight Domains for Continual Pre-training
di: Yang, Kailai, et al.
Pubblicazione: (2025)
di: Yang, Kailai, et al.
Pubblicazione: (2025)
MAPO: Boosting Large Language Model Performance with Model-Adaptive Prompt Optimization
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
Unveiling the Misuse Potential of Base Large Language Models via In-Context Learning
di: Wang, Xiao, et al.
Pubblicazione: (2024)
di: Wang, Xiao, et al.
Pubblicazione: (2024)
Prompt and Parameter Co-Optimization for Large Language Models
di: Bo, Xiaohe, et al.
Pubblicazione: (2025)
di: Bo, Xiaohe, et al.
Pubblicazione: (2025)
Evaluating and Enhancing Large Language Models Performance in Domain-specific Medicine: Osteoarthritis Management with DocOA
di: Chen, Xi, et al.
Pubblicazione: (2024)
di: Chen, Xi, et al.
Pubblicazione: (2024)
Athena: Retrieval-augmented Legal Judgment Prediction with Large Language Models
di: Peng, Xiao, et al.
Pubblicazione: (2024)
di: Peng, Xiao, et al.
Pubblicazione: (2024)
Gradients with Respect to Semantics Preserving Embeddings Tell the Uncertainty of Large Language Models
di: Li, Mingda, et al.
Pubblicazione: (2026)
di: Li, Mingda, et al.
Pubblicazione: (2026)
Assessing and Understanding Creativity in Large Language Models
di: Zhao, Yunpu, et al.
Pubblicazione: (2024)
di: Zhao, Yunpu, et al.
Pubblicazione: (2024)
Ontology-Enhanced Knowledge Graph Completion using Large Language Models
di: Guo, Wenbin, et al.
Pubblicazione: (2025)
di: Guo, Wenbin, et al.
Pubblicazione: (2025)
Genshin: General Shield for Natural Language Processing with Large Language Models
di: Peng, Xiao, et al.
Pubblicazione: (2024)
di: Peng, Xiao, et al.
Pubblicazione: (2024)
Key-Point-Driven Data Synthesis with its Enhancement on Mathematical Reasoning
di: Huang, Yiming, et al.
Pubblicazione: (2024)
di: Huang, Yiming, et al.
Pubblicazione: (2024)
ELPO: Ensemble Learning Based Prompt Optimization for Large Language Models
di: Zhang, Qing, et al.
Pubblicazione: (2025)
di: Zhang, Qing, et al.
Pubblicazione: (2025)
A Survey of Large Language Models
di: Zhao, Wayne Xin, et al.
Pubblicazione: (2023)
di: Zhao, Wayne Xin, et al.
Pubblicazione: (2023)
Efficient Task Adaptation in Large Language Models via Selective Parameter Optimization
di: Wan, Weijie, et al.
Pubblicazione: (2026)
di: Wan, Weijie, et al.
Pubblicazione: (2026)
Are Large Language Models a Good Replacement of Taxonomies?
di: Sun, Yushi, et al.
Pubblicazione: (2024)
di: Sun, Yushi, et al.
Pubblicazione: (2024)
Unraveling and Mitigating Retriever Inconsistencies in Retrieval-Augmented Large Language Models
di: Li, Mingda, et al.
Pubblicazione: (2024)
di: Li, Mingda, et al.
Pubblicazione: (2024)
A Survey on Enhancing Causal Reasoning Ability of Large Language Models
di: Li, Xin, et al.
Pubblicazione: (2025)
di: Li, Xin, et al.
Pubblicazione: (2025)
Give Us the Facts: Enhancing Large Language Models with Knowledge Graphs for Fact-aware Language Modeling
di: Yang, Linyao, et al.
Pubblicazione: (2023)
di: Yang, Linyao, et al.
Pubblicazione: (2023)
AGENTIF: Benchmarking Instruction Following of Large Language Models in Agentic Scenarios
di: Qi, Yunjia, et al.
Pubblicazione: (2025)
di: Qi, Yunjia, et al.
Pubblicazione: (2025)
Integrative Decoding: Improve Factuality via Implicit Self-consistency
di: Cheng, Yi, et al.
Pubblicazione: (2024)
di: Cheng, Yi, et al.
Pubblicazione: (2024)
Ensuring Safe and High-Quality Outputs: A Guideline Library Approach for Language Models
di: Luo, Yi, et al.
Pubblicazione: (2024)
di: Luo, Yi, et al.
Pubblicazione: (2024)
CRANE: Causal Relevance Analysis of Language-Specific Neurons in Multilingual Large Language Models
di: Le, Yifan, et al.
Pubblicazione: (2026)
di: Le, Yifan, et al.
Pubblicazione: (2026)
A Survey on Large Language Models for Mathematical Reasoning
di: Wang, Peng-Yuan, et al.
Pubblicazione: (2025)
di: Wang, Peng-Yuan, et al.
Pubblicazione: (2025)
Delta -- Contrastive Decoding Mitigates Text Hallucinations in Large Language Models
di: Huang, Cheng Peng, et al.
Pubblicazione: (2025)
di: Huang, Cheng Peng, et al.
Pubblicazione: (2025)
EpiCoder: Encompassing Diversity and Complexity in Code Generation
di: Wang, Yaoxiang, et al.
Pubblicazione: (2025)
di: Wang, Yaoxiang, et al.
Pubblicazione: (2025)
Evaluating the Translation Performance of Large Language Models Based on Euas-20
di: Huang, Yan, et al.
Pubblicazione: (2024)
di: Huang, Yan, et al.
Pubblicazione: (2024)
Large Language Model Enhanced Knowledge Representation Learning: A Survey
di: Wang, Xin, et al.
Pubblicazione: (2024)
di: Wang, Xin, et al.
Pubblicazione: (2024)
BESA: Pruning Large Language Models with Blockwise Parameter-Efficient Sparsity Allocation
di: Xu, Peng, et al.
Pubblicazione: (2024)
di: Xu, Peng, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Overcoming Vocabulary Mismatch: Vocabulary-agnostic Teacher Guided Language Modeling
di: Shin, Haebin, et al.
Pubblicazione: (2025) -
Process-based Self-Rewarding Language Models
di: Zhang, Shimao, et al.
Pubblicazione: (2025) -
Enhancing Chain-of-Thoughts Prompting with Iterative Bootstrapping in Large Language Models
di: Sun, Jiashuo, et al.
Pubblicazione: (2023) -
Learning from the Best, Differently: A Diversity-Driven Rethinking on Data Selection
di: He, Hongyi, et al.
Pubblicazione: (2025) -
How Does Alignment Enhance LLMs' Multilingual Capabilities? A Language Neurons Perspective
di: Zhang, Shimao, et al.
Pubblicazione: (2025)