Vocabulary-level Memory Efficiency for Language Model Fine-tuning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Williams, Miles, Aletras, Nikolaos |
|---|---|
| Format: | Preprint |
| Publié: |
2023
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Self-calibration for Language Model Quantization and Pruning
par: Williams, Miles, et autres
Publié: (2024)
par: Williams, Miles, et autres
Publié: (2024)
On the Impact of Calibration Data in Post-training Quantization and Pruning
par: Williams, Miles, et autres
Publié: (2023)
par: Williams, Miles, et autres
Publié: (2023)
Comparing Explanation Faithfulness between Multilingual and Monolingual Fine-tuned Language Models
par: Zhao, Zhixue, et autres
Publié: (2024)
par: Zhao, Zhixue, et autres
Publié: (2024)
Compressing Language Models for Specialized Domains
par: Williams, Miles, et autres
Publié: (2025)
par: Williams, Miles, et autres
Publié: (2025)
Investigating Hallucinations in Pruned Large Language Models for Abstractive Summarization
par: Chrysostomou, George, et autres
Publié: (2023)
par: Chrysostomou, George, et autres
Publié: (2023)
An Empirical Study on Cross-lingual Vocabulary Adaptation for Efficient Language Model Inference
par: Yamaguchi, Atsuki, et autres
Publié: (2024)
par: Yamaguchi, Atsuki, et autres
Publié: (2024)
How Can We Effectively Expand the Vocabulary of LLMs with 0.01GB of Target Language Text?
par: Yamaguchi, Atsuki, et autres
Publié: (2024)
par: Yamaguchi, Atsuki, et autres
Publié: (2024)
Fine-Tuning on Noisy Instructions: Effects on Generalization and Performance
par: Alajrami, Ahmed, et autres
Publié: (2025)
par: Alajrami, Ahmed, et autres
Publié: (2025)
How Private are Language Models in Abstractive Summarization?
par: Hughes, Anthony, et autres
Publié: (2024)
par: Hughes, Anthony, et autres
Publié: (2024)
Enhancing Linguistic Competence of Language Models through Pre-training with Language Learning Tasks
par: Yamaguchi, Atsuki, et autres
Publié: (2026)
par: Yamaguchi, Atsuki, et autres
Publié: (2026)
Deconstructing Attention: Investigating Design Principles for Effective Language Modeling
par: Xue, Huiyin, et autres
Publié: (2025)
par: Xue, Huiyin, et autres
Publié: (2025)
Adapting Chat Language Models Using Only Target Unlabeled Language Data
par: Yamaguchi, Atsuki, et autres
Publié: (2024)
par: Yamaguchi, Atsuki, et autres
Publié: (2024)
Incorporating Attribution Importance for Improving Faithfulness Metrics
par: Zhao, Zhixue, et autres
Publié: (2023)
par: Zhao, Zhixue, et autres
Publié: (2023)
MEDVOC: Vocabulary Adaptation for Fine-tuning Pre-trained Language Models on Medical Text Summarization
par: Balde, Gunjan, et autres
Publié: (2024)
par: Balde, Gunjan, et autres
Publié: (2024)
Progressive Depth Up-scaling via Optimal Transport
par: Cao, Mingzi, et autres
Publié: (2025)
par: Cao, Mingzi, et autres
Publié: (2025)
Enhancing Logical Reasoning in Language Models via Symbolically-Guided Monte Carlo Process Supervision
par: Tan, Xingwei, et autres
Publié: (2025)
par: Tan, Xingwei, et autres
Publié: (2025)
Examining the Limitations of Computational Rumor Detection Models Trained on Static Datasets
par: Mu, Yida, et autres
Publié: (2023)
par: Mu, Yida, et autres
Publié: (2023)
Mitigating Catastrophic Forgetting in Target Language Adaptation of LLMs via Source-Shielded Updates
par: Yamaguchi, Atsuki, et autres
Publié: (2025)
par: Yamaguchi, Atsuki, et autres
Publié: (2025)
PATCH: Mitigating PII Leakage in Language Models with Privacy-Aware Targeted Circuit PatcHing
par: Hughes, Anthony, et autres
Publié: (2025)
par: Hughes, Anthony, et autres
Publié: (2025)
GreekBarBench: A Challenging Benchmark for Free-Text Legal Reasoning and Citations
par: Chlapanis, Odysseas S., et autres
Publié: (2025)
par: Chlapanis, Odysseas S., et autres
Publié: (2025)
Enhancing Data Quality through Simple De-duplication: Navigating Responsible Computational Social Science Research
par: Mu, Yida, et autres
Publié: (2024)
par: Mu, Yida, et autres
Publié: (2024)
Preference-grounded Token-level Guidance for Language Model Fine-tuning
par: Yang, Shentao, et autres
Publié: (2023)
par: Yang, Shentao, et autres
Publié: (2023)
Where does output diversity collapse in post-training?
par: Karouzos, Constantinos, et autres
Publié: (2026)
par: Karouzos, Constantinos, et autres
Publié: (2026)
An Empirical Study on Preference Tuning Generalization and Diversity Under Domain Shift
par: Karouzos, Constantinos, et autres
Publié: (2026)
par: Karouzos, Constantinos, et autres
Publié: (2026)
Reasoning Dynamics and the Limits of Monitoring Modality Reliance in Vision-Language Models
par: Villegas, Danae Sánchez, et autres
Publié: (2026)
par: Villegas, Danae Sánchez, et autres
Publié: (2026)
Speculative Decoding with a Speculative Vocabulary
par: Williams, Miles, et autres
Publié: (2026)
par: Williams, Miles, et autres
Publié: (2026)
Compliance versus Sensibility: On the Reasoning Controllability in Large Language Models
par: Tan, Xingwei, et autres
Publié: (2026)
par: Tan, Xingwei, et autres
Publié: (2026)
Fundamental Reasoning Paradigms Induce Out-of-Domain Generalization in Language Models
par: Cao, Mingzi, et autres
Publié: (2026)
par: Cao, Mingzi, et autres
Publié: (2026)
Can Confidence Estimates Decide When Chain-of-Thought Is Necessary for LLMs?
par: Lewis-Lim, Samuel, et autres
Publié: (2025)
par: Lewis-Lim, Samuel, et autres
Publié: (2025)
We Need to Talk About Classification Evaluation Metrics in NLP
par: Vickers, Peter, et autres
Publié: (2024)
par: Vickers, Peter, et autres
Publié: (2024)
Fine-tuning Large Language Models with Sequential Instructions
par: Hu, Hanxu, et autres
Publié: (2024)
par: Hu, Hanxu, et autres
Publié: (2024)
Sparse Matrix in Large Language Model Fine-tuning
par: He, Haoze, et autres
Publié: (2024)
par: He, Haoze, et autres
Publié: (2024)
EffiCoder: Enhancing Code Generation in Large Language Models through Efficiency-Aware Fine-tuning
par: Huang, Dong, et autres
Publié: (2024)
par: Huang, Dong, et autres
Publié: (2024)
Analysing Chain of Thought Dynamics: Active Guidance or Unfaithful Post-hoc Rationalisation?
par: Lewis-Lim, Samuel, et autres
Publié: (2025)
par: Lewis-Lim, Samuel, et autres
Publié: (2025)
Investigating the Representation of Backchannels and Fillers in Fine-tuned Language Models
par: Wang, Yu, et autres
Publié: (2025)
par: Wang, Yu, et autres
Publié: (2025)
Navigating Prompt Complexity for Zero-Shot Classification: A Study of Large Language Models in Computational Social Science
par: Mu, Yida, et autres
Publié: (2023)
par: Mu, Yida, et autres
Publié: (2023)
Improving Multimodal Classification of Social Media Posts by Leveraging Image-Text Auxiliary Tasks
par: Villegas, Danae Sánchez, et autres
Publié: (2023)
par: Villegas, Danae Sánchez, et autres
Publié: (2023)
Semi-supervised Fine-tuning for Large Language Models
par: Luo, Junyu, et autres
Publié: (2024)
par: Luo, Junyu, et autres
Publié: (2024)
NeurIPS 2023 LLM Efficiency Fine-tuning Competition
par: Saroufim, Mark, et autres
Publié: (2025)
par: Saroufim, Mark, et autres
Publié: (2025)
Advancing Parameter Efficiency in Fine-tuning via Representation Editing
par: Wu, Muling, et autres
Publié: (2024)
par: Wu, Muling, et autres
Publié: (2024)
Documents similaires
-
Self-calibration for Language Model Quantization and Pruning
par: Williams, Miles, et autres
Publié: (2024) -
On the Impact of Calibration Data in Post-training Quantization and Pruning
par: Williams, Miles, et autres
Publié: (2023) -
Comparing Explanation Faithfulness between Multilingual and Monolingual Fine-tuned Language Models
par: Zhao, Zhixue, et autres
Publié: (2024) -
Compressing Language Models for Specialized Domains
par: Williams, Miles, et autres
Publié: (2025) -
Investigating Hallucinations in Pruned Large Language Models for Abstractive Summarization
par: Chrysostomou, George, et autres
Publié: (2023)