BitFit: Simple Parameter-efficient Fine-tuning for Transformer-based Masked Language-models
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Ben-Zaken, Elad, Ravfogel, Shauli, Goldberg, Yoav |
|---|---|
| Format: | Preprint |
| Publié: |
2021
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Log-linear Guardedness and its Implications
par: Ravfogel, Shauli, et autres
Publié: (2022)
par: Ravfogel, Shauli, et autres
Publié: (2022)
Kernelized Concept Erasure
par: Ravfogel, Shauli, et autres
Publié: (2022)
par: Ravfogel, Shauli, et autres
Publié: (2022)
Linear Adversarial Concept Erasure
par: Ravfogel, Shauli, et autres
Publié: (2022)
par: Ravfogel, Shauli, et autres
Publié: (2022)
A Practical Method for Generating String Counterfactuals
par: Avitan, Matan, et autres
Publié: (2024)
par: Avitan, Matan, et autres
Publié: (2024)
Diversity Over Quantity: A Lesson From Few Shot Relation Classification
par: Cohen, Amir DN, et autres
Publié: (2024)
par: Cohen, Amir DN, et autres
Publié: (2024)
Description-Based Text Similarity
par: Ravfogel, Shauli, et autres
Publié: (2023)
par: Ravfogel, Shauli, et autres
Publié: (2023)
SALSA: Single-pass Autoregressive LLM Structured Classification
par: Berdichevsky, Ruslan, et autres
Publié: (2025)
par: Berdichevsky, Ruslan, et autres
Publié: (2025)
Gumbel Counterfactual Generation From Language Models
par: Ravfogel, Shauli, et autres
Publié: (2024)
par: Ravfogel, Shauli, et autres
Publié: (2024)
State over Tokens: Characterizing the Role of Reasoning Tokens
par: Levy, Mosh, et autres
Publié: (2025)
par: Levy, Mosh, et autres
Publié: (2025)
The Role of Language Imbalance in Cross-lingual Generalisation: Insights from Cloned Language Experiments
par: Schäfer, Anton, et autres
Publié: (2024)
par: Schäfer, Anton, et autres
Publié: (2024)
Chain of LoRA: Efficient Fine-tuning of Language Models via Residual Learning
par: Xia, Wenhan, et autres
Publié: (2024)
par: Xia, Wenhan, et autres
Publié: (2024)
Representation Surgery: Theory and Practice of Affine Steering
par: Singh, Shashwat, et autres
Publié: (2024)
par: Singh, Shashwat, et autres
Publié: (2024)
Random Masking Finds Winning Tickets for Parameter Efficient Fine-tuning
par: Xu, Jing, et autres
Publié: (2024)
par: Xu, Jing, et autres
Publié: (2024)
LEACE: Perfect linear concept erasure in closed form
par: Belrose, Nora, et autres
Publié: (2023)
par: Belrose, Nora, et autres
Publié: (2023)
Automatic Pruning of Fine-tuning Datasets for Transformer-based Language Models
par: Tayaranian, Mohammadreza, et autres
Publié: (2024)
par: Tayaranian, Mohammadreza, et autres
Publié: (2024)
Linguistic Binding in Diffusion Models: Enhancing Attribute Correspondence through Attention Map Alignment
par: Rassin, Royi, et autres
Publié: (2023)
par: Rassin, Royi, et autres
Publié: (2023)
Layer-wise Importance Matters: Less Memory for Better Performance in Parameter-efficient Fine-tuning of Large Language Models
par: Yao, Kai, et autres
Publié: (2024)
par: Yao, Kai, et autres
Publié: (2024)
Increasing Model Capacity for Free: A Simple Strategy for Parameter Efficient Fine-tuning
par: Song, Haobo, et autres
Publié: (2024)
par: Song, Haobo, et autres
Publié: (2024)
PRISM: PRIor from corpus Statistics for topic Modeling
par: Ishon, Tal, et autres
Publié: (2026)
par: Ishon, Tal, et autres
Publié: (2026)
On Affine Homotopy between Language Encoders
par: Chan, Robin SM, et autres
Publié: (2024)
par: Chan, Robin SM, et autres
Publié: (2024)
GRASS: Gradient-based Adaptive Layer-wise Importance Sampling for Memory-efficient Large Language Model Fine-tuning
par: Tian, Kaiyuan, et autres
Publié: (2026)
par: Tian, Kaiyuan, et autres
Publié: (2026)
Geometric Factual Recall in Transformers
par: Ravfogel, Shauli, et autres
Publié: (2026)
par: Ravfogel, Shauli, et autres
Publié: (2026)
Advancing Parameter Efficiency in Fine-tuning via Representation Editing
par: Wu, Muling, et autres
Publié: (2024)
par: Wu, Muling, et autres
Publié: (2024)
Towards Higher Effective Rank in Parameter-efficient Fine-tuning using Khatri--Rao Product
par: Albert, Paul, et autres
Publié: (2025)
par: Albert, Paul, et autres
Publié: (2025)
Obliviate: Neutralizing Task-agnostic Backdoors within the Parameter-efficient Fine-tuning Paradigm
par: Kim, Jaehan, et autres
Publié: (2024)
par: Kim, Jaehan, et autres
Publié: (2024)
Simultaneous Masking, Not Prompting Optimization: A Paradigm Shift in Fine-tuning LLMs for Simultaneous Translation
par: Raffel, Matthew, et autres
Publié: (2024)
par: Raffel, Matthew, et autres
Publié: (2024)
Preserving Task-Relevant Information Under Linear Concept Removal
par: Holstege, Floris, et autres
Publié: (2025)
par: Holstege, Floris, et autres
Publié: (2025)
Memento: Fine-tuning LLM Agents without Fine-tuning LLMs
par: Zhou, Huichi, et autres
Publié: (2025)
par: Zhou, Huichi, et autres
Publié: (2025)
CoMoE: Contrastive Representation for Mixture-of-Experts in Parameter-Efficient Fine-tuning
par: Feng, Jinyuan, et autres
Publié: (2025)
par: Feng, Jinyuan, et autres
Publié: (2025)
BitDelta: Your Fine-Tune May Only Be Worth One Bit
par: Liu, James, et autres
Publié: (2024)
par: Liu, James, et autres
Publié: (2024)
Parameter Efficient Fine-tuning via Explained Variance Adaptation
par: Paischer, Fabian, et autres
Publié: (2024)
par: Paischer, Fabian, et autres
Publié: (2024)
No Mean Feat: Simple, Strong Baselines for Context Compression
par: Feldman, Yair, et autres
Publié: (2025)
par: Feldman, Yair, et autres
Publié: (2025)
Compared to What? Baselines and Metrics for Counterfactual Prompting
par: Yang, Zihao, et autres
Publié: (2026)
par: Yang, Zihao, et autres
Publié: (2026)
Simple and Effective Masked Diffusion Language Models
par: Sahoo, Subham Sekhar, et autres
Publié: (2024)
par: Sahoo, Subham Sekhar, et autres
Publié: (2024)
S'MoRE: Structural Mixture of Residual Experts for Parameter-Efficient LLM Fine-tuning
par: Zeng, Hanqing, et autres
Publié: (2025)
par: Zeng, Hanqing, et autres
Publié: (2025)
Whispering in Amharic: Fine-tuning Whisper for Low-resource Language
par: Gete, Dawit Ketema, et autres
Publié: (2025)
par: Gete, Dawit Ketema, et autres
Publié: (2025)
Efficient Ensemble for Fine-tuning Language Models on Multiple Datasets
par: Li, Dongyue, et autres
Publié: (2025)
par: Li, Dongyue, et autres
Publié: (2025)
Fine-tuning Large Language Models for Domain-specific Machine Translation
par: Zheng, Jiawei, et autres
Publié: (2024)
par: Zheng, Jiawei, et autres
Publié: (2024)
Exploring Memorization in Fine-tuned Language Models
par: Zeng, Shenglai, et autres
Publié: (2023)
par: Zeng, Shenglai, et autres
Publié: (2023)
A General Framework to Enhance Fine-tuning-based LLM Unlearning
par: Ren, Jie, et autres
Publié: (2025)
par: Ren, Jie, et autres
Publié: (2025)
Documents similaires
-
Log-linear Guardedness and its Implications
par: Ravfogel, Shauli, et autres
Publié: (2022) -
Kernelized Concept Erasure
par: Ravfogel, Shauli, et autres
Publié: (2022) -
Linear Adversarial Concept Erasure
par: Ravfogel, Shauli, et autres
Publié: (2022) -
A Practical Method for Generating String Counterfactuals
par: Avitan, Matan, et autres
Publié: (2024) -
Diversity Over Quantity: A Lesson From Few Shot Relation Classification
par: Cohen, Amir DN, et autres
Publié: (2024)