Block Circulant Adapter for Large Language Models
Fuente:
arXiv
Salvato in:
| Autori principali: | Ding, Xinyu, Wang, Meiqi, Liao, Siyu, Wang, Zhongfeng |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Parameter-Efficient Fine-Tuning with Circulant and Diagonal Vectors
di: Ding, Xinyu, et al.
Pubblicazione: (2025)
di: Ding, Xinyu, et al.
Pubblicazione: (2025)
CBQ: Cross-Block Quantization for Large Language Models
di: Ding, Xin, et al.
Pubblicazione: (2023)
di: Ding, Xin, et al.
Pubblicazione: (2023)
Training-Free Bayesianization for Low-Rank Adapters of Large Language Models
di: Shi, Haizhou, et al.
Pubblicazione: (2024)
di: Shi, Haizhou, et al.
Pubblicazione: (2024)
Hadamard Adapter: An Extreme Parameter-Efficient Adapter Tuning Method for Pre-trained Language Models
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
di: Chen, Yuyan, et al.
Pubblicazione: (2024)
Data-driven Clustering and Merging of Adapters for On-device Large Language Models
di: Bohdal, Ondrej, et al.
Pubblicazione: (2026)
di: Bohdal, Ondrej, et al.
Pubblicazione: (2026)
BBox-Adapter: Lightweight Adapting for Black-Box Large Language Models
di: Sun, Haotian, et al.
Pubblicazione: (2024)
di: Sun, Haotian, et al.
Pubblicazione: (2024)
Towards Unified Task Embeddings Across Multiple Models: Bridging the Gap for Prompt-Based Large Language Models and Beyond
di: Wang, Xinyu, et al.
Pubblicazione: (2024)
di: Wang, Xinyu, et al.
Pubblicazione: (2024)
Erasing Without Remembering: Implicit Knowledge Forgetting in Large Language Models
di: Wang, Huazheng, et al.
Pubblicazione: (2025)
di: Wang, Huazheng, et al.
Pubblicazione: (2025)
K-Merge: Online Continual Merging of Adapters for On-device Large Language Models
di: Shenaj, Donald, et al.
Pubblicazione: (2025)
di: Shenaj, Donald, et al.
Pubblicazione: (2025)
JumpLoRA: Sparse Adapters for Continual Learning in Large Language Models
di: Dragomir, Alexandra, et al.
Pubblicazione: (2026)
di: Dragomir, Alexandra, et al.
Pubblicazione: (2026)
VLSM-Adapter: Finetuning Vision-Language Segmentation Efficiently with Lightweight Blocks
di: Dhakal, Manish, et al.
Pubblicazione: (2024)
di: Dhakal, Manish, et al.
Pubblicazione: (2024)
Correcting Suppressed Log-Probabilities in Language Models with Post-Transformer Adapters
di: Sanchez, Bryan
Pubblicazione: (2026)
di: Sanchez, Bryan
Pubblicazione: (2026)
AF Adapter: Continual Pretraining for Building Chinese Biomedical Language Model
di: Yan, Yongyu, et al.
Pubblicazione: (2022)
di: Yan, Yongyu, et al.
Pubblicazione: (2022)
Memory-Efficient Training with In-Place FFT Implementation
di: Ding, Xinyu, et al.
Pubblicazione: (2025)
di: Ding, Xinyu, et al.
Pubblicazione: (2025)
Filter-then-Generate: Large Language Models with Structure-Text Adapter for Knowledge Graph Completion
di: Liu, Ben, et al.
Pubblicazione: (2024)
di: Liu, Ben, et al.
Pubblicazione: (2024)
LEGO: Language Model Building Blocks
di: Bhansali, Shrenik, et al.
Pubblicazione: (2024)
di: Bhansali, Shrenik, et al.
Pubblicazione: (2024)
Simultaneous Computation and Memory Efficient Zeroth-Order Optimizer for Fine-Tuning Large Language Models
di: Wang, Fei, et al.
Pubblicazione: (2024)
di: Wang, Fei, et al.
Pubblicazione: (2024)
Semantic Consistency Regularization with Large Language Models for Semi-supervised Sentiment Analysis
di: Li, Kunrong, et al.
Pubblicazione: (2025)
di: Li, Kunrong, et al.
Pubblicazione: (2025)
Not All Adapters Matter: Selective Adapter Freezing for Memory-Efficient Fine-Tuning of Language Models
di: Son, Hyegang, et al.
Pubblicazione: (2024)
di: Son, Hyegang, et al.
Pubblicazione: (2024)
When to Commit? Towards Variable-Size Self-Contained Blocks for Discrete Diffusion Language Models
di: Wang, Danny, et al.
Pubblicazione: (2026)
di: Wang, Danny, et al.
Pubblicazione: (2026)
GeoBlock: Inferring Block Granularity from Dependency Geometry in Diffusion Language Models
di: Wan, Lipeng, et al.
Pubblicazione: (2026)
di: Wan, Lipeng, et al.
Pubblicazione: (2026)
Beyond Quality: Unlocking Diversity in Ad Headline Generation with Large Language Models
di: Wang, Chang, et al.
Pubblicazione: (2025)
di: Wang, Chang, et al.
Pubblicazione: (2025)
Dynamic Adaptation of LoRA Fine-Tuning for Efficient and Task-Specific Optimization of Large Language Models
di: Liao, Xiaoxuan, et al.
Pubblicazione: (2025)
di: Liao, Xiaoxuan, et al.
Pubblicazione: (2025)
Can Large Language Models Generalize Procedures Across Representations?
di: Lin, Fangru, et al.
Pubblicazione: (2026)
di: Lin, Fangru, et al.
Pubblicazione: (2026)
FUSE-ing Language Models: Zero-Shot Adapter Discovery for Prompt Optimization Across Tokenizers
di: Williams, Joshua Nathaniel, et al.
Pubblicazione: (2024)
di: Williams, Joshua Nathaniel, et al.
Pubblicazione: (2024)
Harnessing Large Language Models for Disaster Management: A Survey
di: Lei, Zhenyu, et al.
Pubblicazione: (2025)
di: Lei, Zhenyu, et al.
Pubblicazione: (2025)
Optimizing Large Language Models with an Enhanced LoRA Fine-Tuning Algorithm for Efficiency and Robustness in NLP Tasks
di: Hu, Jiacheng, et al.
Pubblicazione: (2024)
di: Hu, Jiacheng, et al.
Pubblicazione: (2024)
Interactions Across Blocks in Post-Training Quantization of Large Language Models
di: Shabanovi, Khasmamad, et al.
Pubblicazione: (2024)
di: Shabanovi, Khasmamad, et al.
Pubblicazione: (2024)
ApiQ: Finetuning of 2-Bit Quantized Large Language Model
di: Liao, Baohao, et al.
Pubblicazione: (2024)
di: Liao, Baohao, et al.
Pubblicazione: (2024)
Multiple Choice Learning of Low-Rank Adapters for Language Modeling
di: Letzelter, Victor, et al.
Pubblicazione: (2025)
di: Letzelter, Victor, et al.
Pubblicazione: (2025)
Simple, Efficient and Scalable Structure-aware Adapter Boosts Protein Language Models
di: Tan, Yang, et al.
Pubblicazione: (2024)
di: Tan, Yang, et al.
Pubblicazione: (2024)
Deep Learning for Medical Text Processing: BERT Model Fine-Tuning and Comparative Study
di: Hu, Jiacheng, et al.
Pubblicazione: (2024)
di: Hu, Jiacheng, et al.
Pubblicazione: (2024)
Adaptive Feature-based Low-Rank Compression of Large Language Models via Bayesian Optimization
di: Ji, Yixin, et al.
Pubblicazione: (2024)
di: Ji, Yixin, et al.
Pubblicazione: (2024)
Athena: Efficient Block-Wise Post-Training Quantization for Large Language Models Using Second-Order Matrix Derivative Information
di: Wang, Yanshu, et al.
Pubblicazione: (2024)
di: Wang, Yanshu, et al.
Pubblicazione: (2024)
Found in the Middle: Permutation Self-Consistency Improves Listwise Ranking in Large Language Models
di: Tang, Raphael, et al.
Pubblicazione: (2023)
di: Tang, Raphael, et al.
Pubblicazione: (2023)
SMoA: Spectrum Modulation Adapter for Parameter-Efficient Fine-Tuning
di: Liu, Yongkang, et al.
Pubblicazione: (2026)
di: Liu, Yongkang, et al.
Pubblicazione: (2026)
Beware of Calibration Data for Pruning Large Language Models
di: Ji, Yixin, et al.
Pubblicazione: (2024)
di: Ji, Yixin, et al.
Pubblicazione: (2024)
Learning to Route for Dynamic Adapter Composition in Continual Learning with Language Models
di: Araujo, Vladimir, et al.
Pubblicazione: (2024)
di: Araujo, Vladimir, et al.
Pubblicazione: (2024)
Shuttle Between the Instructions and the Parameters of Large Language Models
di: Sun, Wangtao, et al.
Pubblicazione: (2025)
di: Sun, Wangtao, et al.
Pubblicazione: (2025)
LIDAO: Towards Limited Interventions for Debiasing (Large) Language Models
di: Liu, Tianci, et al.
Pubblicazione: (2024)
di: Liu, Tianci, et al.
Pubblicazione: (2024)
Documenti analoghi
-
Parameter-Efficient Fine-Tuning with Circulant and Diagonal Vectors
di: Ding, Xinyu, et al.
Pubblicazione: (2025) -
CBQ: Cross-Block Quantization for Large Language Models
di: Ding, Xin, et al.
Pubblicazione: (2023) -
Training-Free Bayesianization for Low-Rank Adapters of Large Language Models
di: Shi, Haizhou, et al.
Pubblicazione: (2024) -
Hadamard Adapter: An Extreme Parameter-Efficient Adapter Tuning Method for Pre-trained Language Models
di: Chen, Yuyan, et al.
Pubblicazione: (2024) -
Data-driven Clustering and Merging of Adapters for On-device Large Language Models
di: Bohdal, Ondrej, et al.
Pubblicazione: (2026)