Enregistré dans:
| Auteurs principaux: | Zhang, Suoxin, He, Run, Fang, Di, Tan, Xiang, Chen, Kaixuan, Zhuang, Huiping |
|---|---|
| Format: | Preprint |
| Publié: |
2026
|
| Sujets: | |
| Accès en ligne: | https://arxiv.org/abs/2605.06183 |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Analytic Subspace Routing: How Recursive Least Squares Works in Continual Learning of Large Language Model
par: Tong, Kai, et autres
Publié: (2025)
par: Tong, Kai, et autres
Publié: (2025)
Rethinking the Role of Prompting Strategies in LLM Test-Time Scaling: A Perspective of Probability Theory
par: Liu, Yexiang, et autres
Publié: (2025)
par: Liu, Yexiang, et autres
Publié: (2025)
A Theoretical Perspective for Speculative Decoding Algorithm
par: Yin, Ming, et autres
Publié: (2024)
par: Yin, Ming, et autres
Publié: (2024)
ConsistentEE: A Consistent and Hardness-Guided Early Exiting Method for Accelerating Language Models Inference
par: Zeng, Ziqian, et autres
Publié: (2023)
par: Zeng, Ziqian, et autres
Publié: (2023)
LoRA-Pro: Are Low-Rank Adapters Properly Optimized?
par: Wang, Zhengbo, et autres
Publié: (2024)
par: Wang, Zhengbo, et autres
Publié: (2024)
BBox-Adapter: Lightweight Adapting for Black-Box Large Language Models
par: Sun, Haotian, et autres
Publié: (2024)
par: Sun, Haotian, et autres
Publié: (2024)
Not How Many, But Which: Parameter Placement in Low-Rank Adaptation
par: Sehanobish, Arijit, et autres
Publié: (2026)
par: Sehanobish, Arijit, et autres
Publié: (2026)
Rethinking Data Mixing from the Perspective of Large Language Models
par: Xu, Yuanjian, et autres
Publié: (2026)
par: Xu, Yuanjian, et autres
Publié: (2026)
Semantic Shift Estimation via Dual-Projection and Classifier Reconstruction for Exemplar-Free Class-Incremental Learning
par: He, Run, et autres
Publié: (2025)
par: He, Run, et autres
Publié: (2025)
Taming Momentum: Rethinking Optimizer States Through Low-Rank Approximation
par: Wang, Zhengbo, et autres
Publié: (2026)
par: Wang, Zhengbo, et autres
Publié: (2026)
Generative Adapter: Contextualizing Language Models in Parameters with A Single Forward Pass
par: Chen, Tong, et autres
Publié: (2024)
par: Chen, Tong, et autres
Publié: (2024)
Ensembles of Low-Rank Expert Adapters
par: Li, Yinghao, et autres
Publié: (2025)
par: Li, Yinghao, et autres
Publié: (2025)
Not All Adapters Matter: Selective Adapter Freezing for Memory-Efficient Fine-Tuning of Language Models
par: Son, Hyegang, et autres
Publié: (2024)
par: Son, Hyegang, et autres
Publié: (2024)
Reinforcement Learning from Human Feedback with Active Queries
par: Ji, Kaixuan, et autres
Publié: (2024)
par: Ji, Kaixuan, et autres
Publié: (2024)
CuMA: Aligning LLMs with Sparse Cultural Values via Demographic-Aware Mixture of Adapters
par: Sun, Ao, et autres
Publié: (2026)
par: Sun, Ao, et autres
Publié: (2026)
R-Stitch: Dynamic Trajectory Stitching for Efficient Reasoning
par: Chen, Zhuokun, et autres
Publié: (2025)
par: Chen, Zhuokun, et autres
Publié: (2025)
MoKA: Mixture of Kronecker Adapters
par: Sadeghi, Mohammadreza, et autres
Publié: (2025)
par: Sadeghi, Mohammadreza, et autres
Publié: (2025)
Random Initialization of Gated Sparse Adapters
par: Retault, Vi, et autres
Publié: (2025)
par: Retault, Vi, et autres
Publié: (2025)
Parameter-Efficient Routed Fine-Tuning: Mixture-of-Experts Demands Mixture of Adaptation Modules
par: Liu, Yilun, et autres
Publié: (2025)
par: Liu, Yilun, et autres
Publié: (2025)
Rethinking Genomic Modeling Through Optical Character Recognition
par: Xiang, Hongxin, et autres
Publié: (2026)
par: Xiang, Hongxin, et autres
Publié: (2026)
SpecDec++: Boosting Speculative Decoding via Adaptive Candidate Lengths
par: Huang, Kaixuan, et autres
Publié: (2024)
par: Huang, Kaixuan, et autres
Publié: (2024)
Dual-Personalizing Adapter for Federated Foundation Models
par: Yang, Yiyuan, et autres
Publié: (2024)
par: Yang, Yiyuan, et autres
Publié: (2024)
Learning Adapter Rank via Symmetry Breaking
par: Doyle, Cooper, et autres
Publié: (2025)
par: Doyle, Cooper, et autres
Publié: (2025)
Neutral Residues: Revisiting Adapters for Model Extension
par: Talla, Franck Signe, et autres
Publié: (2024)
par: Talla, Franck Signe, et autres
Publié: (2024)
Training-Free Bayesianization for Low-Rank Adapters of Large Language Models
par: Shi, Haizhou, et autres
Publié: (2024)
par: Shi, Haizhou, et autres
Publié: (2024)
Self-Play Fine-Tuning Converts Weak Language Models to Strong Language Models
par: Chen, Zixiang, et autres
Publié: (2024)
par: Chen, Zixiang, et autres
Publié: (2024)
An Adaptive Placement and Parallelism Framework for Accelerating RLHF Training
par: Xiao, Youshao, et autres
Publié: (2023)
par: Xiao, Youshao, et autres
Publié: (2023)
Hierarchical Recurrent Adapters for Efficient Multi-Task Adaptation of Large Speech Models
par: Munkhdalai, Tsendsuren, et autres
Publié: (2024)
par: Munkhdalai, Tsendsuren, et autres
Publié: (2024)
Do Not Let Low-Probability Tokens Over-Dominate in RL for LLMs
par: Yang, Zhihe, et autres
Publié: (2025)
par: Yang, Zhihe, et autres
Publié: (2025)
AlphaDecay: Module-wise Weight Decay for Heavy-Tailed Balancing in LLMs
par: He, Di, et autres
Publié: (2025)
par: He, Di, et autres
Publié: (2025)
Filter-then-Generate: Large Language Models with Structure-Text Adapter for Knowledge Graph Completion
par: Liu, Ben, et autres
Publié: (2024)
par: Liu, Ben, et autres
Publié: (2024)
Shears: Unstructured Sparsity with Neural Low-rank Adapter Search
par: Muñoz, J. Pablo, et autres
Publié: (2024)
par: Muñoz, J. Pablo, et autres
Publié: (2024)
ABBA-Adapters: Efficient and Expressive Fine-Tuning of Foundation Models
par: Singhal, Raghav, et autres
Publié: (2025)
par: Singhal, Raghav, et autres
Publié: (2025)
Multiple Choice Learning of Low-Rank Adapters for Language Modeling
par: Letzelter, Victor, et autres
Publié: (2025)
par: Letzelter, Victor, et autres
Publié: (2025)
Finer Parameter Steps for Low-Rank PEFT: A Controlled Study with CP Tensor Adapters
par: Wang, Xinjue, et autres
Publié: (2026)
par: Wang, Xinjue, et autres
Publié: (2026)
The Lottery LLM Hypothesis, Rethinking What Abilities Should LLM Compression Preserve?
par: Tang, Zhenheng, et autres
Publié: (2025)
par: Tang, Zhenheng, et autres
Publié: (2025)
Rethinking Reward Model Evaluation: Are We Barking up the Wrong Tree?
par: Wen, Xueru, et autres
Publié: (2024)
par: Wen, Xueru, et autres
Publié: (2024)
MemAdapter: Fast Alignment across Agent Memory Paradigms via Generative Subgraph Retrieval
par: Zhang, Xin, et autres
Publié: (2026)
par: Zhang, Xin, et autres
Publié: (2026)
Data-driven Clustering and Merging of Adapters for On-device Large Language Models
par: Bohdal, Ondrej, et autres
Publié: (2026)
par: Bohdal, Ondrej, et autres
Publié: (2026)
Learning to Route for Dynamic Adapter Composition in Continual Learning with Language Models
par: Araujo, Vladimir, et autres
Publié: (2024)
par: Araujo, Vladimir, et autres
Publié: (2024)
Documents similaires
-
Analytic Subspace Routing: How Recursive Least Squares Works in Continual Learning of Large Language Model
par: Tong, Kai, et autres
Publié: (2025) -
Rethinking the Role of Prompting Strategies in LLM Test-Time Scaling: A Perspective of Probability Theory
par: Liu, Yexiang, et autres
Publié: (2025) -
A Theoretical Perspective for Speculative Decoding Algorithm
par: Yin, Ming, et autres
Publié: (2024) -
ConsistentEE: A Consistent and Hardness-Guided Early Exiting Method for Accelerating Language Models Inference
par: Zeng, Ziqian, et autres
Publié: (2023) -
LoRA-Pro: Are Low-Rank Adapters Properly Optimized?
par: Wang, Zhengbo, et autres
Publié: (2024)