MALoRA: Mixture of Asymmetric Low-Rank Adaptation for Enhanced Multi-Task Learning
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Wang, Xujia, Zhao, Haiyan, Wang, Shuo, Wang, Hanqing, Liu, Zhiyuan |
|---|---|
| Format: | Preprint |
| Publié: |
2024
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
FIM-LoRA: Task-Informative Rank Allocation for LoRA via Calibration-Time Gradient-Variance Estimation
par: Sathyavageeswaran, Ramakrishnan
Publié: (2026)
par: Sathyavageeswaran, Ramakrishnan
Publié: (2026)
SpectralLoRA: Is Low-Frequency Structure Sufficient for LoRA Adaptation? A Spectral Analysis of Weight Updates
par: Singh, Rajveer
Publié: (2026)
par: Singh, Rajveer
Publié: (2026)
Quantization-Robust LLM Unlearning via Low-Rank Adaptation
par: Abitante, João Vitor Boer, et autres
Publié: (2026)
par: Abitante, João Vitor Boer, et autres
Publié: (2026)
LoRS: Efficient Low-Rank Adaptation for Sparse Large Language Model
par: Hu, Yuxuan, et autres
Publié: (2025)
par: Hu, Yuxuan, et autres
Publié: (2025)
TensLoRA: Tensor Alternatives for Low-Rank Adaptation
par: Marmoret, Axel, et autres
Publié: (2025)
par: Marmoret, Axel, et autres
Publié: (2025)
MELoRA: Mini-Ensemble Low-Rank Adapters for Parameter-Efficient Fine-Tuning
par: Ren, Pengjie, et autres
Publié: (2024)
par: Ren, Pengjie, et autres
Publié: (2024)
A Multi-Task Benchmark for Abusive Language Detection in Low-Resource Settings
par: Gaim, Fitsum, et autres
Publié: (2025)
par: Gaim, Fitsum, et autres
Publié: (2025)
Amulet: ReAlignment During Test Time for Personalized Preference Adaptation of LLMs
par: Zhang, Zhaowei, et autres
Publié: (2025)
par: Zhang, Zhaowei, et autres
Publié: (2025)
Low-Resource Court Judgment Summarization for Common Law Systems
par: Liu, Shuaiqi, et autres
Publié: (2024)
par: Liu, Shuaiqi, et autres
Publié: (2024)
WSM: Decay-Free Learning Rate Schedule via Checkpoint Merging for LLM Pre-training
par: Tian, Changxin, et autres
Publié: (2025)
par: Tian, Changxin, et autres
Publié: (2025)
Annotation Entropy Predicts Per-Example Learning Dynamics in LoRA Fine-Tuning
par: Steele, Brady
Publié: (2026)
par: Steele, Brady
Publié: (2026)
SECURA: Sigmoid-Enhanced CUR Decomposition with Uninterrupted Retention and Low-Rank Adaptation in Large Language Models
par: Zhang, Yuxuan
Publié: (2025)
par: Zhang, Yuxuan
Publié: (2025)
Where Should LoRA Go? Component-Type Placement in Hybrid Language Models
par: Borobia, Hector, et autres
Publié: (2026)
par: Borobia, Hector, et autres
Publié: (2026)
Generalizable LLM Learning of Graph Synthetic Data with Post-training Alignment
par: Zhang, Yizhuo, et autres
Publié: (2025)
par: Zhang, Yizhuo, et autres
Publié: (2025)
Evaluating the Efficacy of Hybrid Deep Learning Models in Distinguishing AI-Generated Text
par: Oketunji, Abiodun Finbarrs
Publié: (2023)
par: Oketunji, Abiodun Finbarrs
Publié: (2023)
Heidelberg-Boston @ SIGTYP 2024 Shared Task: Enhancing Low-Resource Language Analysis With Character-Aware Hierarchical Transformers
par: Riemenschneider, Frederick, et autres
Publié: (2024)
par: Riemenschneider, Frederick, et autres
Publié: (2024)
BLP-2023 Task 2: Sentiment Analysis
par: Hasan, Md. Arid, et autres
Publié: (2023)
par: Hasan, Md. Arid, et autres
Publié: (2023)
Ouroboros: Dynamic Weight Generation for Recursive Transformers via Input-Conditioned LoRA Modulation
par: Jaber, Jaber, et autres
Publié: (2026)
par: Jaber, Jaber, et autres
Publié: (2026)
Enhancing Paraphrase Type Generation: The Impact of DPO and RLHF Evaluated with Human-Ranked Data
par: Lübbers, Christopher Lee
Publié: (2025)
par: Lübbers, Christopher Lee
Publié: (2025)
AMELI: Enhancing Multimodal Entity Linking with Fine-Grained Attributes
par: Yao, Barry Menglong, et autres
Publié: (2023)
par: Yao, Barry Menglong, et autres
Publié: (2023)
Learning to Generate Structured Output with Schema Reinforcement Learning
par: Lu, Yaxi, et autres
Publié: (2025)
par: Lu, Yaxi, et autres
Publié: (2025)
From Classification to Ranking: Enhancing LLM Reasoning Capabilities for MBTI Personality Detection
par: Cao, Yuan, et autres
Publié: (2026)
par: Cao, Yuan, et autres
Publié: (2026)
Mixture of Attention Spans: Optimizing LLM Inference Efficiency with Heterogeneous Sliding-Window Lengths
par: Fu, Tianyu, et autres
Publié: (2024)
par: Fu, Tianyu, et autres
Publié: (2024)
TCNN: Triple Convolutional Neural Network Models for Retrieval-based Question Answering System in E-commerce
par: Song, Shuangyong, et autres
Publié: (2020)
par: Song, Shuangyong, et autres
Publié: (2020)
Enhancing In-Context Learning via Implicit Demonstration Augmentation
par: Zhou, Xiaoling, et autres
Publié: (2024)
par: Zhou, Xiaoling, et autres
Publié: (2024)
Towards Greater Leverage: Scaling Laws for Efficient Mixture-of-Experts Language Models
par: Tian, Changxin, et autres
Publié: (2025)
par: Tian, Changxin, et autres
Publié: (2025)
Sparsing Law: Towards Large Language Models with Greater Activation Sparsity
par: Luo, Yuqi, et autres
Publié: (2024)
par: Luo, Yuqi, et autres
Publié: (2024)
Lacuna Language Learning: Leveraging RNNs for Ranked Text Completion in Digitized Coptic Manuscripts
par: Levine, Lauren, et autres
Publié: (2024)
par: Levine, Lauren, et autres
Publié: (2024)
AgentTTS: Large Language Model Agent for Test-time Compute-optimal Scaling Strategy in Complex Tasks
par: Wang, Fali, et autres
Publié: (2025)
par: Wang, Fali, et autres
Publié: (2025)
GenAI Content Detection Task 3: Cross-Domain Machine-Generated Text Detection Challenge
par: Dugan, Liam, et autres
Publié: (2025)
par: Dugan, Liam, et autres
Publié: (2025)
Memory Bank Compression for Continual Adaptation of Large Language Models
par: Katraouras, Thomas, et autres
Publié: (2026)
par: Katraouras, Thomas, et autres
Publié: (2026)
Lon-ea at SemEval-2023 Task 11: A Comparison of Activation Functions for Soft and Hard Label Prediction
par: Hosseini, Peyman, et autres
Publié: (2023)
par: Hosseini, Peyman, et autres
Publié: (2023)
CRISP: Persistent Concept Unlearning via Sparse Autoencoders
par: Ashuach, Tomer, et autres
Publié: (2025)
par: Ashuach, Tomer, et autres
Publié: (2025)
KenSwQuAD -- A Question Answering Dataset for Swahili Low Resource Language
par: Wanjawa, Barack W., et autres
Publié: (2022)
par: Wanjawa, Barack W., et autres
Publié: (2022)
Every Sample Matters: Leveraging Mixture-of-Experts and High-Quality Data for Efficient and Accurate Code LLM
par: Codefuse, et autres
Publié: (2025)
par: Codefuse, et autres
Publié: (2025)
Ambiguity in LLMs is a concept missing problem
par: Hu, Zhibo, et autres
Publié: (2025)
par: Hu, Zhibo, et autres
Publié: (2025)
Comparative Analysis of LoRA-Adapted Embedding Models for Clinical Cardiology Text Representation
par: Young, Richard J., et autres
Publié: (2025)
par: Young, Richard J., et autres
Publié: (2025)
Enhancing Traffic Accident Classifications: Application of NLP Methods for City Safety
par: Özeren, Enes, et autres
Publié: (2025)
par: Özeren, Enes, et autres
Publié: (2025)
Refining Packing and Shuffling Strategies for Enhanced Performance in Generative Language Models
par: Chen, Yanbing, et autres
Publié: (2024)
par: Chen, Yanbing, et autres
Publié: (2024)
ASR Error Correction in Low-Resource Burmese with Alignment-Enhanced Transformers using Phonetic Features
par: Lin, Ye Bhone, et autres
Publié: (2025)
par: Lin, Ye Bhone, et autres
Publié: (2025)
Documents similaires
-
FIM-LoRA: Task-Informative Rank Allocation for LoRA via Calibration-Time Gradient-Variance Estimation
par: Sathyavageeswaran, Ramakrishnan
Publié: (2026) -
SpectralLoRA: Is Low-Frequency Structure Sufficient for LoRA Adaptation? A Spectral Analysis of Weight Updates
par: Singh, Rajveer
Publié: (2026) -
Quantization-Robust LLM Unlearning via Low-Rank Adaptation
par: Abitante, João Vitor Boer, et autres
Publié: (2026) -
LoRS: Efficient Low-Rank Adaptation for Sparse Large Language Model
par: Hu, Yuxuan, et autres
Publié: (2025) -
TensLoRA: Tensor Alternatives for Low-Rank Adaptation
par: Marmoret, Axel, et autres
Publié: (2025)