Can Large Models Teach Student Models to Solve Mathematical Problems Like Human Beings? A Reasoning Distillation Method via Multi-LoRA Interaction
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Li, Xinhe, Liu, Jiajun, Wang, Peng |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
LoRA-Gen: Specializing Large Language Model via Online LoRA Generation
par: Xiao, Yicheng, et autres
Publié: (2025)
par: Xiao, Yicheng, et autres
Publié: (2025)
LoRA-Flow: Dynamic LoRA Fusion for Large Language Models in Generative Tasks
par: Wang, Hanqing, et autres
Publié: (2024)
par: Wang, Hanqing, et autres
Publié: (2024)
Tina: Tiny Reasoning Models via LoRA
par: Wang, Shangshang, et autres
Publié: (2025)
par: Wang, Shangshang, et autres
Publié: (2025)
Routing Distilled Knowledge via Mixture of LoRA Experts for Large Language Model based Bundle Generation
par: Feng, Kaidong, et autres
Publié: (2025)
par: Feng, Kaidong, et autres
Publié: (2025)
DR-LoRA: Dynamic Rank LoRA for Fine-Tuning Mixture-of-Experts Models
par: Deng, Guanzhi, et autres
Publié: (2026)
par: Deng, Guanzhi, et autres
Publié: (2026)
KD-LoRA: A Hybrid Approach to Efficient Fine-Tuning with LoRA and Knowledge Distillation
par: Azimi, Rambod, et autres
Publié: (2024)
par: Azimi, Rambod, et autres
Publié: (2024)
A Survey on LoRA of Large Language Models
par: Mao, Yuren, et autres
Publié: (2024)
par: Mao, Yuren, et autres
Publié: (2024)
Dual LoRA: Enhancing LoRA with Magnitude and Direction Updates
par: Xu, Yixing, et autres
Publié: (2025)
par: Xu, Yixing, et autres
Publié: (2025)
LoRA-Drop: Temporal LoRA Decoding for Efficient LLM Inference
par: Rajabzadeh, Hossein, et autres
Publié: (2026)
par: Rajabzadeh, Hossein, et autres
Publié: (2026)
CA-LoRA: Adapting Existing LoRA for Compressed LLMs to Enable Efficient Multi-Tasking on Personal Devices
par: Zhao, Weilin, et autres
Publié: (2023)
par: Zhao, Weilin, et autres
Publié: (2023)
DLP-LoRA: Efficient Task-Specific LoRA Fusion with a Dynamic, Lightweight Plugin for Large Language Models
par: Zhang, Yuxuan, et autres
Publié: (2024)
par: Zhang, Yuxuan, et autres
Publié: (2024)
MeTA-LoRA: Data-Efficient Multi-Task Fine-Tuning for Large Language Models
par: Cheng, Bo, et autres
Publié: (2025)
par: Cheng, Bo, et autres
Publié: (2025)
MeteoRA: Multiple-tasks Embedded LoRA for Large Language Models
par: Xu, Jingwei, et autres
Publié: (2024)
par: Xu, Jingwei, et autres
Publié: (2024)
LoRA+: Efficient Low Rank Adaptation of Large Models
par: Hayou, Soufiane, et autres
Publié: (2024)
par: Hayou, Soufiane, et autres
Publié: (2024)
LoRA-Leak: Membership Inference Attacks Against LoRA Fine-tuned Language Models
par: Ran, Delong, et autres
Publié: (2025)
par: Ran, Delong, et autres
Publié: (2025)
Personalized LoRA for Human-Centered Text Understanding
par: Zhang, You, et autres
Publié: (2024)
par: Zhang, You, et autres
Publié: (2024)
MixLoRA: Enhancing Large Language Models Fine-Tuning with LoRA-based Mixture of Experts
par: Li, Dengchun, et autres
Publié: (2024)
par: Li, Dengchun, et autres
Publié: (2024)
Vision as LoRA
par: Wang, Han, et autres
Publié: (2025)
par: Wang, Han, et autres
Publié: (2025)
$D^2LoRA$: Data-Driven LoRA Initialization for Low Resource Tasks
par: SeraJ, Javad, et autres
Publié: (2025)
par: SeraJ, Javad, et autres
Publié: (2025)
LoRA on the Go: Instance-level Dynamic LoRA Selection and Merging
par: Lee, Seungeon, et autres
Publié: (2025)
par: Lee, Seungeon, et autres
Publié: (2025)
LoRA-drop: Efficient LoRA Parameter Pruning based on Output Evaluation
par: Zhou, Hongyun, et autres
Publié: (2024)
par: Zhou, Hongyun, et autres
Publié: (2024)
LoRA$^2$ : Multi-Scale Low-Rank Approximations for Fine-Tuning Large Language Models
par: Zhang, Jia-Chen, et autres
Publié: (2024)
par: Zhang, Jia-Chen, et autres
Publié: (2024)
LoRASuite: Efficient LoRA Adaptation Across Large Language Model Upgrades
par: Li, Yanan, et autres
Publié: (2025)
par: Li, Yanan, et autres
Publié: (2025)
PLoP: Precise LoRA Placement for Efficient Finetuning of Large Models
par: Hayou, Soufiane, et autres
Publié: (2025)
par: Hayou, Soufiane, et autres
Publié: (2025)
Make LoRA Great Again: Boosting LoRA with Adaptive Singular Values and Mixture-of-Experts Optimization Alignment
par: Fan, Chenghao, et autres
Publié: (2025)
par: Fan, Chenghao, et autres
Publié: (2025)
AFA-LoRA: Enabling Non-Linear Adaptations in LoRA with Activation Function Annealing
par: Li, Jiacheng, et autres
Publié: (2025)
par: Li, Jiacheng, et autres
Publié: (2025)
LoRA-Squeeze: Simple and Effective Post-Tuning and In-Tuning Compression of LoRA Modules
par: Vulić, Ivan, et autres
Publié: (2026)
par: Vulić, Ivan, et autres
Publié: (2026)
Assertion Detection Large Language Model In-context Learning LoRA Fine-tuning
par: Ji, Yuelyu, et autres
Publié: (2024)
par: Ji, Yuelyu, et autres
Publié: (2024)
LoRA Done RITE: Robust Invariant Transformation Equilibration for LoRA Optimization
par: Yen, Jui-Nan, et autres
Publié: (2024)
par: Yen, Jui-Nan, et autres
Publié: (2024)
Model Fusion with Multi-LoRA Inference for Tool-Enhanced Game Dialogue Agents
par: Wang, Kangxu, et autres
Publié: (2025)
par: Wang, Kangxu, et autres
Publié: (2025)
Mixture of LoRA Experts
par: Wu, Xun, et autres
Publié: (2024)
par: Wu, Xun, et autres
Publié: (2024)
Teaching LLMs According to Their Aptitude: Adaptive Reasoning for Mathematical Problem Solving
par: Xu, Xin, et autres
Publié: (2025)
par: Xu, Xin, et autres
Publié: (2025)
Fusian: Multi-LoRA Fusion for Fine-Grained Continuous MBTI Personality Control in Large Language Models
par: Chen, Zehao, et autres
Publié: (2026)
par: Chen, Zehao, et autres
Publié: (2026)
Budgeted LoRA: Distillation as Structured Compute Allocation for Efficient Inference
par: Sabry, Mohammed, et autres
Publié: (2026)
par: Sabry, Mohammed, et autres
Publié: (2026)
ToRA: A Tool-Integrated Reasoning Agent for Mathematical Problem Solving
par: Gou, Zhibin, et autres
Publié: (2023)
par: Gou, Zhibin, et autres
Publié: (2023)
A Note on LoRA
par: Fomenko, Vlad, et autres
Publié: (2024)
par: Fomenko, Vlad, et autres
Publié: (2024)
PeriodicLoRA: Breaking the Low-Rank Bottleneck in LoRA Optimization
par: Meng, Xiangdi, et autres
Publié: (2024)
par: Meng, Xiangdi, et autres
Publié: (2024)
Higher Layers Need More LoRA Experts
par: Gao, Chongyang, et autres
Publié: (2024)
par: Gao, Chongyang, et autres
Publié: (2024)
FIM-LoRA: Task-Informative Rank Allocation for LoRA via Calibration-Time Gradient-Variance Estimation
par: Sathyavageeswaran, Ramakrishnan
Publié: (2026)
par: Sathyavageeswaran, Ramakrishnan
Publié: (2026)
LoRA Soups: Merging LoRAs for Practical Skill Composition Tasks
par: Prabhakar, Akshara, et autres
Publié: (2024)
par: Prabhakar, Akshara, et autres
Publié: (2024)
Documents similaires
-
LoRA-Gen: Specializing Large Language Model via Online LoRA Generation
par: Xiao, Yicheng, et autres
Publié: (2025) -
LoRA-Flow: Dynamic LoRA Fusion for Large Language Models in Generative Tasks
par: Wang, Hanqing, et autres
Publié: (2024) -
Tina: Tiny Reasoning Models via LoRA
par: Wang, Shangshang, et autres
Publié: (2025) -
Routing Distilled Knowledge via Mixture of LoRA Experts for Large Language Model based Bundle Generation
par: Feng, Kaidong, et autres
Publié: (2025) -
DR-LoRA: Dynamic Rank LoRA for Fine-Tuning Mixture-of-Experts Models
par: Deng, Guanzhi, et autres
Publié: (2026)