Curriculum Learning-Guided Progressive Distillation in Large Language Models
Fuente:
arXiv
Guardado en:
| Autores principales: | Cao, Jincheng, Zeng, Fanzhi, Liu, Leqi, Mokhtari, Aryan |
|---|---|
| Formato: | Preprint |
| Publicado: |
2026
|
| Materias: | |
| Acceso en línea: | |
| Etiquetas: |
Agregar Etiqueta
Sin Etiquetas, Sea el primero en etiquetar este registro!
|
Ejemplares similares
CARE-RFT: Confidence-Anchored Reinforcement Finetuning for Reliable Reasoning in Large Language Models
por: Li, Shuozhe, et al.
Publicado: (2026)
por: Li, Shuozhe, et al.
Publicado: (2026)
Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models
por: Bello, Femi, et al.
Publicado: (2025)
por: Bello, Femi, et al.
Publicado: (2025)
Being Strong Progressively! Enhancing Knowledge Distillation of Large Language Models through a Curriculum Learning Framework
por: Liu, Lingyuan, et al.
Publicado: (2025)
por: Liu, Lingyuan, et al.
Publicado: (2025)
Collaborative Adaptive Curriculum for Progressive Knowledge Distillation
por: Liu, Jing, et al.
Publicado: (2026)
por: Liu, Jing, et al.
Publicado: (2026)
Machine Unlearning under Overparameterization
por: Block, Jacob L., et al.
Publicado: (2025)
por: Block, Jacob L., et al.
Publicado: (2025)
Large Language Model Guided Knowledge Distillation for Time Series Anomaly Detection
por: Liu, Chen, et al.
Publicado: (2024)
por: Liu, Chen, et al.
Publicado: (2024)
GDSD: Reinforcement Learning as Guided Denoiser Self-Distillation for Diffusion Language Models
por: Tang, Xiaohang, et al.
Publicado: (2026)
por: Tang, Xiaohang, et al.
Publicado: (2026)
In-Context Learning with Transformers: Softmax Attention Adapts to Function Lipschitzness
por: Collins, Liam, et al.
Publicado: (2024)
por: Collins, Liam, et al.
Publicado: (2024)
Prompting Fairness: Integrating Causality to Debias Large Language Models
por: Li, Jingling, et al.
Publicado: (2024)
por: Li, Jingling, et al.
Publicado: (2024)
Delta Knowledge Distillation for Large Language Models
por: Cao, Yihan, et al.
Publicado: (2025)
por: Cao, Yihan, et al.
Publicado: (2025)
Large Language Models Explore by Latent Distilling
por: Zeng, Yuanhao, et al.
Publicado: (2026)
por: Zeng, Yuanhao, et al.
Publicado: (2026)
A Common Pitfall of Margin-based Language Model Alignment: Gradient Entanglement
por: Yuan, Hui, et al.
Publicado: (2024)
por: Yuan, Hui, et al.
Publicado: (2024)
Internalizing Meta-Experience into Memory for Guided Reinforcement Learning in Large Language Models
por: Huang, Shiting, et al.
Publicado: (2026)
por: Huang, Shiting, et al.
Publicado: (2026)
Personalized Language Modeling from Personalized Human Feedback
por: Li, Xinyu, et al.
Publicado: (2024)
por: Li, Xinyu, et al.
Publicado: (2024)
Curriculum Guided Personalized Subgraph Federated Learning
por: Kang, Minku, et al.
Publicado: (2025)
por: Kang, Minku, et al.
Publicado: (2025)
QOG:Question and Options Generation based on Language Model
por: Zhou, Jincheng
Publicado: (2024)
por: Zhou, Jincheng
Publicado: (2024)
Large Language Models aren't all that you need
por: Holla, Kiran Voderhobli, et al.
Publicado: (2024)
por: Holla, Kiran Voderhobli, et al.
Publicado: (2024)
Learning Robust Reasoning through Guided Adversarial Self-Play
por: Li, Shuozhe, et al.
Publicado: (2026)
por: Li, Shuozhe, et al.
Publicado: (2026)
Curriculum Learning for Efficient Chain-of-Thought Distillation via Structure-Aware Masking and GRPO
por: Yu, Bowen, et al.
Publicado: (2026)
por: Yu, Bowen, et al.
Publicado: (2026)
Rethinking the Role of Temperature in Large Language Model Distillation
por: Luong, Hoang-Chau, et al.
Publicado: (2026)
por: Luong, Hoang-Chau, et al.
Publicado: (2026)
Sculpting Latent Spaces With MMD: Disentanglement With Programmable Priors
por: Fruytier, Quentin, et al.
Publicado: (2025)
por: Fruytier, Quentin, et al.
Publicado: (2025)
SPaCe: Unlocking Sample-Efficient Large Language Models Training With Self-Pace Curriculum Learning
por: Do, Dai, et al.
Publicado: (2025)
por: Do, Dai, et al.
Publicado: (2025)
Training Large Language Models for Reasoning through Reverse Curriculum Reinforcement Learning
por: Xi, Zhiheng, et al.
Publicado: (2024)
por: Xi, Zhiheng, et al.
Publicado: (2024)
Learning Progress Driven Multi-Agent Curriculum
por: Zhao, Wenshuai, et al.
Publicado: (2022)
por: Zhao, Wenshuai, et al.
Publicado: (2022)
Large Language Model Distilling Medication Recommendation Model
por: Liu, Qidong, et al.
Publicado: (2024)
por: Liu, Qidong, et al.
Publicado: (2024)
Distillation of Large Language Models via Concrete Score Matching
por: Kim, Yeongmin, et al.
Publicado: (2025)
por: Kim, Yeongmin, et al.
Publicado: (2025)
Eurekaverse: Environment Curriculum Generation via Large Language Models
por: Liang, William, et al.
Publicado: (2024)
por: Liang, William, et al.
Publicado: (2024)
Structured Agent Distillation for Large Language Model
por: Liu, Jun, et al.
Publicado: (2025)
por: Liu, Jun, et al.
Publicado: (2025)
Overcoming Uncertain Incompleteness for Robust Multimodal Sequential Diagnosis Prediction via Curriculum Data Erasing Guided Knowledge Distillation
por: Koo, Heejoon
Publicado: (2024)
por: Koo, Heejoon
Publicado: (2024)
ChessArena: A Chess Testbed for Evaluating Strategic Reasoning Capabilities of Large Language Models
por: Liu, Jincheng, et al.
Publicado: (2025)
por: Liu, Jincheng, et al.
Publicado: (2025)
Offline Model-Based Optimization via Policy-Guided Gradient Search
por: Chemingui, Yassine, et al.
Publicado: (2024)
por: Chemingui, Yassine, et al.
Publicado: (2024)
On Predictability of Reinforcement Learning Dynamics for Large Language Models
por: Cai, Yuchen, et al.
Publicado: (2025)
por: Cai, Yuchen, et al.
Publicado: (2025)
An Interpretable and Scalable Framework for Evaluating Large Language Models
por: Qu, Xinhao, et al.
Publicado: (2026)
por: Qu, Xinhao, et al.
Publicado: (2026)
Provable Training Data Identification for Large Language Models
por: Liu, Zhenlong, et al.
Publicado: (2025)
por: Liu, Zhenlong, et al.
Publicado: (2025)
LCD: Advancing Extreme Low-Bit Clustering for Large Language Models via Knowledge Distillation
por: Liu, Fangxin, et al.
Publicado: (2025)
por: Liu, Fangxin, et al.
Publicado: (2025)
Curriculum Learning for Small Code Language Models
por: Naïr, Marwa, et al.
Publicado: (2024)
por: Naïr, Marwa, et al.
Publicado: (2024)
LBLLM: Lightweight Binarization of Large Language Models via Three-Stage Distillation
por: Song, Siqing, et al.
Publicado: (2026)
por: Song, Siqing, et al.
Publicado: (2026)
Efficient Epistemic Uncertainty Estimation for Large Language Models via Knowledge Distillation
por: Park, Seonghyeon, et al.
Publicado: (2026)
por: Park, Seonghyeon, et al.
Publicado: (2026)
Diversity-Aware Reverse Kullback-Leibler Divergence for Large Language Model Distillation
por: Luong, Hoang-Chau, et al.
Publicado: (2026)
por: Luong, Hoang-Chau, et al.
Publicado: (2026)
Lillama: Large Language Models Compression via Low-Rank Feature Distillation
por: Sy, Yaya, et al.
Publicado: (2024)
por: Sy, Yaya, et al.
Publicado: (2024)
Ejemplares similares
-
CARE-RFT: Confidence-Anchored Reinforcement Finetuning for Reliable Reasoning in Large Language Models
por: Li, Shuozhe, et al.
Publicado: (2026) -
Linear Representation Transferability Hypothesis: Leveraging Small Models to Steer Large Models
por: Bello, Femi, et al.
Publicado: (2025) -
Being Strong Progressively! Enhancing Knowledge Distillation of Large Language Models through a Curriculum Learning Framework
por: Liu, Lingyuan, et al.
Publicado: (2025) -
Collaborative Adaptive Curriculum for Progressive Knowledge Distillation
por: Liu, Jing, et al.
Publicado: (2026) -
Machine Unlearning under Overparameterization
por: Block, Jacob L., et al.
Publicado: (2025)