Salvato in:
| Autori principali: | Takrouri, Mohannad, Cuadrado, Nicolás M., Takáč, Martin |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2025
|
| Soggetti: | |
| Accesso online: | https://arxiv.org/abs/2502.03034 |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Tractable Probabilistic Models for Investment Planning
di: A., Nicolas M. Cuadrado, et al.
Pubblicazione: (2025)
di: A., Nicolas M. Cuadrado, et al.
Pubblicazione: (2025)
Delta Knowledge Distillation for Large Language Models
di: Cao, Yihan, et al.
Pubblicazione: (2025)
di: Cao, Yihan, et al.
Pubblicazione: (2025)
A Survey on Symbolic Knowledge Distillation of Large Language Models
di: Acharya, Kamal, et al.
Pubblicazione: (2024)
di: Acharya, Kamal, et al.
Pubblicazione: (2024)
Enhancing BERT Fine-Tuning for Sentiment Analysis in Lower-Resourced Languages
di: Kubík, Jozef, et al.
Pubblicazione: (2025)
di: Kubík, Jozef, et al.
Pubblicazione: (2025)
Feature Alignment and Representation Transfer in Knowledge Distillation for Large Language Models
di: Yang, Junjie, et al.
Pubblicazione: (2025)
di: Yang, Junjie, et al.
Pubblicazione: (2025)
Knowledge Distillation and Dataset Distillation of Large Language Models: Emerging Trends, Challenges, and Future Directions
di: Fang, Luyang, et al.
Pubblicazione: (2025)
di: Fang, Luyang, et al.
Pubblicazione: (2025)
FRESCO: Federated Reinforcement Energy System for Cooperative Optimization
di: Cuadrado, Nicolas Mauricio, et al.
Pubblicazione: (2024)
di: Cuadrado, Nicolas Mauricio, et al.
Pubblicazione: (2024)
LLM-NEO: Parameter Efficient Knowledge Distillation for Large Language Models
di: Yang, Runming, et al.
Pubblicazione: (2024)
di: Yang, Runming, et al.
Pubblicazione: (2024)
Multistage Collaborative Knowledge Distillation from a Large Language Model for Semi-Supervised Sequence Generation
di: Zhao, Jiachen, et al.
Pubblicazione: (2023)
di: Zhao, Jiachen, et al.
Pubblicazione: (2023)
Self-Distilled Reasoner: On-Policy Self-Distillation for Large Language Models
di: Zhao, Siyan, et al.
Pubblicazione: (2026)
di: Zhao, Siyan, et al.
Pubblicazione: (2026)
Language Model Knowledge Distillation for Efficient Question Answering in Spanish
di: Bazaga, Adrián, et al.
Pubblicazione: (2023)
di: Bazaga, Adrián, et al.
Pubblicazione: (2023)
A Dual-Space Framework for General Knowledge Distillation of Large Language Models
di: Zhang, Xue, et al.
Pubblicazione: (2025)
di: Zhang, Xue, et al.
Pubblicazione: (2025)
Personalized Collaborative Fine-Tuning for On-Device Large Language Models
di: Wagner, Nicolas, et al.
Pubblicazione: (2024)
di: Wagner, Nicolas, et al.
Pubblicazione: (2024)
Demystifying Low-Rank Knowledge Distillation in Large Language Models: Convergence, Generalization, and Information-Theoretic Guarantees
di: Soarez, Alberlucia Rafael, et al.
Pubblicazione: (2026)
di: Soarez, Alberlucia Rafael, et al.
Pubblicazione: (2026)
A Survey of On-Policy Distillation for Large Language Models
di: Song, Mingyang, et al.
Pubblicazione: (2026)
di: Song, Mingyang, et al.
Pubblicazione: (2026)
Adversarial Moment-Matching Distillation of Large Language Models
di: Jia, Chen
Pubblicazione: (2024)
di: Jia, Chen
Pubblicazione: (2024)
KDFlow: A User-Friendly and Efficient Knowledge Distillation Framework for Large Language Models
di: Zhang, Songming, et al.
Pubblicazione: (2026)
di: Zhang, Songming, et al.
Pubblicazione: (2026)
Compact Language Models via Pruning and Knowledge Distillation
di: Muralidharan, Saurav, et al.
Pubblicazione: (2024)
di: Muralidharan, Saurav, et al.
Pubblicazione: (2024)
MLKD-BERT: Multi-level Knowledge Distillation for Pre-trained Language Models
di: Zhang, Ying, et al.
Pubblicazione: (2024)
di: Zhang, Ying, et al.
Pubblicazione: (2024)
Cache & Distil: Optimising API Calls to Large Language Models
di: Ramírez, Guillem, et al.
Pubblicazione: (2023)
di: Ramírez, Guillem, et al.
Pubblicazione: (2023)
Distilling Large Language Models for Text-Attributed Graph Learning
di: Pan, Bo, et al.
Pubblicazione: (2024)
di: Pan, Bo, et al.
Pubblicazione: (2024)
Structured Agent Distillation for Large Language Model
di: Liu, Jun, et al.
Pubblicazione: (2025)
di: Liu, Jun, et al.
Pubblicazione: (2025)
Large Language Models Explore by Latent Distilling
di: Zeng, Yuanhao, et al.
Pubblicazione: (2026)
di: Zeng, Yuanhao, et al.
Pubblicazione: (2026)
Generalising Battery Control in Net-Zero Buildings via Personalised Federated RL
di: Avila, Nicolas M Cuadrado, et al.
Pubblicazione: (2024)
di: Avila, Nicolas M Cuadrado, et al.
Pubblicazione: (2024)
Iterative Layer-wise Distillation for Efficient Compression of Large Language Models
di: Kovalev, Grigory, et al.
Pubblicazione: (2025)
di: Kovalev, Grigory, et al.
Pubblicazione: (2025)
Self-Data Distillation for Recovering Quality in Pruned Large Language Models
di: Thangarasa, Vithursan, et al.
Pubblicazione: (2024)
di: Thangarasa, Vithursan, et al.
Pubblicazione: (2024)
SODA: Semi On-Policy Black-Box Distillation for Large Language Models
di: Chen, Xiwen, et al.
Pubblicazione: (2026)
di: Chen, Xiwen, et al.
Pubblicazione: (2026)
Neuron-Level Knowledge Attribution in Large Language Models
di: Yu, Zeping, et al.
Pubblicazione: (2023)
di: Yu, Zeping, et al.
Pubblicazione: (2023)
metabench -- A Sparse Benchmark of Reasoning and Knowledge in Large Language Models
di: Kipnis, Alex, et al.
Pubblicazione: (2024)
di: Kipnis, Alex, et al.
Pubblicazione: (2024)
UniDetox: Universal Detoxification of Large Language Models via Dataset Distillation
di: Lu, Huimin, et al.
Pubblicazione: (2025)
di: Lu, Huimin, et al.
Pubblicazione: (2025)
GeoLLM: Extracting Geospatial Knowledge from Large Language Models
di: Manvi, Rohin, et al.
Pubblicazione: (2023)
di: Manvi, Rohin, et al.
Pubblicazione: (2023)
Being Strong Progressively! Enhancing Knowledge Distillation of Large Language Models through a Curriculum Learning Framework
di: Liu, Lingyuan, et al.
Pubblicazione: (2025)
di: Liu, Lingyuan, et al.
Pubblicazione: (2025)
Oh! We Freeze: Improving Quantized Knowledge Distillation via Signal Propagation Analysis for Large Language Models
di: Bhardwaj, Kartikeya, et al.
Pubblicazione: (2024)
di: Bhardwaj, Kartikeya, et al.
Pubblicazione: (2024)
Self-Calibrating Language Models via Test-Time Discriminative Distillation
di: Hedna, Mohamed Rissal, et al.
Pubblicazione: (2026)
di: Hedna, Mohamed Rissal, et al.
Pubblicazione: (2026)
Relative Value Biases in Large Language Models
di: Hayes, William M., et al.
Pubblicazione: (2024)
di: Hayes, William M., et al.
Pubblicazione: (2024)
Large Language Models are Biased Reinforcement Learners
di: Hayes, William M., et al.
Pubblicazione: (2024)
di: Hayes, William M., et al.
Pubblicazione: (2024)
Testing Uncertainty of Large Language Models for Physics Knowledge and Reasoning
di: Reganova, Elizaveta, et al.
Pubblicazione: (2024)
di: Reganova, Elizaveta, et al.
Pubblicazione: (2024)
Crosslingual Capabilities and Knowledge Barriers in Multilingual Large Language Models
di: Chua, Lynn, et al.
Pubblicazione: (2024)
di: Chua, Lynn, et al.
Pubblicazione: (2024)
Procedural Knowledge in Pretraining Drives Reasoning in Large Language Models
di: Ruis, Laura, et al.
Pubblicazione: (2024)
di: Ruis, Laura, et al.
Pubblicazione: (2024)
Large Language Models Lack Temporal Awareness of Medical Knowledge
di: Guan, Zihan, et al.
Pubblicazione: (2026)
di: Guan, Zihan, et al.
Pubblicazione: (2026)
Documenti analoghi
-
Tractable Probabilistic Models for Investment Planning
di: A., Nicolas M. Cuadrado, et al.
Pubblicazione: (2025) -
Delta Knowledge Distillation for Large Language Models
di: Cao, Yihan, et al.
Pubblicazione: (2025) -
A Survey on Symbolic Knowledge Distillation of Large Language Models
di: Acharya, Kamal, et al.
Pubblicazione: (2024) -
Enhancing BERT Fine-Tuning for Sentiment Analysis in Lower-Resourced Languages
di: Kubík, Jozef, et al.
Pubblicazione: (2025) -
Feature Alignment and Representation Transfer in Knowledge Distillation for Large Language Models
di: Yang, Junjie, et al.
Pubblicazione: (2025)