Importance Analysis for Dynamic Control of Balancing Parameter in a Simple Knowledge Distillation Setting
Fuente:
arXiv
Enregistré dans:
| Auteurs principaux: | Kim, Seongmin, Kim, Kwanho, Kim, Minseung, Jo, Kanghyun |
|---|---|
| Format: | Preprint |
| Publié: |
2025
|
| Sujets: | |
| Accès en ligne: | |
| Tags: |
Ajouter un tag
Pas de tags, Soyez le premier à ajouter un tag!
|
Documents similaires
Artificial Behavior Intelligence: Technology, Challenges, and Future Directions
par: Jo, Kanghyun, et autres
Publié: (2025)
par: Jo, Kanghyun, et autres
Publié: (2025)
AMiD: Knowledge Distillation for LLMs with $α$-mixture Assistant Distribution
par: Shin, Donghyeok, et autres
Publié: (2025)
par: Shin, Donghyeok, et autres
Publié: (2025)
PCoreSet: Effective Active Learning through Knowledge Distillation from Vision-Language Models
par: Kang, Seongjae, et autres
Publié: (2025)
par: Kang, Seongjae, et autres
Publié: (2025)
Accuracy of a Large Language Model in Distinguishing Anti- And Pro-vaccination Messages on Social Media: The Case of Human Papillomavirus Vaccination
par: Kim, Soojong, et autres
Publié: (2024)
par: Kim, Soojong, et autres
Publié: (2024)
Efficient Epistemic Uncertainty Estimation for Large Language Models via Knowledge Distillation
par: Park, Seonghyeon, et autres
Publié: (2026)
par: Park, Seonghyeon, et autres
Publié: (2026)
Asymptotic Midpoint Mixup for Margin Balancing and Moderate Broadening
par: Kim, Hoyong, et autres
Publié: (2024)
par: Kim, Hoyong, et autres
Publié: (2024)
Multi-Level Knowledge Distillation and Dynamic Self-Supervised Learning for Continual Learning
par: Kim, Taeheon, et autres
Publié: (2025)
par: Kim, Taeheon, et autres
Publié: (2025)
Entropy Meets Importance: A Unified Head Importance-Entropy Score for Stable and Efficient Transformer Pruning
par: Choi, Minsik, et autres
Publié: (2025)
par: Choi, Minsik, et autres
Publié: (2025)
Measuring Sample Importance in Data Pruning for Language Models based on Information Entropy
par: Kim, Minsang, et autres
Publié: (2024)
par: Kim, Minsang, et autres
Publié: (2024)
Balancing Knowledge Distillation for Imbalance Learning with Bilevel Optimization
par: Nguyen, Anh B. H., et autres
Publié: (2026)
par: Nguyen, Anh B. H., et autres
Publié: (2026)
Adaptive Action Chunking via Multi-Chunk Q Value Estimation
par: Shin, Yongjae, et autres
Publié: (2026)
par: Shin, Yongjae, et autres
Publié: (2026)
Mitigating Long-Tailed Anomaly Score Distributions with Importance-Weighted Loss
par: Lee, Jungi, et autres
Publié: (2026)
par: Lee, Jungi, et autres
Publié: (2026)
Metastable Dynamics of Chain-of-Thought Reasoning: Provable Benefits of Search, RL and Distillation
par: Kim, Juno, et autres
Publié: (2025)
par: Kim, Juno, et autres
Publié: (2025)
SafeDPO: A Simple Approach to Direct Preference Optimization with Enhanced Safety
par: Kim, Geon-Hyeong, et autres
Publié: (2025)
par: Kim, Geon-Hyeong, et autres
Publié: (2025)
Knowledge Distillation from Language-Oriented to Emergent Communication for Multi-Agent Remote Control
par: Kim, Yongjun, et autres
Publié: (2024)
par: Kim, Yongjun, et autres
Publié: (2024)
KD-EKF: Knowledge-Distilled Adaptive Covariance EKF for Robust UWB/PDR Indoor Localization
par: Yoo, Kyeonghyun, et autres
Publié: (2026)
par: Yoo, Kyeonghyun, et autres
Publié: (2026)
Explain in Your Own Words: Improving Reasoning via Token-Selective Dual Knowledge Distillation
par: Kim, Minsang, et autres
Publié: (2026)
par: Kim, Minsang, et autres
Publié: (2026)
CleaR: Towards Robust and Generalized Parameter-Efficient Fine-Tuning for Noisy Label Learning
par: Kim, Yeachan, et autres
Publié: (2024)
par: Kim, Yeachan, et autres
Publié: (2024)
Every Expert Matters: Towards Effective Knowledge Distillation for Mixture-of-Experts Language Models
par: Kim, Gyeongman, et autres
Publié: (2025)
par: Kim, Gyeongman, et autres
Publié: (2025)
The Max-Min Formulation of Multi-Objective Reinforcement Learning: From Theory to a Model-Free Algorithm
par: Park, Giseung, et autres
Publié: (2024)
par: Park, Giseung, et autres
Publié: (2024)
The Role of Teacher Calibration in Knowledge Distillation
par: Kim, Suyoung, et autres
Publié: (2025)
par: Kim, Suyoung, et autres
Publié: (2025)
Random Conditioning with Distillation for Data-Efficient Diffusion Model Compression
par: Kim, Dohyun, et autres
Publié: (2025)
par: Kim, Dohyun, et autres
Publié: (2025)
PromptKD: Distilling Student-Friendly Knowledge for Generative Language Models via Prompt Tuning
par: Kim, Gyeongman, et autres
Publié: (2024)
par: Kim, Gyeongman, et autres
Publié: (2024)
Dynamic Temperature Scheduler for Knowledge Distillation
par: Islam, Sibgat Ul, et autres
Publié: (2025)
par: Islam, Sibgat Ul, et autres
Publié: (2025)
TIP: Token Importance in On-Policy Distillation
par: Xu, Yuanda, et autres
Publié: (2026)
par: Xu, Yuanda, et autres
Publié: (2026)
Parameter Efficient Mamba Tuning via Projector-targeted Diagonal-centric Linear Transformation
par: Ham, Seokil, et autres
Publié: (2024)
par: Ham, Seokil, et autres
Publié: (2024)
Pruning and Distilling Mixture-of-Experts into Dense Language Models
par: Kim, Junhyuck, et autres
Publié: (2026)
par: Kim, Junhyuck, et autres
Publié: (2026)
FIRE: Frobenius-Isometry Reinitialization for Balancing the Stability-Plasticity Tradeoff
par: Han, Isaac, et autres
Publié: (2026)
par: Han, Isaac, et autres
Publié: (2026)
Energy-Efficient Wireless LLM Inference via Uncertainty and Importance-Aware Speculative Decoding
par: Park, Jihoon, et autres
Publié: (2025)
par: Park, Jihoon, et autres
Publié: (2025)
GraLoRA: Granular Low-Rank Adaptation for Parameter-Efficient Fine-Tuning
par: Jung, Yeonjoon, et autres
Publié: (2025)
par: Jung, Yeonjoon, et autres
Publié: (2025)
Dynamic Mixture of Experts Against Severe Distribution Shifts
par: Kim, Donghu
Publié: (2025)
par: Kim, Donghu
Publié: (2025)
Distilling Reinforcement Learning Algorithms for In-Context Model-Based Planning
par: Son, Jaehyeon, et autres
Publié: (2025)
par: Son, Jaehyeon, et autres
Publié: (2025)
Diffusion-Assisted Distillation for Self-Supervised Graph Representation Learning with MLPs
par: Ahn, Seong Jin, et autres
Publié: (2025)
par: Ahn, Seong Jin, et autres
Publié: (2025)
Geometry-Aware Attention Guidance for Diffusion Models via Modern Hopfield Dynamics
par: Kim, Kwanyoung
Publié: (2026)
par: Kim, Kwanyoung
Publié: (2026)
Prism: Spectral Parameter Sharing for Multi-Agent Reinforcement Learning
par: Kim, Kyungbeom, et autres
Publié: (2026)
par: Kim, Kyungbeom, et autres
Publié: (2026)
Analysis of Fourier Neural Operators via Effective Field Theory
par: Kim, Taeyoung
Publié: (2025)
par: Kim, Taeyoung
Publié: (2025)
On-Device Continual Learning with Dual-Stage Buffer and Dynamic Loss for Point-of-Care Pneumonia Diagnosis
par: Kim, Danu
Publié: (2026)
par: Kim, Danu
Publié: (2026)
FedMTFI: Feature Importance Based Optimized Multi Teacher Knowledge Distillation in Heterogeneous Federated Learning Environment
par: Shadin, Nazmus Shakib, et autres
Publié: (2026)
par: Shadin, Nazmus Shakib, et autres
Publié: (2026)
SAMOSA: Sharpness Aware Minimization for Open Set Active learning
par: Kim, Young In, et autres
Publié: (2025)
par: Kim, Young In, et autres
Publié: (2025)
Latent Behavior Diffusion for Sequential Reaction Generation in Dyadic Setting
par: Nguyen, Minh-Duc, et autres
Publié: (2025)
par: Nguyen, Minh-Duc, et autres
Publié: (2025)
Documents similaires
-
Artificial Behavior Intelligence: Technology, Challenges, and Future Directions
par: Jo, Kanghyun, et autres
Publié: (2025) -
AMiD: Knowledge Distillation for LLMs with $α$-mixture Assistant Distribution
par: Shin, Donghyeok, et autres
Publié: (2025) -
PCoreSet: Effective Active Learning through Knowledge Distillation from Vision-Language Models
par: Kang, Seongjae, et autres
Publié: (2025) -
Accuracy of a Large Language Model in Distinguishing Anti- And Pro-vaccination Messages on Social Media: The Case of Human Papillomavirus Vaccination
par: Kim, Soojong, et autres
Publié: (2024) -
Efficient Epistemic Uncertainty Estimation for Large Language Models via Knowledge Distillation
par: Park, Seonghyeon, et autres
Publié: (2026)