Feature Structure Distillation with Centered Kernel Alignment in BERT Transferring
Fuente:
arXiv
Salvato in:
| Autori principali: | Jung, Hee-Jun, Kim, Doyeon, Na, Seung-Hoon, Kim, Kangil |
|---|---|
| Natura: | Preprint |
| Pubblicazione: |
2022
|
| Soggetti: | |
| Accesso online: | |
| Tags: |
Aggiungi Tag
Nessun Tag, puoi essere il primo ad aggiungerne!!
|
Documenti analoghi
Multiple Invertible and Partial-Equivariant Function for Latent Vector Transformation to Enhance Disentanglement in VAEs
di: Jung, Hee-Jun, et al.
Pubblicazione: (2025)
di: Jung, Hee-Jun, et al.
Pubblicazione: (2025)
CFASL: Composite Factor-Aligned Symmetry Learning for Disentanglement in Variational AutoEncoder
di: Jung, Hee-Jun, et al.
Pubblicazione: (2024)
di: Jung, Hee-Jun, et al.
Pubblicazione: (2024)
Explain in Your Own Words: Improving Reasoning via Token-Selective Dual Knowledge Distillation
di: Kim, Minsang, et al.
Pubblicazione: (2026)
di: Kim, Minsang, et al.
Pubblicazione: (2026)
Reasoning Distillation and Structural Alignment for Improved Code Generation
di: Jalilifard, Amir, et al.
Pubblicazione: (2025)
di: Jalilifard, Amir, et al.
Pubblicazione: (2025)
PSYCHE: A Multi-faceted Patient Simulation Framework for Evaluation of Psychiatric Assessment Conversational Agents
di: Lee, Jingoo, et al.
Pubblicazione: (2025)
di: Lee, Jingoo, et al.
Pubblicazione: (2025)
QUICK: Quantization-aware Interleaving and Conflict-free Kernel for efficient LLM inference
di: Kim, Taesu, et al.
Pubblicazione: (2024)
di: Kim, Taesu, et al.
Pubblicazione: (2024)
Safety Alignment Can Be Not Superficial With Explicit Safety Signals
di: Li, Jianwei, et al.
Pubblicazione: (2025)
di: Li, Jianwei, et al.
Pubblicazione: (2025)
Pruning and Distilling Mixture-of-Experts into Dense Language Models
di: Kim, Junhyuck, et al.
Pubblicazione: (2026)
di: Kim, Junhyuck, et al.
Pubblicazione: (2026)
Superficial Safety Alignment Hypothesis
di: Li, Jianwei, et al.
Pubblicazione: (2024)
di: Li, Jianwei, et al.
Pubblicazione: (2024)
Spread Preference Annotation: Direct Preference Judgment for Efficient LLM Alignment
di: Kim, Dongyoung, et al.
Pubblicazione: (2024)
di: Kim, Dongyoung, et al.
Pubblicazione: (2024)
RSCF: Relation-Semantics Consistent Filter for Entity Embedding of Knowledge Graph
di: Kim, Junsik, et al.
Pubblicazione: (2025)
di: Kim, Junsik, et al.
Pubblicazione: (2025)
AlignDistil: Token-Level Language Model Alignment as Adaptive Policy Distillation
di: Zhang, Songming, et al.
Pubblicazione: (2025)
di: Zhang, Songming, et al.
Pubblicazione: (2025)
Multilingual Safety Alignment via Self-Distillation
di: Qin, Ruiyang, et al.
Pubblicazione: (2026)
di: Qin, Ruiyang, et al.
Pubblicazione: (2026)
Evolutionary Contrastive Distillation for Language Model Alignment
di: Katz-Samuels, Julian, et al.
Pubblicazione: (2024)
di: Katz-Samuels, Julian, et al.
Pubblicazione: (2024)
Rethinking the Role of Proxy Rewards in Language Model Alignment
di: Kim, Sungdong, et al.
Pubblicazione: (2024)
di: Kim, Sungdong, et al.
Pubblicazione: (2024)
Obliviate: Neutralizing Task-agnostic Backdoors within the Parameter-efficient Fine-tuning Paradigm
di: Kim, Jaehan, et al.
Pubblicazione: (2024)
di: Kim, Jaehan, et al.
Pubblicazione: (2024)
Revisiting Softmax Masking: Stop Gradient for Enhancing Stability in Replay-based Continual Learning
di: Kim, Hoyong, et al.
Pubblicazione: (2023)
di: Kim, Hoyong, et al.
Pubblicazione: (2023)
Asymptotic Midpoint Mixup for Margin Balancing and Moderate Broadening
di: Kim, Hoyong, et al.
Pubblicazione: (2024)
di: Kim, Hoyong, et al.
Pubblicazione: (2024)
Structured Agent Distillation for Large Language Model
di: Liu, Jun, et al.
Pubblicazione: (2025)
di: Liu, Jun, et al.
Pubblicazione: (2025)
Every Expert Matters: Towards Effective Knowledge Distillation for Mixture-of-Experts Language Models
di: Kim, Gyeongman, et al.
Pubblicazione: (2025)
di: Kim, Gyeongman, et al.
Pubblicazione: (2025)
MedicalBERT: enhancing biomedical natural language processing using pretrained BERT-based model
di: Reddy, K. Sahit, et al.
Pubblicazione: (2025)
di: Reddy, K. Sahit, et al.
Pubblicazione: (2025)
PromptKD: Distilling Student-Friendly Knowledge for Generative Language Models via Prompt Tuning
di: Kim, Gyeongman, et al.
Pubblicazione: (2024)
di: Kim, Gyeongman, et al.
Pubblicazione: (2024)
DistiLLM: Towards Streamlined Distillation for Large Language Models
di: Ko, Jongwoo, et al.
Pubblicazione: (2024)
di: Ko, Jongwoo, et al.
Pubblicazione: (2024)
Sparse Autoencoder Features for Classifications and Transferability
di: Gallifant, Jack, et al.
Pubblicazione: (2025)
di: Gallifant, Jack, et al.
Pubblicazione: (2025)
TLPO: Token-Level Policy Optimization for Mitigating Language Confusion in Large Language Models
di: Choo, Jinho, et al.
Pubblicazione: (2026)
di: Choo, Jinho, et al.
Pubblicazione: (2026)
DRAG: Distilling RAG for SLMs from LLMs to Transfer Knowledge and Mitigate Hallucination via Evidence and Graph-based Distillation
di: Chen, Jennifer, et al.
Pubblicazione: (2025)
di: Chen, Jennifer, et al.
Pubblicazione: (2025)
Value Augmented Sampling for Language Model Alignment and Personalization
di: Han, Seungwook, et al.
Pubblicazione: (2024)
di: Han, Seungwook, et al.
Pubblicazione: (2024)
Align to Structure: Aligning Large Language Models with Structural Information
di: Kim, Zae Myung, et al.
Pubblicazione: (2025)
di: Kim, Zae Myung, et al.
Pubblicazione: (2025)
ReflAct: World-Grounded Decision Making in LLM Agents via Goal-State Reflection
di: Kim, Jeonghye, et al.
Pubblicazione: (2025)
di: Kim, Jeonghye, et al.
Pubblicazione: (2025)
Atlas-Alignment: Making Interpretability Transferable Across Language Models
di: Puri, Bruno, et al.
Pubblicazione: (2025)
di: Puri, Bruno, et al.
Pubblicazione: (2025)
Patent Language Model Pretraining with ModernBERT
di: Yousefiramandi, Amirhossein, et al.
Pubblicazione: (2025)
di: Yousefiramandi, Amirhossein, et al.
Pubblicazione: (2025)
BERT-LSH: Reducing Absolute Compute For Attention
di: Li, Zezheng, et al.
Pubblicazione: (2024)
di: Li, Zezheng, et al.
Pubblicazione: (2024)
TAID: Temporally Adaptive Interpolated Distillation for Efficient Knowledge Transfer in Language Models
di: Shing, Makoto, et al.
Pubblicazione: (2025)
di: Shing, Makoto, et al.
Pubblicazione: (2025)
Preference Optimization by Estimating the Ratio of the Data Distribution
di: Kim, Yeongmin, et al.
Pubblicazione: (2025)
di: Kim, Yeongmin, et al.
Pubblicazione: (2025)
ixi-GEN: Efficient Industrial sLLMs through Domain Adaptive Continual Pretraining
di: Kim, Seonwu, et al.
Pubblicazione: (2025)
di: Kim, Seonwu, et al.
Pubblicazione: (2025)
Injecting linguistic knowledge into BERT for Dialogue State Tracking
di: Feng, Xiaohan, et al.
Pubblicazione: (2023)
di: Feng, Xiaohan, et al.
Pubblicazione: (2023)
Structural Rationale Distillation via Reasoning Space Compression
di: Yang, Jialin, et al.
Pubblicazione: (2026)
di: Yang, Jialin, et al.
Pubblicazione: (2026)
BERT Learns (and Teaches) Chemistry
di: Payne, Josh, et al.
Pubblicazione: (2020)
di: Payne, Josh, et al.
Pubblicazione: (2020)
Binary Classifier Optimization for Large Language Model Alignment
di: Jung, Seungjae, et al.
Pubblicazione: (2024)
di: Jung, Seungjae, et al.
Pubblicazione: (2024)
On the Robustness of Reward Models for Language Model Alignment
di: Hong, Jiwoo, et al.
Pubblicazione: (2025)
di: Hong, Jiwoo, et al.
Pubblicazione: (2025)
Documenti analoghi
-
Multiple Invertible and Partial-Equivariant Function for Latent Vector Transformation to Enhance Disentanglement in VAEs
di: Jung, Hee-Jun, et al.
Pubblicazione: (2025) -
CFASL: Composite Factor-Aligned Symmetry Learning for Disentanglement in Variational AutoEncoder
di: Jung, Hee-Jun, et al.
Pubblicazione: (2024) -
Explain in Your Own Words: Improving Reasoning via Token-Selective Dual Knowledge Distillation
di: Kim, Minsang, et al.
Pubblicazione: (2026) -
Reasoning Distillation and Structural Alignment for Improved Code Generation
di: Jalilifard, Amir, et al.
Pubblicazione: (2025) -
PSYCHE: A Multi-faceted Patient Simulation Framework for Evaluation of Psychiatric Assessment Conversational Agents
di: Lee, Jingoo, et al.
Pubblicazione: (2025)